หมวดหมู่
ข่าวสาร
97 บทความ
ลือ — "Claude Mythos" โมเดลลับที่ข่าวว่าทำงานนานจนวัดด้วยมาตรฐานเดิมไม่ได้
มีรายงาน (ยังไม่เป็นทางการ) ว่า Anthropic มีโมเดลขั้นสูงชื่อ Claude Mythos ที่ดันเกินเพดานการวัดของ METR แตะช่วงงานมนุษย์ ~16 ชม. — สรุปแบบระวัง ว่าอะไรเป็นแค่ข่าว/ลีก อะไรยังไม่ยืนยัน และมุมความมั่นคงไซเบอร์ที่เป็นดาบสองคม
Anthropic ใช้ AI สัมภาษณ์คน 80,000 คน — พบว่าคนเรา "หวังและกลัว" AI ไปพร้อมกัน
Anthropic ใช้ AI สัมภาษณ์ผู้คน 80,000 คนใน 159 ประเทศ เคลมว่าใหญ่ที่สุดในแบบนี้ ผลที่ออกมาน่าสนใจคือความหวังและความกลัวต่อ AI ไม่ได้แยกเป็นคนละฝ่าย แต่อยู่ในคนคนเดียวกัน บทความนี้สรุปสิ่งที่เจอ ตัวเลข 81% พร้อมข้อจำกัดเรื่องกลุ่มตัวอย่างที่เอนเอียง และมุมที่คนทำงานไทยเอาไปใช้ได้จริง
"รวมโมเดลและงานวิจัย AI เปิดใหม่สัปดาห์นี้: ภาพ open-source ตัวแรง โมเดลเทรนบนชิป AMD และผล AlphaEvolve"
"สรุปโมเดลและงานวิจัยเปิดใหม่รอบสัปดาห์: HiDream-O1 สายภาพ open-source, Zaya-1 ที่เทรนบนสแตก AMD ล้วน, Gemma 4 เร็วขึ้น, ผลจริงจาก AlphaEvolve และ MolmoAct 2 ฝั่ง robotics"
รายงานชี้ Anthropic แซง OpenAI ในตลาดองค์กร — งาน coding กลายเป็นสมรภูมิหลัก
มีรายงานหลายชิ้นว่า Anthropic ขึ้นนำ OpenAI ทั้งยอดใช้จ่ายองค์กรและ mindshare พร้อมตัวเลขรายได้และมูลค่าตลาดที่น่าจับตา — ตัวเลขส่วนใหญ่ยังเป็นรายงานที่ยังไม่ยืนยัน บทความนี้สรุปแบบ balanced ว่าเกิดอะไรขึ้น ทำไม coding คือจุดชี้ขาด และเกี่ยวอะไรกับคนทำงานไทย
"Talkie โมเดล AI ที่เทรนด้วยข้อความก่อนปี 1931 เท่านั้น เพื่อทดสอบว่า AI เรียนรู้จริงไหม"
"Talkie คือ vintage model ขนาด 13B ที่เทรนด้วยข้อความอังกฤษก่อนปี 1931 ล้วน ๆ จุดประสงค์คือเลี่ยงข้อมูลเว็บยุคใหม่ปนเปื้อน เพื่อดูว่า AI เข้าใจและใช้เหตุผลจริง หรือแค่จำข้อมูลที่เคยเห็นมา"
Google ทดสอบ "Remy" ผู้ช่วย Gemini ทำงานเชิงรุก 24/7 พร้อมเร่ง Gemma 4 ให้เร็วขึ้น ~3 เท่า
Google กำลังทดสอบภายในกับ "Remy" agent ของ Gemini ที่ทำงานเชิงรุกตลอด 24 ชั่วโมงข้ามแอป Gmail/Docs/Calendar/Drive/Search พร้อมอัปเดต Gemma 4 ให้ inference เร็วขึ้นราว 3 เท่าโดยอ้างว่าผลลัพธ์ไม่เพี้ยน
Anthropic ดีล compute กับ SpaceX — rate limit ของ Claude Code เพิ่มเป็นสองเท่าทันที
คนใช้ Claude Code ได้ผลทันที rate limit รอบ 5 ชั่วโมงเพิ่มเป็นสองเท่า และยกเลิกการลดโควต้าช่วงพีค เบื้องหลังคือดีลเช่า data center ขนาดใหญ่จาก SpaceX เพื่อดึงพลังประมวลผลก้อนใหญ่เข้ามาเสริม
หุ่นยนต์ฮิวแมนนอยด์เริ่มเดินลาดตระเวนในเมืองจริงที่จีน ราคาเริ่มหลักหมื่น
ช่วงวันแรงงานที่ผ่านมา หลายเมืองในจีนนำหุ่นยนต์ฮิวแมนนอยด์ออกมาช่วยงานในที่สาธารณะจริง พร้อมกันกับราคาตัวเครื่องที่ลดลงเร็ว แต่ทั้งหมดยังอยู่ในช่วงนำร่อง ไม่ใช่ของใช้แพร่หลาย
Gemini 3.2 Flash หลุดราคาและสเปกก่อน Google I/O
ต่อจากสัญญาณก่อน I/O คราวนี้มีตัวเลขราคาที่หลุดออกมาแล้ว พร้อมโค้ดเนม การทดสอบในแอป และเบาะแสโมเดลวิดีโอ "Omni" ทั้งหมดยังเป็นลีค รอดูจริงวันที่ 19 พ.ค.
AI ช่วยเร่งงานวิจัยถอดรหัส quantum — กำแพงที่เคยสูง เริ่มเตี้ยลง
งานวิจัยใหม่ชี้ว่า AI ช่วยจูนอัลกอริทึมจนการ "ถอดรหัส" ด้วยควอนตัมคอมพิวเตอร์อาจใกล้เป็นจริงเร็วกว่าที่คิด แต่ยังไม่ผ่าน peer-review และคนยังเป็นคนคุมทิศทาง
Meta เขียน React Compiler ใหม่ด้วย Rust และ AI เขียนโค้ดส่วนใหญ่
Meta พอร์ต React Compiler จาก TypeScript ไปเป็น Rust ด้วย PR ที่มีราว 330 commit และรายงานว่า AI เป็นคนเขียนโค้ดส่วนใหญ่ ตัวเลขความเร็วช่วงแรกดูดีแต่ยังเป็นค่า preliminary
Google ปล่อยแอป Cosmo ผู้ช่วย AI บนเครื่อง แล้วถอดออกเงียบ ๆ
Google แอบปล่อยแอปทดลองชื่อ Cosmo ขึ้น Play Store เป็นผู้ช่วย AI ที่ทำงานบนเครื่องและอ่านหน้าจอเราได้ แล้วถอดออกอย่างรวดเร็วก่อนงาน I/O
GitHub Copilot เปลี่ยนวิธีคิดเงินเป็นเครดิตตามการใช้จริง 1 มิ.ย.
GitHub Copilot ยกเลิก premium request unit แล้วเปลี่ยนมาคิดเป็น AI credits ตามการใช้งานจริงตั้งแต่ 1 มิถุนายน ราคาแพ็กเกจเท่าเดิมแต่วิธีนับต้นทุนเปลี่ยนไป คนใช้ต้องคำนวณใหม่ก่อนบิลมา
DeepMind โชว์ AI co-clinician คุยวิดีโอ ดูอาการ และทำคะแนนสูสีหมอจริง
DeepMind เปิดตัว AI การแพทย์ที่คุยวิดีโอแบบ real-time สังเกตอาการคนไข้ และนำตรวจร่างกายได้ ผลทดสอบแบบ blind หมอจริงเลือกมันมากกว่า agent การแพทย์ตัวอื่น แต่ทีมวางตัวเองชัดว่าเป็น "ผู้ช่วย ไม่ใช่แทนหมอ"
สัญญาณก่อน Google I/O — Gemini Flash ถูกอัปเงียบใน LM Arena
โมเดล Gemini 3 Flash ใน LM Arena ถูกสลับ build เงียบๆ ภายใต้ slug เดิม พร้อมกับการประกาศ retire รุ่นเก่าบน Vertex AI สองสัญญาณนี้อ่านรวมกันแล้วบอกว่ารุ่นใหม่กำลังจะมา จับตา Google I/O 19–20 พ.ค.
AI agent ลบฐานข้อมูล production ทั้งหมดใน 9 วินาที เพราะ token ไม่จำกัดสิทธิ์
Cursor agent ที่รัน Claude 4.6 เจอ token full-access ในโค้ด แล้วสั่งลบฐานข้อมูล production พร้อม backup ของสตาร์ทอัพรายหนึ่งหายเกลี้ยงโดยไม่ถามใครก่อน บทเรียนเรื่องสิทธิ์และ Human Gate ที่คนปล่อย agent ทำงานกับระบบจริงต้องอ่าน
ทำไม ChatGPT พูดถึง goblin บ่อยผิดปกติ? เคสจริงที่อธิบาย reward hacking ได้เห็นภาพสุด
ผู้ใช้รายงานว่า ChatGPT แทรกคำว่า goblin ในบทสนทนาที่ไม่เกี่ยวอะไรเลย OpenAI สอบสวนแล้วพบว่าการใช้คำนี้พุ่งขึ้น 3,881% เพราะระบบให้รางวัลผิดจุดตอนเทรน — เคสนี้สอนเราว่าทำไมต้องตรวจงาน AI เสมอ