

ไม่ต้องเก่งแค่เริ่มแล้วทำต่อ
ข่าว AI ที่เดียวพอเลย
ไม่ต้องตามทุกข่าว เดี๋ยวผมคัดให้ — สรุปอัปเดต AI ที่สำคัญ
อ่านง่าย เข้าใจไว เอาไปใช้ต่อได้จริง
วันนี้มีอะไรใหม่?
Gemini 4 เริ่มเทรนจริงแล้ว — Google ยืนยัน "รันพรีเทรนใหญ่สุดเท่าที่เคยทำ" พร้อมเช็กพอยต์ลับโผล่ทดสอบใน Arena
- ยังเป็นเช็กพอยต์ ไม่ใช่รุ่นจริง
- ผลใน Arena/app ไม่ใช่ของเต็ม
- สเปกยังเป็นการคาดเดา
- ยังไม่แซงรุ่นท็อปคู่แข่ง
Hermes 0.19 "Quicksilver" — เริ่มงานไวขึ้น ~80% ต่อกับ Antigravity ให้ตัวหนึ่งคิด อีกตัวลงมือ
Hermes รุ่น 0.19 ลดเวลาเริ่มงานจากราว 4.5 วินาทีเหลือไม่ถึง 1 และเพิ่มระบบกันงานหาย ส่วน Antigravity ของ Google เปิด CLI ให้ Hermes สั่งงานตรงได้ กลายเป็นคู่หูตัวคิด-ตัวลงมือ
GPT-5.6 SOL ปะทะ Claude Opus 5 — สองเรือธงคนละสไตล์ ที่สกอร์การ์ดวัดกันคนละสนาม
SOL เก่งสายลุยงานยาวและคุมเครื่องมือ ส่วน Opus 5 เก่งสายวางแผนและตรวจงานตัวเอง แต่กราฟ benchmark ของสองค่ายวัดกันคนละวันคนละคู่แข่ง อ่านหาผู้ชนะตรง ๆ ไม่ได้
Qwen Image Flash — โมเดลสร้างภาพ 4 สเต็ปจาก Alibaba ที่ Nvidia จูนต่อให้ ใช้เชิงพาณิชย์ได้
Qwen Image Flash กลั่นโมเดลภาพตัวเต็มให้เหลือแค่ 4 สเต็ป โดย Nvidia ปล่อยเวอร์ชันจูนต่อบน Hugging Face จุดเด่นคือใส่ตัวหนังสือในภาพให้อ่านออกได้ดีที่สุดในกลุ่มโมเดลรันในเครื่อง และเปิดใช้เชิงพาณิชย์ได้
Microsoft Mage-Flow — โมเดลสร้าง/แก้ภาพโอเพนซอร์ส 4B รันในเครื่องฟรี สั่งงานผ่าน AI agent ได้
Microsoft ปล่อย Mage-Flow โมเดลสร้างและแก้ภาพโอเพนซอร์สขนาด 4B ใบอนุญาต MIT รันในเครื่องได้ฟรี สั่งงานผ่าน agent อย่าง Claude Desktop ได้ และเคลมว่าสู้โมเดลเปิดที่ใหญ่กว่าหลายเท่า
Impeccable — สกิลโอเพนซอร์สที่สอนให้ AI เลิกออกแบบหน้าเว็บหน้าตาเหมือนกันไปหมด
Impeccable เป็นสกิลออกแบบโอเพนซอร์ส Apache 2.0 ที่ติดตั้งเข้า AI coding agent แล้วเติมคลังคำศัพท์ด้านดีไซน์ พร้อมตัวตรวจ 41 กฎที่จับ "หน้าตา AI slop" ได้โดยไม่ต้องเรียกโมเดลและไม่เสียโทเคน
Gemini Spark เปิดให้แพ็ก AI Pro ในสหรัฐฯ — เอเจนต์ที่ลงมือทำงานในอีเมลและปฏิทินให้เอง
Google ขยาย Gemini Spark เอเจนต์ที่รับเป้าหมายแล้วไปลงมือทำงานจริงในแอป Workspace จากแพ็กแพงสุดลงมาที่แพ็ก AI Pro ราคาเดือนละ 19.99 ดอลลาร์ในสหรัฐฯ พร้อมทำงานพร้อมกันได้ถึง 15 งาน
LLaDA 2.2-flash — โมเดล diffusion โอเพนซอร์สที่แก้คำผิดของตัวเองได้ระหว่างเขียน
Inclusion AI จาก Ant Group เปิด LLaDA 2.2-flash โมเดลภาษาแบบ diffusion ที่เขียนข้อความทั้งก้อนพร้อมกันแล้วเกลาซ้ำ ๆ ลบและแทรกแก้ระหว่างทางได้ ออกแบบมาเพื่อเป็นเอเจนต์ที่ทำงานหลายขั้นโดยไม่พังกลางคัน โหลดน้ำหนักได้ฟรีบน Hugging Face
Microsoft เปิด Flint — ภาษากลางให้ AI เอเจนต์วาดกราฟให้ตรงและสวยด้วยสเปกไม่กี่บรรทัด
Microsoft Research เปิดโอเพนซอร์ส Flint ภาษากลางสำหรับสร้างกราฟ แยกงาน "ความหมาย" ที่ AI ถนัดออกจากงาน "เรขาคณิต" ที่ AI มักพลาด แล้วให้คอมไพเลอร์คำนวณแกน สเกล สีเอง ผลคือกราฟที่เอเจนต์สร้างแล้วไม่พังกลางทาง
Anthropic ลบ system prompt ของ Claude Code ทิ้งกว่า 80% — กฎ context engineering ใหม่ของ Claude 5
ทีม Claude Code ออกกฎ context engineering ชุดใหม่สำหรับโมเดลรุ่น Claude 5 พร้อมเผยว่าตัด system prompt ทิ้งกว่า 80% แล้วผลเทสต์โค้ดไม่ตก แนวคิดคือเลิกยัดกฎ แล้วให้โมเดลใช้วิจารณญาณแทน
ChatGPT เปิด cloud browser ให้ agent ทำงานหลังหน้า login ได้แล้ว
โหมด work ของ ChatGPT ให้ cloud browser เข้าหน้าเว็บที่ต้อง login ได้แล้ว โดยเรากรอกรหัสเองแล้วส่งคุมกลับให้ agent ทำต่อ และรหัสผ่านไม่ถูกโมเดลมองเห็น
Gemini Notebook เพิ่ม Collections จัดโน้ตเป็นโฟลเดอร์ — เปิดให้ทุกคนบนเว็บแล้ว
Google ปล่อยฟีเจอร์ Collections ใน Gemini Notebook (ชื่อใหม่ของ NotebookLM) ให้จัดกลุ่มโน้ตบุ๊กเป็นโฟลเดอร์ได้ เปิดใช้ครบ 100% ของผู้ใช้บนเว็บแล้ว
Claude Fable 5.1 หลุด — ลือจ่อออกสิงหาคม ราคาเท่าเดิม
มีรายงานหลุดถึงโมเดลใหม่ Claude Fable 5.1 ที่ว่ากันว่าจ่อเปิดตัวเดือนสิงหาคม ราคาคงเดิมเท่า Fable 5 แต่ทั้งหมดยังเป็นข่าวลือที่ Anthropic ยังไม่ยืนยัน
Grok 4.5 ปล่อยครบทุกแพลตฟอร์มพร้อมกัน — เข้า Word, Excel, PowerPoint ได้ด้วย
xAI ปล่อย Grok 4.5 ขึ้น grok.com, X และแอป iOS/Android พร้อมกันในวันเดียว พร้อมฝังเข้า Word, Excel, PowerPoint และ Outlook ผ่าน add-in ของ Microsoft เน้นทำงานยาวจบในตัว
ลองจริง Claude Opus 5 — เก่ง agent กับ reasoning ชัด แต่ผลเทสต์อิสระบอกว่ายัง "ไม่แซง" Fable 5 อย่างที่โฆษณา
เบนช์มาร์กทางการของ Opus 5 ดูแรงมาก แต่ผลทดสอบมือหนึ่งสำนักกลับพบว่ามันเสมอ Kimi K3 และลงต่ำกว่ารุ่นก่อนอย่าง Opus 4.8 ด้วยซ้ำ เก่งงาน agentic/reasoning จริง แต่ฝั่งภาพ 3D ถอยและเปลืองโทเคน
Claude Code เปิดพาเนล iOS Simulator บนเดสก์ท็อป — สร้างแอปเสร็จ กดเทสต์บนจอมือถือให้เองสด ๆ
อัปเดตใหม่ของ Claude Code เดสก์ท็อป เปิดหน้าจอ iOS Simulator ข้างห้องแชต ให้ AI สร้างแอป รันแอป แล้วแตะดูทีละหน้าจอเอง แต่มีเงื่อนไขเครื่อง แพลน และความปลอดภัยที่ต้องรู้ก่อนลอง
Kimi K3 จาก Moonshot — โมเดลโอเพนเวท 2.8 ล้านล้านพารามิเตอร์ที่เคลมแซงตัวปิด
Moonshot AI เปิด Kimi K3 โมเดลโอเพนเวทที่ใหญ่ที่สุดในตอนนี้ เคลมเทียบชั้น Fable 5 และ GPT-5.6 บนหลายเบนช์มาร์ก ราคาถูกกว่าราว 3 เท่า เตรียมปล่อยเวทบน Hugging Face 27 ก.ค.
Claude Opus 5 มาแล้ว — แรงขึ้นชัดในราคาเท่าเดิม เข้าใกล้ Fable 5 แต่ถูกกว่า
Anthropic ปล่อย Opus 5 ราคาเท่ารุ่น 4.8 เดิม แต่คะแนนงานโค้ดแบบ agent และการให้เหตุผลกระโดดขึ้นชัด บนหลายเบนช์มาร์กเข้าใกล้ Fable 5 ในราคาที่ถูกกว่า
Google Flow แจกเครดิตฟรี 50 ต่อวัน ถึงสิ้นเดือน ส.ค. — ลองทำงานภาพเคลื่อนไหว AI ได้ทุกวัน
Google ปล่อยเครดิต Flow ฟรี 50 หน่วยต่อวันจนถึง 31 ส.ค. ใช้สร้างงานภาพเคลื่อนไหวด้วย Veo 3.1 และ Gemini Omni Flash เครดิตหมดอายุรายวัน ไม่ทบไปวันถัดไป
Buzz จาก Block — เวิร์กสเปซโอเพนซอร์สที่ให้ AI เอเจนต์เป็นเพื่อนร่วมทีมเท่าคน
Block ของ Jack Dorsey เปิด Buzz เวิร์กสเปซแบบ Slack บวก GitHub รวมร่างบนโปรโตคอล Nostr ให้เอเจนต์มีตัวตนเข้ารหัสของตัวเอง โพสต์ รีวิวโค้ด รันงานได้เหมือนคน ทุกการกระทำเซ็นชื่อกำกับ
Poolside เปิด Laguna S 2.1 — โมเดลโค้ดโอเพนเวท 118B ที่ปลุกแค่ 8B ต่อครั้ง แต่สู้โมเดลใหญ่กว่าหลายเท่า
Poolside ปล่อยโมเดลโค้ดโอเพนเวท Laguna S 2.1 แบบ Mixture-of-Experts 118B พารามิเตอร์รวม แต่เปิดใช้จริงแค่ราว 8B ต่อ token ทำคะแนนสายเขียนโค้ดสูสีหรือแซงโมเดลที่ใหญ่กว่าหลายเท่า และดาวน์โหลดไปรันเองได้
Thinking Machines เปิด Inkling — โมเดลโอเพนเวท 975B ฟัง "เสียงดิบ" ได้ตรง ๆ เกิดมาเพื่อให้ fine-tune
แล็บของ Mira Murati ปล่อยโมเดลแรก Inkling โอเพนเวท 975B พารามิเตอร์ ใบอนุญาต Apache 2.0 รับ text/ภาพ/เสียงดิบเข้าตรง ๆ โดยไม่แปลงเป็นข้อความก่อน และวางตัวเป็นฐานสำหรับ fine-tune งานเฉพาะทาง
โมเดลลับ Cantus โผล่ใน Qoder — ตั้งราคาแพงกว่าเรือธง Qwen 3.8 Max ถึง 6 เท่า จนคนสงสัยว่าคืออะไร
Qoder แพลตฟอร์ม agentic coding ของ Alibaba เงียบ ๆ เพิ่มโมเดลลับชื่อ Cantus ที่ตั้งราคาแพงกว่าเรือธงตัวเองหลายเท่า พร้อมฟรีเทียร์และทดลอง pro 14 วันที่ให้ลอง Qwen 3.8 Max และ Kimi K3 ได้
Gemini แทรกเข้าทุกแอป Workspace — อวตารหน้าตัวเองใน Vids, เปลี่ยนชื่อเป็น Gemini Notebook, แถบแก้อีเมลใน Gmail
Google ไม่ได้ปล่อยโมเดลยักษ์ตัวเดียว แต่ทยอยเสริม Gemini เข้าไปในเครื่องมือ Workspace ที่ใช้กันทุกวัน ทั้งอวตารที่ใช้หน้าตัวเองใน Google Vids, การเปลี่ยนชื่อ NotebookLM เป็น Gemini Notebook, แถบแก้อีเมลใน Gmail และงานหลายภาษาใน Docs/Slides
OpenAI อัปเดต Codex — จำงานยาวข้ามวันได้ดีขึ้น เพิ่มโหมดรีวิวงานและ side chat
OpenAI ปล่อยอัปเดต Codex ที่เน้น workflow ไม่ใช่ความฉลาด ทั้งการจำ context ของโปรเจกต์ยาว ๆ ได้ดีขึ้น แถบ sidebar ใหม่ ระบบรีวิว/อนุมัติงานแบบสั่งลูกน้อง และ side chat ที่ถามแทรกได้โดยงานหลักไม่หยุด