บทความและข่าวสาร
AI อัปเดต
สรุปข่าว รีวิว และวิธีใช้ AI แบบเจาะลึก เลือกช่วงสัปดาห์ที่อยากอ่านได้เลย
Gemini Omni Flash ใน Google Flow แก้วิดีโอที่ถ่ายไว้แล้วด้วยการพิมพ์สั่ง เปลี่ยนตัวละคร เปลี่ยนฉากได้
- เอาฟุตเทจเก่ามาต่อยอด
- เทสต์หลายไอเดียจากฟุตเทจเดียว
- Flow Agent
- ต่อยอดถึงเพลง
Gemini Spark เปิด Auto Browse สั่งงานทีเดียว ให้ AI เปิดเว็บ คลิก กรอกฟอร์มเองใน Chrome
Google เพิ่มความสามารถ Auto Browse ให้ Gemini Spark ลงมือทำงานบนเว็บได้เอง เปิดหน้า คลิกลิงก์ กรอกฟอร์ม และใช้บัญชีที่ล็อกอินไว้ โดยต้องโชว์แผนให้เราอนุมัติก่อนทุกครั้ง
สกิล I have ADHD สำหรับ Claude Code บังคับให้ AI ตอบสั้น ลงมือก่อน ตัดคำเกริ่นทิ้งทั้งหมด
ปลั๊กอินโอเพนซอร์ส I have ADHD สำหรับ Claude Code รีฟอร์แมตคำตอบให้ขึ้นต้นด้วยแอ็กชัน เป็นข้อ ตัดคำเกริ่นและคำปิดท้ายทิ้ง ติดตั้งสองนาที ใช้ได้กับ Codex และ DeepSeek ด้วย
Hermes Agent 0.20 Herald มาแล้ว คุยด้วยเสียงแบบขัดจังหวะได้ พร้อมโหมดอ้างอิงแหล่งที่ตรวจสอบได้
Nous Research ปล่อย Hermes Agent 0.20 ชื่อ Herald เพิ่มโหมดเสียงสตรีมที่พูดแทรกได้ โหมด grounded citations ที่ทุกคำอ้างมีแหล่งตรวจได้ ขยายลิมิตทูลจาก 90 เป็น 500 สเต็ป และเปิด plugin SDK
Caveman สกิลฟรีที่สั่งให้ Claude Code พูดสั้นลง — ลด output token ราว 65%
สกิลโอเพนซอร์สตัวเดียว สั่งให้ agent ตัดคำเยิ่นเย้อแล้วตอบสั้น ๆ ลด output token เฉลี่ยราว 65% โดยยังได้คำตอบเทคนิคครบ เหมาะกับ Fable 5 ที่ค่า output แพงเป็นพิเศษ
OmniRoute เกตเวย์ AI โอเพนซอร์ส — ต่อ Claude Code, Cursor เข้ากับโมเดลฟรีหลายสิบเจ้าในเอนด์พอยต์เดียว
proxy โอเพนซอร์สที่รันในเครื่อง เปิดเอนด์พอยต์เดียวแล้วสลับ provider ให้อัตโนมัติเมื่อโควตาหมด รวมโมเดลฟรีหลายสิบเจ้าไว้ในที่เดียว เขียนโค้ดต่อได้ไม่สะดุด
ลดการเผา token ใน Claude Fable 5 — 10 วิธีจัดการก่อนหมดโควตา
Fable 5 เก่งแต่กิน token หนักและใช้ได้แค่ครึ่งโควตา รวมวิธีลดการใช้ตั้งแต่จัดโมเดลให้ถูกงาน ปรับ effort ไปจนถึงเครื่องมือโอเพนซอร์สอย่าง Headroom และ Ponytail
Meetily แอปจดประชุมโอเพนซอร์ส ประมวลผลในเครื่อง 100% — ไม่มีบอทโผล่ในห้อง
เครื่องมือจดโน้ตประชุมแบบเปิดซอร์สที่ไม่ส่งบอทเข้าห้องและไม่ส่งเสียงขึ้นคลาวด์ ถอดเสียงสดในเครื่อง แล้วให้เราเลือกเองว่าจะสรุปด้วยโมเดลในเครื่องหรือ API
Agents A1 โมเดล agent 35B ของ InternScience — เล็ก รันในเครื่อง แต่ล้มโมเดลระดับล้านล้านพารามิเตอร์
โมเดล MoE 35B จากแล็บ InternScience เปิดซอร์ส Apache 2.0 ใช้พารามิเตอร์ทำงานจริงแค่ 3B รันบน Mac ได้ ทำคะแนน search และ instruction following ระดับ SOTA เหนือโมเดลยักษ์
Hermes Agent v0.18 — เวอร์ชันที่ทำให้ agent รู้ว่างานเสร็จจริงไหม แถมเห็นความจำได้
อัปเดต v0.18 ของ Hermes Agent เน้นให้ agent ตรวจงานตัวเองว่าเสร็จจริงหรือแค่เดา เพิ่ม completion contracts ปิดบั๊กสำคัญหมดทั้งรีโป และเปิดให้ไล่ดูหรือลบความจำที่ agent เก็บไว้ได้
Tracer ออกแอปเดสก์ท็อป — รวม Claude Code, Codex, Cursor ให้ทำงานร่วมกันในที่เดียว
Tracer เปิดแอปเดสก์ท็อปที่เอา coding agent ที่เราจ่ายอยู่แล้วมาทำงานร่วมกันในเวิร์กสเปซเดียว ส่ง context ต่อกันได้ไม่ต้องก็อปไปมา แถมแพลนเริ่มต้นฟรีและเปิดซอร์ส
Gemma 4 รันในเครื่องเร็วขึ้นเกือบเท่าตัว — บิลด์ MLX ลง Ollama บน Apple Silicon แล้ว
Gemma 4 มีบิลด์ MLX ใน Ollama ทำให้รันบน Mac Apple Silicon เร็วขึ้นมาก จากราว 50 เป็น 95 tokens ต่อวินาที เป็นโมเดลฟรีที่รันออฟไลน์ในเครื่องได้
Claude Fable 5 กลับมาแล้ว — แพงกว่า Opus เท่าตัว มี effort 4 ระดับ และช่วงโปรถึง 7 ก.ค.
Anthropic เปิด Fable 5 ให้ใช้อีกครั้ง เป็นรุ่นแรงสุดของค่าย ราคา $10/$50 ต่อล้านโทเค็น มีระดับความพยายาม 4 step และช่วงโปรให้ใช้ฟรีบางส่วนถึง 7 กรกฎาคม
Google ออก Nano Banana 2 Lite — สร้างภาพใน 4 วินาที บวก Gemini Omniflash โมเดลวิดีโอ
Google เปิดโมเดลภาพเร็วสุด Nano Banana 2 Lite ทำภาพในราว 4 วินาที และปล่อย Gemini Omniflash โมเดลวิดีโอที่แก้ด้วยภาษาธรรมดาได้ ทั้งคู่พร้อมใช้ผ่าน AI Studio และ Gemini API
NotebookLM ทำวิดีโอสั้นแนวตั้ง 60 วินาที — ป้อนโน้ต ได้งานลงโซเชียล
NotebookLM เพิ่มฟีเจอร์ short video overviews สร้างวิดีโอแนวตั้ง 60 วินาทีจากโน้ตของเรา เหมาะกับโซเชียล เริ่มปล่อยให้ผู้ใช้ AI Ultra และ Pro ก่อน
OpenClaw ลงแอปมือถือแล้ว — ผู้ช่วย AI ที่รันบนเครื่องเรา สั่งผ่าน iPhone/Android
OpenClaw ผู้ช่วย AI โอเพนซอร์สแบบ self-hosted ออกแอปเนทีฟบน App Store และ Google Play แต่ตัวหลักยังต้องรันบนคอมของเรา มือถือทำหน้าที่เป็นรีโมตที่จับคู่ผ่าน QR
Hermes Agent อัปเดต Kanban — หลาย agent ทำงานขนานบนบอร์ดเดียว ไม่ค้างกันแล้ว
Hermes Agent ออกอัปเดตบอร์ด Kanban แก้ปัญหาคอขวดที่ทำให้ agent ค้างกัน ย้ายการเซฟช้าไปทำเบื้องหลัง ให้หลาย agent รันขนานได้จริง พร้อมระบบเก็บประวัติและส่งงานให้คนตรวจเมื่อพลาดซ้ำ
Meituan LongCat 2.0 — โมเดลเปิด 1.6 ล้านล้านพารามิเตอร์ ฝึกบนชิปนอกค่าย Nvidia
บริษัทส่งอาหารจีน Meituan ปล่อย LongCat 2.0 โมเดล MoE ขนาด 1.6 ล้านล้านพารามิเตอร์ ที่อาจเป็นโมเดลเปิดใหญ่ที่สุดเท่าที่เคยมี จุดที่น่าสนใจกว่าขนาดคือมันฝึกบนฮาร์ดแวร์ที่ไม่ใช่ Nvidia
Claude Sonnet 5 ออกแล้ว — agentic ขึ้นชัด แต่ tokenizer ใหม่ทำให้คุ้มน้อยกว่าที่คิด
Anthropic ปล่อย Claude Sonnet 5 รุ่น agentic ที่สุดของสาย Sonnet เบนช์มาร์กไล่จี้ Opus 4.8 แต่ของจริงมีกับดักเรื่อง tokenizer ใหม่และส่วนต่างราคาที่บางจนน่าคิดว่าจะใช้แทน Opus คุ้มไหม
Hermes Agent เพิ่ม Mixture of Agents — ผสมหลายโมเดลให้ช่วยกันคิด แล้วมีตัวรวมคำตอบ
Hermes Agent เปิดฟีเจอร์ Mixture of Agents ให้หลายโมเดลตอบขนานกันแล้วส่งให้โมเดลตัวรวมตัดสินคำตอบสุดท้าย ออกแบบมาสำหรับงานยาก ๆ ไม่ใช่งานเร็ว และแลกมาด้วยค่าใช้จ่ายที่สูงขึ้น
GLM-5.2 โมเดลโค้ดดิ้งโอเพนซอร์ส — context ล้านโทเค็น เปิดให้รันเองได้
z.ai ปล่อย GLM-5.2 โมเดลเปิดสายโค้ด context 1 ล้านโทเค็น รันเองได้หรือเสียบเข้า agent ที่ใช้อยู่ ผลทดสอบหนึ่งสำนักบอกว่าใกล้รุ่นท็อปแบบปิดในงานสร้างจริง แต่ยังตามอยู่บนเบนช์มาร์กที่ยากที่สุด
OpenTag — ทางเลือกโอเพนซอร์สแทน Claude Tag ใช้โมเดลไหน/แชตไหนก็ได้
หลัง Claude Tag เปิดตัวไม่ถึงสัปดาห์ ก็มีเวอร์ชันโอเพนซอร์สชื่อ OpenTag ออกตามมา ใช้โมเดลอะไรก็ได้ โฮสต์เอง มี audit trail แลกกับการติดตั้งที่ยังไม่ใช่กดปุ่มเดียวจบ