แบรนด์
Claude
114 โพสต์
Anthropic กล่าวหา Alibaba ทำ distillation attack ครั้งใหญ่ — 25,000 บัญชี ดูดความสามารถ Claude
Anthropic กล่าวหากลุ่มที่เชื่อมโยงกับ Alibaba ว่าสร้างบัญชีปลอมเกือบ 25,000 บัญชี ดูดบทสนทนาจาก Claude ราว 28.8 ล้านครั้ง เพื่อกลั่นความสามารถด้านโค้ดและ agent มาเทรนโมเดลคู่แข่ง พร้อมระบุชื่อแล็บจีนอีกหลายเจ้า และส่งจดหมายถึงรัฐสภาให้เร่งจัดการ
Claude Code v2.1.187 — sandbox อ่านความลับไม่ได้แล้ว และ MCP ตัดที่ 5 นาที
อัปเดต Claude Code v2.1.187 มาพร้อม 21 การเปลี่ยนแปลง สองอันที่สำคัญคือ sandbox credentials ที่กันไม่ให้คำสั่งใน sandbox อ่านกุญแจและตัวแปรลับ กับการตัด MCP tool call ที่ค้างเกิน 5 นาทีทิ้งทันที พร้อมแก้บั๊กวางภาษาเกาหลีเพี้ยนและงานเบื้องหลังค้าง
สัญญาณ Claude Fable 5 กำลังจะกลับ — และอาจถูกรวมในแพ็กเกจ subscription
หลัง Fable 5 ถูกถอดไปเมื่อกลางเดือน มีสามร่องรอยที่ตรวจสอบได้โผล่พร้อมกัน ทั้งสตริงใน Claude Code, รายชื่อใน Amazon Bedrock และเอกสาร AWS ชี้ว่ามันอาจกำลังกลับ และอาจมาแบบรวมในแพ็กเกจพร้อมโควต้ารายสัปดาห์ แต่ยังไม่มีอะไรเป็นทางการ
ความจริงเรื่อง "ช่องคิด" ของ Claude Code และ Codex ที่ถูกเข้ารหัส และทำไม dev ต้องสนใจ
นักวิจัยแกะ log ของ Claude Code และ Codex แล้วพบว่าบล็อกความคิดของโมเดลถูกเข้ารหัสไว้ อ่านไม่ได้ และยัง replay ข้ามบัญชีได้ เปิดช่องความเสี่ยงสำหรับคนที่ทำแอปแชทรับ input ผู้ใช้ภายนอก
Anthropic เปิดตัว Claude Tag — Claude Code ที่ทั้งทีมใช้ร่วมกันได้ใน Slack
Anthropic ปล่อย Claude Tag วางตัวเป็น Claude Code เวอร์ชันออกแบบใหม่ให้ทั้งทีมใช้ ทำงานในแชนเนล Slack ที่ทุกคนเห็น พร้อม instance แยกต่อทีม สิทธิ์ข้อมูล และ audit log เต็ม
ลือ Anthropic ซุ่มของใหม่ — slug "Sonnet 5" โผล่ที่พาร์ตเนอร์ และ Mythos รุ่นใหม่เทรนเสร็จ
มีคนเจอ slug ของ Claude Sonnet 5 บนผู้ให้บริการพาร์ตเนอร์ของ Anthropic บวกกับข่าวว่า Mythos รุ่นที่เก่งขึ้นเทรนเสร็จแล้ว ทั้งหมดยังเป็นลือ ยังไม่มีอะไรประกาศทางการ
Claude Code v2.1.185 — รอ server นานขึ้นก่อน retry งานยาวล้มกลางคันน้อยลง
Claude Code v2.1.185 ยืดเวลารอ server จาก 10 เป็น 20 วินาทีก่อนจะ retry และปรับ recovery ให้อยู่บน fast path นานขึ้น เป็นการแก้ที่ "ท่อ" เพื่อให้ agent รันงานยาวโดยไม่ต้องเฝ้าได้เสถียรขึ้น
GLM 5.2 ผ่านเบนช์มาร์กอิสระ — โอเพนอันดับต้น หลอนต่ำสุด และรันที่บ้านได้แล้ว
หลังเปิดตัว GLM 5.2 มีข้อมูลจากหลายสำนักออกมา ทั้งขึ้นอันดับต้นของโอเพนบน AA Index, hallucination ต่ำสุดในกลุ่ม frontier, ติดอันดับ 3 บนเบนช์งานยาวที่เพิ่งสร้าง และชุมชนทำเวอร์ชันบีบอัดให้รันที่บ้านได้ใน 2 วัน
บริษัทเริ่มถอย "เอา AI แทนคน" — ต้นทุน token แพงกว่าจ้างคน งานยังพึ่ง AI ล้วนไม่ได้
หลายบริษัทใหญ่กำลังถอยจากแผนแทนพนักงานด้วย AI หลังเจอทั้งคุณภาพตก ต้นทุน token ที่แพงกว่าค่าคน และโครงการนำร่องที่ไม่เกิดผล บทเรียนคือ AI แทน task ได้ แต่ยังแทนทั้ง job ไม่ได้
Claude Code เพิ่ม Artifacts — เปลี่ยน session เป็นหน้าเว็บ live ให้ทีมเปิดดูพร้อมกัน
Claude Code เพิ่มฟีเจอร์ Artifacts ที่เปลี่ยนงานจาก session เป็นหน้าเว็บ interactive อัปเดต live แชร์ในองค์กรได้ มี version history ครบ กำลังเปิด beta บนแพลน Team และ Enterprise
Claude Code 2.1.181 — ตั้งค่าในบรรทัดเดียวด้วย /config และแก้บั๊กไฟล์ว่างบนโฟลเดอร์ซิงก์
อัปเดตรายสัปดาห์ของ Claude Code มาพร้อม 39 การเปลี่ยนแปลง ไฮไลต์คือคำสั่ง /config ตั้งค่าในบรรทัดเดียว และการแก้บั๊กไฟล์ว่าง/ขาดบนโฟลเดอร์ OneDrive และ Google Drive
GLM 5.2 ขึ้นอันดับ 1 ดีไซน์เว็บบน Design Arena — โมเดลโอเพนตัวแรกที่แซงสาย Claude
หลังเปิดตัวด้วยตัวเลขผู้ผลิต รอบนี้ GLM 5.2 ขึ้นอันดับ 1 ดีไซน์เว็บ single-turn บน Design Arena แซงทั้งสาย Claude รวม Fable 5 ในราคาประมาณ 1/10 ของรุ่นพรีเมียม
Google DeepMind สะเทือน — สองหัวกะทิระดับโลกลาออกในสัปดาห์เดียว โมเดลร่วงอันดับ 5
คนเขียนเปเปอร์ Transformer และเจ้าของรางวัลโนเบล AlphaFold ลาออกจาก Google ในสัปดาห์เดียวกัน ขณะที่โมเดลที่ดีที่สุดของ Google ตกไปอันดับ 5 บนกระดานวัดความฉลาด
ponytail ภาคต่อ — เทสต์อิสระชี้ Opus 4.8 ประหยัด 53% เร็วขึ้น 71% แตะ 40,000 ดาวใน 7 วัน
หลังกระแสแรกของ ponytail รอบนี้มีคนรันเบนช์มาร์กอิสระ พบว่ายิ่งใช้โมเดลแพงอย่าง Opus 4.8 ยิ่งคุ้ม ประหยัด 53% เร็วขึ้น 71% และโค้ดน้อยลง 71%
Microsoft Copilot Co-work เปิดใช้ทั่วโลก — agent ทำงานยาวได้ แต่คิดเงินตามใช้จริง
Copilot Co-work เวอร์ชัน agent ที่รับงานยาว ๆ ไปทำเองในคลาวด์ เปิดใช้ทั่วไปแล้ว พร้อมเปลี่ยนมาคิดเงินตามการใช้งานจริง และมีข่าวว่า Microsoft กำลังส่อง DeepSeek เป็นตัวเลือกรุ่นประหยัด
สร้าง second brain ให้ Claude Code — 5 ระดับ เลือกให้พอดีกับงาน
คู่มือสร้างคลังความรู้ส่วนตัวให้ Claude Code จากไฟล์ markdown ธรรมดา ไล่ตั้งแต่ระดับ routing พื้นฐานไปจนถึง knowledge graph และระบบที่อัปเดตตัวเองตลอดเวลา พร้อมข้อห้ามเรื่องข้อมูลบริษัท
Claude Design อัปเดต — จำแบรนด์ได้ แก้บนแคนวาส แล้วส่งตรงเข้า Claude Code
Anthropic อัปเดต Claude Design ให้จำสี ฟอนต์ โลโก้แบรนด์ได้อัตโนมัติ แก้งานบนแคนวาสได้ตรง ๆ และซิงค์กับ Claude Code เพื่อแปลงดีไซน์เป็นเว็บจริงโดยไม่ต้องเริ่มใหม่
Claude Code 2.1.178 — ปิดช่องโหว่ sub-agent ขอสิทธิ์เกินตัว
เวอร์ชันใหม่ตรวจ sub-agent ก่อนปล่อยให้ทำงาน ปิดช่องที่ลูกทีมเคยขอสิ่งที่ตัวหลักถูกห้าม พร้อม wildcard สำหรับล็อก permission ระดับไฟล์
Anthropic ให้ Agent SDK กับ claude -p ใช้โควต้า subscription ต่อ ไม่คิดเงินเพิ่ม
Anthropic ยืนยันว่า Claude Agent SDK, claude -p และแอปของบุคคลที่สามที่สร้างบน Agent SDK จะดึงโควต้าจาก subscription ของผู้ใช้ต่อไป และไม่เดินหน้าแผนที่เคยพูดถึงว่าจะคิดเครดิตเพิ่ม $200 ตามราคา API สำหรับการใช้งานแบบนี้
agent ลงมือทำได้ แต่ทำนายผลไม่ได้ ทำไมต้องมี Human Gate
นักวิจัยกลุ่มหนึ่งเตือนว่า LLM สั่งงานเป็น agent ได้ แต่คาดเดาผลของการกระทำตัวเองไม่แม่น งานที่ย้อนคืนไม่ได้จึงต้องมีคนกั้นก่อนเสมอ