อัปเดตแวดวง AI & IT
สรุปข่าวและความเคลื่อนไหวล่าสุดให้เข้าใจง่าย พร้อมลิงก์ไปอ่าน/ดูต้นทางทุกข่าว
Microsoft ทุ่ม $2.5B ตั้ง Frontier Company ส่งวิศวกร AI ไปฝังตัวในบริษัทลูกค้า
Microsoft เปิดหน่วยธุรกิจใหม่ Frontier Company งบ 2.5 พันล้านดอลลาร์ คน 6,000 คน ส่งวิศวกรไปนั่งทำงานในบริษัทลูกค้าโดยตรง — สัญญาณว่าคอขวดของ AI องค์กรไม่ใช่ตัวโมเดลอีกต่อไป แต่คือ "ใครจะเอาไปใช้งานจริงให้ได้"

ศึกโมเดล AI กลางปี 2026: เก่งขึ้น ถูกลง และ open-weight ไล่จี้แนวหน้า
ปลายมิถุนายนถึงต้นกรกฎาคม สองเจ้าใหญ่ขยับพร้อมกัน — Anthropic ปล่อย Claude Sonnet 5 ที่ agentic แต่ถูกลง OpenAI ตามด้วย GPT-5.6 สามรุ่น Sol/Terra/Luna ขณะที่โมเดล open-weight อย่าง DeepSeek V4-Pro และ GLM-5.2 ไล่จี้จนเส้นแบ่งเริ่มเบลอ

Snowflake Summit 2026: ฟีเจอร์ใหม่ที่คนสาย Data ควรรู้
Snowflake เลิกให้คุณเลือกขนาด warehouse เอง (Adaptive Compute), ยกเครื่อง Cortex เป็นระบบ agent และเดิมพันทั้งบริษัทกับ 'agentic enterprise' — สรุปของที่ต้องรู้ + กระทบคนไทยยังไง

Distillation attack คืออะไร: ถอดบทเรียนจากกรณี Anthropic กล่าวหา Alibaba ดึงความสามารถ Claude
Anthropic กล่าวหาทีม Qwen ของ Alibaba ว่าใช้ 25,000 บัญชีปลอมยิงคำถามใส่ Claude เกือบ 29 ล้านครั้งเพื่อ 'distill' ความสามารถ — เคสนี้เปิดคำถามที่ทุกคนสาย AI ควรเข้าใจ: distillation คืออะไร ทำไมเป็นทั้งพระเอกและผู้ร้าย

Hyper-Extract: RAG ที่เลิกหั่น chunk แล้วหันมาสกัดเอกสารเป็นความรู้มีโครงสร้าง
เครื่องมือใหม่ Hyper-Extract เปลี่ยนเอกสารยุ่ง ๆ ให้เป็น knowledge graph/hypergraph ด้วยคำสั่งเดียว — สะท้อนเทรนด์ปี 2026 ที่ RAG กำลังขยับจาก หั่น chunk แล้วค้นหา ไปสู่ การสกัดเป็นความรู้มีโครงสร้าง ที่แม่นกว่าและรันในเครื่องได้

Ollama อัปเดต MLX: รัน AI บนเครื่อง Mac เร็วขึ้น 20%
Ollama รีดเครื่องยนต์ MLX บน Apple Silicon ใหม่ — เร็วขึ้นถึง 20%, รองรับการบีบอัดแบบ NVFP4 ที่คุณภาพหายน้อยลง และเพิ่มระบบ snapshot เพื่องาน AI agent โดยเฉพาะ คนใช้ MacBook ได้ของฟรีแค่กดอัปเดต
รัน AI ในเครื่องตัวเองปี 2026 ง่ายขึ้นมาก: อัปเดต Ollama, llama.cpp, LM Studio
เครื่องมือรัน LLM ในเครื่อง (Ollama, llama.cpp, vLLM, LM Studio, MLX) ออกอัปเดตชุดใหญ่ — เร็วขึ้น ติดตั้งง่ายขึ้น รองรับโมเดลใหม่มากขึ้น จนการรัน AI เองบนเครื่องกลายเป็นทางเลือกใช้งานจริงในระดับ production

GLM-5.2: โมเดลโค้ด open-weight ที่ทำคะแนนแซงโมเดลเสียเงิน
Zhipu AI ปล่อย GLM-5.2 ใต้ใบอนุญาต MIT — โมเดล MoE ราว 750B ที่ขึ้นนำ open-weight intelligence index และทำคะแนนใกล้ GPT-5.5 แต่ยังมีข้อควรระวังเรื่องเลขที่ยังไม่ verify และ API ที่โฮสต์ในจีน

Apple เปิด Foundation Models ให้เสียบ LLM ค่ายไหนก็ได้บน iPhone
WWDC 2026 — Apple เปิด framework on-device ให้ dev สลับใช้โมเดล Apple, Claude หรือ Gemini ด้วยโค้ดชุดเดียว พร้อมโมเดลใหม่ AFM 3 แบบ sparse 20B ที่รับภาพได้ และ Python SDK ที่รันบน Linux ได้

Gemma 4: โมเดลเปิดของ Google ที่ออกแบบมาให้รันบนเครื่องเราเอง ตั้งแต่มือถือยัน workstation
Google ปล่อย Gemma 4 ภายใต้ลิขสิทธิ์เปิด Apache 2.0 มาเป็น 4 ขนาด ตั้งแต่ 2B สำหรับมือถือยันรุ่น 31B — รองรับข้อความ ภาพ เสียง 140+ ภาษา context ยาว 256K และสั่งรันในเครื่องด้วยคำสั่งเดียว นี่คือก้าวสำคัญของยุค "AI อยู่บนเครื่องเรา"

Kimi K2.7-Code: โมเดลเขียนโค้ด open-weight 1 ล้านล้านพารามิเตอร์จาก Moonshot AI
Moonshot AI จากจีนปล่อย Kimi K2.7-Code โมเดล MoE ขนาด 1 ล้านล้านพารามิเตอร์ภายใต้ไลเซนส์เปิด ทำคะแนนเขียนโค้ดดีขึ้นกว่ารุ่นก่อนชัดเจน พร้อมลดการเผาโทเคนคิดวิเคราะห์ลง 30% แต่ก็มีข้อแม้ที่ต้องอ่านก่อนตื่นเต้น

ปี 2026 นักพัฒนา 42% รัน LLM บนเครื่องตัวเอง: เปิดศึก Ollama, llama.cpp, LM Studio
กระแส local-first มาแรง นักพัฒนากว่า 42% เริ่มรันโมเดลภาษาบนเครื่องตัวเองเพื่อความเป็นส่วนตัวและลดค่าคลาวด์ มาดูกันว่าเครื่องมือ 4 ตัวหลัก Ollama, llama.cpp, LM Studio, vLLM ต่างกันอย่างไร และตัวไหนเหมาะกับใคร

MiniMax M3: โมเดลโอเพนเวต์ที่ท้าชน GPT-5.5 ด้านเขียนโค้ด
สตาร์ทอัพจีน MiniMax ปล่อยโมเดล M3 แบบเปิดน้ำหนัก เคลมว่าเป็นตัวแรกที่รวมการเขียนโค้ดระดับแนวหน้า, หน้าต่างบริบท 1 ล้านโทเคน และมัลติโมดัลในตัวเดียว ทำคะแนน SWE-Bench Pro แซง GPT-5.5

AI รันบนมือถือได้จริงแล้วปี 2026 ไม่ต้องต่อเน็ต
เรือธงปี 2026 ทั้ง iPhone, Samsung และ Google รันโมเดล AI ขนาดเล็กบนเครื่องได้เองแบบออฟไลน์ ทั้ง Gemma 4 และโมเดลของ Apple เปิดทางให้แอปประมวลผลข้อมูลส่วนตัวโดยไม่ต้องส่งขึ้นคลาวด์

Context Engineering: ทักษะหลักใหม่ของ AI Engineer ปี 2026
รายงาน State of Agent Engineering ของ LangChain ชี้ว่า 57% ขององค์กรมี AI agent ใช้งานจริงแล้ว และทักษะที่สำคัญที่สุดของ AI Engineer ปีนี้ไม่ใช่การเขียน prompt สวย ๆ แต่คือการ "จัดบริบท" ให้โมเดล

Apple ยกเครื่อง Siri ใหม่ — เช่าสมอง Gemini ของ Google
Apple ยอมจ่าย Google ปีละราว 1,000 ล้านดอลลาร์ เช่าโมเดล Gemini ขนาด 1.2 ล้านล้านพารามิเตอร์มาเป็น "สมอง" ของ Siri โฉมใหม่ — สัญญาณว่าแม้ยักษ์อย่าง Apple ก็ยังตามเกม AI พื้นฐานไม่ทัน

สหรัฐสั่ง Anthropic ห้ามต่างชาติใช้ Fable 5 และ Mythos 5
รัฐบาลสหรัฐสั่งห้ามผู้ที่ไม่ใช่พลเมืองสหรัฐเข้าถึงสองโมเดลใหม่ล่าสุดของ Anthropic ด้วยเหตุผลความมั่นคง สุดท้าย Anthropic ปิดทั้งสองรุ่นกับผู้ใช้ทุกคน แล้วคนไทยกระทบแค่ไหน

Zuckerberg ยอมรับ Meta ทำพลาดในการปรับองค์กรสู่ AI
ในบันทึกภายใน Mark Zuckerberg ยอมรับว่า Meta ทำพลาดหลายอย่างระหว่างปรับองค์กรครั้งใหญ่เพื่อมุ่งสู่ AI พร้อมรับปากว่าจะไม่มีการปลดพนักงานทั้งบริษัทอีกในปีนี้

Coinbase for Agents เปิดให้ AI เทรดพอร์ตคริปโตอัตโนมัติ
Coinbase เปิดเครื่องมือให้ AI agent เทรดคริปโตและจ่ายเงินผ่านบัญชีของผู้ใช้ได้ ทั้งทาง MCP และ CLI พร้อมระบบจำกัดความเสี่ยง นับเป็นก้าวสำคัญของ AI ที่ขยับจากคุยเป็นลงมือทำธุรกรรมเงินจริง
