30 กันยายน 2569
ที่มา: 9to5Google
หมวด: ปัญญาประดิษฐ์
การแข่งขันโมเดล AI ขยับจากการตอบคำถามสั้น ๆ ไปสู่การทำงานยาวหลายขั้นตอนแทนคน Google เปิดตัว Gemini 4 Argon โมเดลระดับแนวหน้า (frontier model) รุ่นใหม่ ที่ออกแบบมาสำหรับงานที่ต้องคิดต่อเนื่องหลายชั่วโมง เช่น เขียนและแก้โค้ดทั้งโปรเจกต์ ค้นคว้ากฎหมาย วิเคราะห์การเงิน และทำความเข้าใจวิดีโอ จุดที่เปลี่ยนชัดที่สุดคือตอบกลับได้ยาวสูงสุด 1 ล้านโทเคนต่อครั้ง จากเดิม 64,000 โทเคน โทเคนคือหน่วยย่อยของข้อความที่โมเดลใช้นับความยาว
Google ระบุว่า Gemini 4 Argon เก่งขึ้นทั้งการเขียนโค้ด การให้เหตุผล และการทำงานกับข้อมูลหลายรูปแบบ และชูจุดแข็งเฉพาะด้าน 4 เรื่อง คือการป้องกันภัยไซเบอร์ งานค้นคว้ากฎหมาย การวิเคราะห์การเงิน และการทำความเข้าใจวิดีโอ ความสามารถตอบยาวขึ้นมากทำให้โมเดลส่งงานชิ้นใหญ่กลับมาได้ในครั้งเดียว เช่น โค้ดหลายไฟล์หรือรายงานยาวทั้งฉบับ แทนการแบ่งคำขอเป็นหลายรอบ
ผลทดสอบที่ Google เผยแพร่ ได้แก่ DeepSWE v1.1 ซึ่งวัดการแก้งานเขียนโปรแกรมจริง ได้ 77.9% สูงกว่าโมเดลคู่แข่งรุ่นปัจจุบันที่อยู่ราว 74% ชุดทดสอบ AutomationBench ซึ่งวัดการทำงานอัตโนมัติหลายขั้นตอน ได้ 51.3% เป็นอันดับหนึ่ง ชุดทดสอบด้านช่องโหว่ซอฟต์แวร์ CWE-bench ได้ 68% อยู่ในกลุ่มอันดับหนึ่ง และการทำความเข้าใจวิดีโอยาว LVBench ได้ 91.7% ตัวเลขเหล่านี้เป็นผลที่ผู้พัฒนาวัดเอง ควรรอผลทดสอบอิสระประกอบก่อนตัดสินใจ
โมเดลเริ่มเปิดให้สมาชิก Google AI Ultra และลูกค้า API แบบเสียเงินก่อน ราคาช่วงแนะนำอยู่ที่ 2 ดอลลาร์ต่อหนึ่งล้านโทเคนขาเข้า และ 10 ดอลลาร์ต่อหนึ่งล้านโทเคนขาออก ก่อนปรับเป็น 4 และ 20 ดอลลาร์หลังจบช่วงโปรโมชัน Google ระบุว่าก่อนเปิดกว้างได้เพิ่มการป้องกันการนำไปใช้ในทางที่ผิด การกันการโจมตีด้วยการแทรกคำสั่ง (prompt injection) การรันในสภาพแวดล้อมแยก (sandbox) และการเฝ้าดูพฤติกรรมที่ไม่ตรงกับเจตนา
สำหรับคนทั่วไป การเปลี่ยนแปลงนี้จะค่อย ๆ เข้ามาในแอปและบริการที่ใช้ Gemini เป็นฐาน ส่วนทีมพัฒนา สิ่งที่น่าทดลองคืองานที่เดิมต้องแบ่งเป็นหลายคำขอ เช่น ปรับโค้ดทั้งโมดูล หรือสรุปเอกสารยาวพร้อมตาราง ซึ่งอาจทำได้ในครั้งเดียว แต่ค่าใช้จ่ายก็เพิ่มตามความยาวของคำตอบ จึงควรวัดต้นทุนต่องานจริงก่อนเปลี่ยนโมเดลทั้งระบบ
ธุรกิจไทยที่เริ่มใช้ AI ช่วยงานเอกสาร งานบริการลูกค้า หรืองานพัฒนาระบบ มีตัวเลือกโมเดลเพิ่มขึ้นแทบทุกเดือน การออกแบบระบบให้สลับโมเดลได้ และวัดผลด้วยงานจริงของตัวเอง สำคัญกว่าการไล่ตามโมเดลที่ใหม่ที่สุด ทีมงาน Smart Cyber Tech พัฒนาระบบที่เชื่อมต่อโมเดล AI พร้อมชุดทดสอบเทียบผลและต้นทุนก่อนใช้งานจริง ปรึกษาได้ที่ แบบฟอร์มติดต่อ
แหล่งข่าว เรียบเรียงจาก 9to5Google —
อ่านต้นฉบับ ภาพปก: 9to5Google · ลิขสิทธิ์ภาพเป็นของเจ้าของต้นฉบับ ใช้ประกอบการรายงานพร้อมอ้างอิงแหล่งที่มา
เนื้อหาบนหน้านี้เป็นการสรุปและเรียบเรียงเพื่อผู้อ่านชาวไทย หากพบข้อผิดพลาดโปรดแจ้งที่
info@smart-cyber-tech.com
บริการที่เกี่ยวข้องจากทีมงาน Smart Cyber Tech
แบ่งปันข่าวนี้:
LINE
Facebook
X
คัดลอกลิงก์
ปรึกษาทีมของเรา