OpenAI เปิดตัว GPT-6 Astra ใช้คอมพิวเตอร์และทำงานหลายขั้นตอนได้
โมเดลเรือธงรุ่นใหม่เน้นเขียนซอฟต์แวร์ วิจัย และควบคุมคอมพิวเตอร์ โดยเริ่มให้ใช้งานแบบจำกัดก่อนทยอยเปิดแก่ลูกค้าเพิ่มเติม
OpenAI เปิดตัว GPT-6 Astra อย่างเป็นทางการเมื่อวันที่ 3 กันยายน 2026 โดยระบุว่าเป็นโมเดลปัญญาประดิษฐ์ที่มีความสามารถสูงที่สุดของบริษัทจนถึงขณะนี้ จุดเด่นคือการใช้งานคอมพิวเตอร์และเว็บเบราว์เซอร์คล้ายมนุษย์ พร้อมรับผิดชอบงานที่มีหลายขั้นตอนได้รวดเร็วและแม่นยำขึ้น
GPT-6 Astra ออกแบบมาสำหรับงานซับซ้อน เช่น การเขียนซอฟต์แวร์ การวิจัยทางวิทยาศาสตร์ การนำทางผ่านโปรแกรมและเว็บไซต์ ตลอดจน Multi-step workflows (กระบวนการทำงานต่อเนื่องหลายขั้น) ผู้ใช้จึงสามารถมอบหมายเป้าหมายให้โมเดลวางแผน ตัดสินใจ และดำเนินงานบนคอมพิวเตอร์ต่อเนื่องได้ แทนการสั่งทีละขั้นเหมือนแชตบอตทั่วไป
ผลทดสอบที่ OpenAI เปิดเผยระบุว่า Astra ทำคะแนนคณิตศาสตร์ FrontierMath Tier 4 ได้ 98% ส่วน ARC-AGI-3 ซึ่งใช้วัดงานแบบ Agentic (การวางแผนและลงมือทำเพื่อบรรลุเป้าหมาย) ได้ 99.9% ขณะที่ชุดทดสอบความปลอดภัย ExploitBench ได้ 100% อย่างไรก็ตาม คะแนนจากชุดทดสอบไม่ควรถูกตีความว่าโมเดลจะทำงานจริงได้ถูกต้องทุกครั้ง เพราะแต่ละสภาพแวดล้อมอาจมีเงื่อนไขต่างจากการทดสอบมาตรฐาน
อีกประเด็นสำคัญคือ OpenAI จัดให้ GPT-6 Astra เป็นโมเดลแรกของบริษัทที่อยู่ในระดับ Critical (ระดับความสามารถที่ต้องควบคุมเข้มงวดเป็นพิเศษ) ด้านไซเบอร์ ตาม Preparedness Framework (กรอบประเมินและเตรียมรับความเสี่ยงจากโมเดลขั้นสูง) สถานะดังกล่าวสะท้อนว่าโมเดลอาจช่วยทำงานด้านความมั่นคงปลอดภัยไซเบอร์ได้มากขึ้น แต่ก็ต้องมีมาตรการจำกัดการใช้งานในทางที่อาจก่ออันตราย
บริษัทเริ่มเปิด GPT-6 Astra ในรูปแบบ Limited Preview (การทดลองใช้แบบจำกัดกลุ่ม) และมีแผนทยอยขยายไปยังลูกค้า Enterprise รวมถึงสมาชิก ChatGPT Plus, Pro และ Business หลังวันเปิดตัว OpenAI มองว่าความสามารถในการทำงานบนคอมพิวเตอร์อย่างเป็นระบบเป็นก้าวสำคัญที่อาจนำไปสู่ AGI (ปัญญาประดิษฐ์ที่ทำงานทางความคิดได้หลากหลายใกล้เคียงมนุษย์) แต่ผลกระทบจริงยังขึ้นอยู่กับประสิทธิภาพนอกห้องทดสอบและมาตรการกำกับความเสี่ยงของบริษัท
โมเดลที่ควบคุมคอมพิวเตอร์และทำงานหลายขั้นได้อาจเปลี่ยนวิธีทำงานของนักพัฒนา นักวิจัย และองค์กรไทย แต่ระดับความสามารถด้านไซเบอร์ที่ถูกจัดว่า Critical ทำให้การควบคุมสิทธิ์เข้าถึงและการตรวจสอบผลงานของโมเดลสำคัญยิ่งขึ้น