ข้ามไปยังเนื้อหาหลัก
กลับไปหน้า ArtifactsAI Model Intelligence

เปรียบเทียบศักยภาพ โมเดล AI

เลือกโมเดลที่สนใจแล้วดูคะแนน benchmark ราคา ความเร็ว และฟีเจอร์เทียบกันแบบตรง ๆ พร้อมข่าวสารวงการ AI ที่อัปเดตทุกวัน

14
โมเดล
5
Benchmark
12
ข่าวล่าสุด
18 ก.ย. 2569
อัปเดตล่าสุด

ข้อมูลยังไม่ครบทุกช่อง

ตัวเลขที่แสดงดึงจาก OpenRouter และ Artificial Analysis โดยตรงและไม่มีการเดาค่า แต่รอบล่าสุดได้ข้อมูล 66 จาก 70 ช่อง — อีก 4 ช่องที่แหล่งข้อมูลยังไม่ได้วัดจะแสดงเป็น N/A ไม่ใช่ตัวเลขประมาณ แถบนี้จะหายไปเองเมื่อข้อมูลครบทุกช่อง

เลือกโมเดลที่ต้องการเปรียบเทียบ

กดก่อน = อยู่ซ้ายสุด · สีและโลโก้ยึดตามค่ายผู้พัฒนา

ตารางเปรียบเทียบ

★ = ค่าที่ดีที่สุดในกลุ่มที่เลือกไว้ · เลื่อนตารางแนวนอน (หรือกด Tab เข้าตารางแล้วใช้ลูกศร) เพื่อดูคอลัมน์ที่เหลือ

คะแนน Benchmark และความคุ้มค่า

ชื่อรุ่นและค่าอยู่ท้ายแท่งทุกแท่ง · ชี้เมาส์ที่แท่งเพื่อดูชื่อรุ่นเต็ม

Claude Opus 5GPT-5.6 SolGemini 3.1 Pro

GPQA Diamond

คำถามระดับปริญญาเอก สาขาฟิสิกส์/เคมี/ชีววิทยา — วัดการให้เหตุผลเชิงลึก

  • Claude Opus 5: 93.2
  • GPT-5.6 Sol: 94.1 (ดีที่สุดในกลุ่ม)
  • Gemini 3.1 Pro: 94.1 (ดีที่สุดในกลุ่ม)
0255075100

Humanity's Last Exam

ชุดคำถามยากที่สุดที่มนุษย์ผู้เชี่ยวชาญออกแบบมาเพื่อท้าทาย AI

  • Claude Opus 5: 54.9 (ดีที่สุดในกลุ่ม)
  • GPT-5.6 Sol: 49.5
  • Gemini 3.1 Pro: 47.0
0255075100

Terminal-Bench 2.1

สั่งงานผ่าน terminal หลายขั้นตอนจนจบด้วยตัวเอง — วัดการทำงานแบบ agent

  • Claude Opus 5: 89.1 (ดีที่สุดในกลุ่ม)
  • GPT-5.6 Sol: 88.0
  • Gemini 3.1 Pro: 73.8
0255075100

τ²-bench

คุยกับผู้ใช้พร้อมเรียกใช้เครื่องมือตามกฎของธุรกิจ — วัดการใช้ tool ในสถานการณ์จริง

  • Claude Opus 5: ไม่มีข้อมูล
  • GPT-5.6 Sol: 85.1
  • Gemini 3.1 Pro: 95.6 (ดีที่สุดในกลุ่ม)
0255075100

SciCode

เขียนโค้ดแก้โจทย์วิทยาศาสตร์ระดับงานวิจัย

  • Claude Opus 5: 56.4
  • GPT-5.6 Sol: 57.1
  • Gemini 3.1 Pro: 58.7 (ดีที่สุดในกลุ่ม)
0255075100

ราคาใช้งานจริง

ถัวเฉลี่ย input:output ที่ 3:1 (สัดส่วนคร่าว ๆ ของงานแบบแชท) — ยิ่งต่ำยิ่งดี

  • Claude Opus 5: $10.00
  • GPT-5.6 Sol: $4.00 (ดีที่สุดในกลุ่ม)
  • Gemini 3.1 Pro: $4.50
$0$3$5$8$10

ความคุ้มค่า

คะแนน Intelligence ที่ได้ต่อราคา 1 ดอลลาร์ — ยิ่งสูงยิ่งคุ้ม

  • Claude Opus 5: 5.1
  • GPT-5.6 Sol: 11.8 (ดีที่สุดในกลุ่ม)
  • Gemini 3.1 Pro: 6.8
05101520

กราฟ benchmark ทุกใบใช้สเกล 0–100% เท่ากัน — Humanity's Last Exam คะแนนต่ำกว่าตัวอื่นมากเพราะเป็นชุดคำถามที่ยากที่สุด ไม่ได้แปลว่าโมเดลแย่

ข่าวสาร AI ล่าสุด

อัปเดตอัตโนมัติทุกวัน — โลโก้ท้ายการ์ดบอกว่าข่าวนี้เกี่ยวกับโมเดลของค่ายไหน
หัวข้อและสรุปภาษาไทยแปลโดย AI (Claude) จากต้นฉบับภาษาอังกฤษ ตรวจรายละเอียดกับต้นฉบับก่อนนำไปใช้อ้างอิง

ฟีเจอร์

Cooley เร่งงาน IPO ด้วย ChatGPT

สำนักงานกฎหมาย Cooley สร้างเครื่องมือชื่อ GO Public บน ChatGPT Work เพื่อนำ AI มาช่วยในกระบวนการ IPO ทำให้ทนายความมองเห็นประเด็นปัญหาได้เร็วขึ้น และทุ่มเวลาไปกับการใช้วิจารณญาณในเรื่องที่สำคัญที่สุด

ฟีเจอร์

เปิดตัว Astra for Law

OpenAI for Law นำโมเดลระดับ frontier มาใช้กับงานกฎหมาย พร้อม workflow ที่ปรับแต่งได้ตามสำนักงาน การเชื่อมต่อแหล่งข้อมูลทางกฎหมาย และระบบควบคุมระดับ legal-grade สำหรับงานลูกความที่เป็นความลับ

ธุรกิจ

ช่วยผู้สูงอายุใช้ AI ในชีวิตประจำวัน

OpenAI จับมือกับ AARP จัด workshop สอนใช้ ChatGPT แบบลงมือทำฟรีให้ผู้สูงอายุ 1,000 คนใน 10 เมืองทั่วสหรัฐฯ เพื่อสร้างทักษะ AI ที่ใช้ได้จริงและปลอดภัย

ฟีเจอร์

ออกแบบโฆษณายุคใหม่ด้วย AI

OpenAI เปิดตัวประสบการณ์โฆษณาที่ขับเคลื่อนด้วย AI ทั้ง Sponsored Agents เครื่องมือสำหรับนักการตลาด และการเชื่อมต่อกับ HubSpot และ Shopify

ฟีเจอร์

Hex เปลี่ยนการวิเคราะห์ซับซ้อนเป็นรายงานภาพด้วย GPT-6 Astra

GPT-6 Astra ช่วยให้ data agents ของ Hex แปลงคำตอบจากการวิเคราะห์ให้กลายเป็น interactive visualization ที่พนักงานมั่นใจพอจะนำไปแชร์ต่อ

ฟีเจอร์

วิธีเชื่อมโยงการใช้ AI เข้ากับคุณค่าทางธุรกิจ

OpenAI อธิบายวิธีใช้ analytics ของ ChatGPT Work และ Codex เพื่อให้ทีมเข้าใจการใช้งานและค่าใช้จ่ายด้าน AI ระบุจุดที่ต้องเทรนเพิ่ม และเชื่อมโยงการนำ AI ไปใช้กับผลลัพธ์ทางธุรกิจ

งานวิจัย

กรอบการรายงาน model misalignment ของ OpenAI

OpenAI เผยแพร่กรอบการทำงานสำหรับติดตาม ตรวจสอบ และเปิดเผยพฤติกรรม misalignment ของโมเดล พร้อมรายงาน 6 กรณีที่พบพฤติกรรมผิดคาดหรือน่ากังวล

งานวิจัย

คนทำงานกำลังปลดล็อกวิธีทำงานแบบใหม่

งานวิจัย OpenAI Economic Research ชิ้นใหม่แสดงให้เห็นว่าคนทำงานใช้ AI นอกเหนือจากบทบาทงานแบบเดิมอย่างไร และกิจกรรมใหม่ ๆ แบบไหนที่กลายเป็นส่วนหนึ่งของงานประจำ

โมเดลใหม่

Google DeepMind เปิดตัว Gemini 3.8 Live และ 3.8 Live Extended Thinking

Google DeepMind ประกาศเปิดตัวโมเดลใหม่ Gemini 3.8 Live และรุ่น 3.8 Live Extended Thinking

งานวิจัย

AI Agent ทำงานสำเร็จครั้งหนึ่ง แล้วจะทำได้อีกไหม?

บทความจาก Hugging Face ตั้งคำถามถึงความสม่ำเสมอของ AI agent ว่าการทำงานสำเร็จเพียงครั้งเดียวนั้นเชื่อถือได้แค่ไหนเมื่อต้องทำซ้ำ

ฟีเจอร์

Fyxer สร้างผู้ช่วยผู้บริหาร AI ที่คนไว้ใจได้อย่างไร

Fyxer ใช้โมเดลของ OpenAI ร่วมกับ fine-tuning, memory และ feedback จากผู้ใช้จริง เพื่อจัดระเบียบ inbox และร่างอีเมลด้วยน้ำเสียงเฉพาะตัวของผู้ใช้แต่ละคน

ฟีเจอร์

Perplexity ไว้ใจให้ GPT-6 Astra ดูแลระบบแบบ end-to-end

Perplexity ใช้ Astra เขียนงานสื่อสาร แก้ไขซอฟต์แวร์ และเฝ้าติดตามระบบ production โดยต้องเข้าไปตรวจสอบน้อยลงมากเมื่อเทียบกับโมเดลรุ่นก่อน

แหล่งข้อมูล

โลโก้ของแต่ละค่ายเป็นเครื่องหมายการค้าของเจ้าของแบรนด์ ใช้เพื่อระบุผลิตภัณฑ์ในตารางเปรียบเทียบเท่านั้น · รูปทรงโลโก้จาก Lobe Icons (MIT License)