gemini3.us
เปิดตัว 19 กุมภาพันธ์ 2026

G 3.1 Pro

โมเดล AI เรือธงของเรา — ก้าวกระโดดครั้งใหญ่ด้านการใช้เหตุผล การเขียนโค้ด และความเฉลียวฉลาด

ความสามารถการใช้เหตุผล 2 เท่าของ G 3 Pro • อันดับ 1 ใน 12 จาก 18 เกณฑ์มาตรฐาน • การแสดงผล SVG และโค้ด 3D แบบเนทีฟ

77.1%
ARC-AGI-2
94.3%
GPQA Diamond
80.6%
SWE-Bench
2887
LiveCodeBench Elo

สิ่งใหม่ใน G 3.1 Pro

การใช้เหตุผล การเขียนโค้ด ความเข้าใจหลายรูปแบบ ทุกอย่างถูกคิดใหม่

การใช้เหตุผลเชิงนามธรรม 2 เท่า

คะแนน 77.1% บน ARC-AGI-2 — มากกว่า G 3 Pro ถึง 2 เท่า เหนือกว่า Claude Opus 4.6

บริบท 1 ล้านโทเค็น, เอาต์พุต 65K

ประมวลผลโค้ดเบสทั้งหมด, เสียง 8.4 ชั่วโมง, PDF 900 หน้า หรือวิดีโอ 1 ชั่วโมงในคำถามเดียว

วิศวกรรมซอฟต์แวร์ระดับสูงสุด

อัตราผ่าน SWE-Bench 80.6%, LiveCodeBench Pro Elo 2887 เหนือกว่า GPT-5.2

การแสดงผล SVG และ 3D แบบเนทีฟ

ความสามารถพิเศษในการสร้าง สร้างภาพเคลื่อนไหว และแสดงผล SVG และโค้ด 3D จากภาษาปกติ

เวิร์กโฟลว์เอเจนต์ระยะยาว

APEX-Agents 33.5%, MCP Atlas 69.2%, BrowseComp 85.9% ผลการทดสอบเอเจนต์ที่แข็งแกร่ง

ระบบการคิดสามระดับ

เลือกโหมดการคำนวณต่ำ กลาง หรือสูง สมดุลระหว่างความเร็วและความลึกของการใช้เหตุผล

ผลการทดสอบ G 3.1 Pro

อันดับ 1 ใน 12 จาก 18 เกณฑ์มาตรฐาน

การใช้เหตุผลเชิงนามธรรม

ARC-AGI-2
2 เท่าของ G 3 Pro, เหนือกว่า Claude Opus 4.6
77.1%
GPQA Diamond
วิทยาศาสตร์ระดับปริญญาเอก
94.3%
SciCode
การแก้ปัญหาทางวิทยาศาสตร์
59%
APEX-Agents
งานเอเจนต์ขั้นสูง
33.5%

วิศวกรรมซอฟต์แวร์

SWE-Bench Verified
การแก้ปัญหาซอฟต์แวร์จริง
80.6%
SWE-Bench Pro
งานวิศวกรรมขั้นสูง
54.2%
LiveCodeBench Pro Elo
อันดับ 1, เหนือกว่า GPT-5.2 และ G 3 Pro
2887
Terminal-Bench 2.0
การนำทางระบบไฟล์และจัดการ dependencies
68.5%

ความเข้าใจหลายรูปแบบ

อินพุตเสียง
สูงสุด 8.4 ชั่วโมงต่อคำถาม
8.4h
ภาพต่อคำถาม
สูงสุด 900 ภาพ
900
อินพุตวิดีโอ
สูงสุด 1 ชั่วโมง
1h
หน้าต่างบริบท
อินพุต 1,048,576 โทเค็น
1M

ความสามารถเอเจนต์

MCP Atlas
ความแม่นยำในการประสานงานเครื่องมือ
69.2%
BrowseComp
การค้นหาเว็บอัตโนมัติ
85.9%
ดัชนีความฉลาดโดยรวม
การประเมิน Artificial Analysis (57.0)
57.0
ดัชนีการเขียนโค้ด
การประเมิน Artificial Analysis (55.5)
55.5
Benchmark Comparison

G 3.1 Pro เทียบกับคู่แข่ง

เปรียบเทียบ G 3.1 Pro กับ Claude Opus 4.6, GPT-5.2 และ GPT-5.4 ในเกณฑ์มาตรฐานหลักและราคา

การใช้เหตุผลและความรู้

เกณฑ์มาตรฐานG 3.1 ProClaude Opus 4.6GPT-5.2GPT-5.4
ARC-AGI-277.1%68.8%52.9%73.3%
GPQA Diamond94.3%91.3%92.4%92.8%
OSWorld (การใช้คอมพิวเตอร์)72.7%47.3%75.0%
GDPval (งานความรู้)78.0%70.9%83.0%

การเขียนโค้ดและงานเอเจนต์

เกณฑ์มาตรฐานG 3.1 ProClaude Opus 4.6GPT-5.2GPT-5.4
SWE-Bench Verified80.6%80.8%80.0%
SWE-Bench Pro54.2%55.6%57.7%
LiveCodeBench Pro Elo28872393
Terminal-Bench 2.068.5%65.4%54.0%75.1%
MCP Atlas69.2%59.5%60.6%67.2%

ราคา

เกณฑ์มาตรฐานG 3.1 ProClaude Opus 4.6GPT-5.2GPT-5.4
ราคาอินพุต / 1M โทเค็น$2.00$15.00$1.75$2.50
ราคาเอาต์พุต / 1M โทเค็น$12.00$75.00$14.00$15.00

คำถามที่พบบ่อยเกี่ยวกับ G 3.1 Pro

คำถามที่พบบ่อยเกี่ยวกับ G 3.1 Pro

G 3.1 Pro คืออะไร?
G 3.1 Pro คือประสบการณ์โมเดล AI เรือธงของเรา เปิดตัวเมื่อ 19 กุมภาพันธ์ 2026 มีความสามารถการใช้เหตุผลมากกว่า G 3 Pro ถึง 2 เท่า อยู่อันดับ 1 ใน 12 จาก 18 เกณฑ์มาตรฐาน และรองรับบริบท 1M โทเค็นพร้อมเอาต์พุต 65K โทเค็น สร้างบนสถาปัตยกรรม Transformer MoE
G 3.1 Pro เปิดตัวเมื่อไหร่?
G 3.1 Pro เปิดตัวเมื่อ 19 กุมภาพันธ์ 2026 นี่คือการเพิ่มขึ้น '.1' ครั้งแรกระหว่างเวอร์ชันหลักของ G การเปลี่ยนชื่อสะท้อนถึงการก้าวกระโดดครั้งใหญ่ในด้านการใช้เหตุผลและประสิทธิภาพเอเจนต์
G 3.1 Pro ราคาเท่าไหร่?
G 3.1 Pro ราคา $2 ต่อ 1M โทเค็นอินพุต และ $12 ต่อ 1M โทเค็นเอาต์พุต — ราคาเดียวกับ G 3 Pro สำหรับคำถามที่เกิน 200K โทเค็น ราคาจะเพิ่มเป็น $4/$18 การแคชบริบทสามารถลดต้นทุนได้ถึง 75% ทำให้ถูกกว่า Claude Opus 4.6 ถึง 7.5 เท่าสำหรับอินพุต
G 3.1 Pro เปรียบเทียบกับ GPT-5.4 อย่างไร?
G 3.1 Pro นำหน้าใน ARC-AGI-2 (77.1% vs 73.3%), GPQA Diamond (94.3% vs 92.8%) และ MCP Atlas (69.2%) GPT-5.4 นำหน้าใน Terminal-Bench 2.0 (75.1% vs 68.5%), SWE-Bench Pro (57.7% vs 54.2%), OSWorld (75.0%) และงานความรู้ (83.0% GDPval) G 3.1 Pro ราคาถูกกว่า: $2/$12 vs $2.50/$15 ต่อ 1M โทเค็น
G 3.1 Pro เปรียบเทียบกับ Claude Opus 4.6 อย่างไร?
G 3.1 Pro นำหน้าใน ARC-AGI-2 (77.1% vs 68.8%), GPQA Diamond (94.3% vs 91.3%), LiveCodeBench Pro (2887 Elo) และ MCP Atlas (69.2% vs 59.5%) Claude Opus 4.6 นำหน้าเล็กน้อยใน SWE-Bench Verified (80.8% vs 80.6%) G 3.1 Pro ราคาถูกกว่า 7.5 เท่าสำหรับอินพุต ($2 vs $15 ต่อ 1M โทเค็น)
หน้าต่างบริบทของ G 3.1 Pro ใหญ่แค่ไหน?
G 3.1 Pro รองรับหน้าต่างบริบทอินพุต 1,048,576 โทเค็น (1M) และเอาต์พุตสูงสุด 65,536 โทเค็น สามารถประมวลผลโค้ดเบสทั้งหมด, เสียง 8.4 ชั่วโมง, PDF 900 หน้า หรือวิดีโอ 1 ชั่วโมงในคำถามเดียว
G 3.1 Pro สามารถสร้าง SVG และโค้ด 3D ได้ไหม?
ได้ G 3.1 Pro สามารถสร้าง สร้างภาพเคลื่อนไหว และแสดงผลกราฟิก SVG และโค้ด 3D โดยตรงจากคำอธิบายภาษาธรรมชาติ ความสามารถในการแสดงผล SVG และ 3D แบบเนทีฟนี้ไม่ค่อยพบในโมเดล frontier อื่น
ระดับการคิดใน G 3.1 Pro มีอะไรบ้าง?
G 3.1 Pro มีสามระดับการคิด: ต่ำ (เร็วที่สุด สำหรับคำถามง่าย), กลาง (สมดุล สำหรับการตรวจสอบโค้ดและวิเคราะห์ข้อมูล) และสูง (ความลึกการใช้เหตุผลสูงสุด สำหรับการเขียนโค้ดซับซ้อนและการวิจัย) ระดับกลางเป็นสิ่งใหม่ใน 3.1 Pro และช่วยเพิ่มประสิทธิภาพต้นทุนสำหรับงานที่ไม่ต้องการการใช้เหตุผลเต็มรูปแบบ

เกี่ยวกับ G 3.1 Pro

G 3.1 Pro คือประสบการณ์โมเดล AI เรือธงของเรา เปิดตัวเมื่อ 19 กุมภาพันธ์ 2026 ออกแบบมาสำหรับการใช้เหตุผลขั้นสูง การเขียนโค้ด และเวิร์กโฟลว์หลายรูปแบบ พร้อมการปรับปรุงในตัวชี้วัดสำคัญในราคาเดิม: $2 ต่อ 1M โทเค็นอินพุต และ $12 ต่อ 1M โทเค็นเอาต์พุต

หมายเหตุสำคัญ: G เป็นแพลตฟอร์มชุมชนอิสระของนักพัฒนา ไม่มีความเกี่ยวข้องกับ Google LLC อย่างเป็นทางการ

ลอง G 3.1 Pro วันนี้

ลอง G 3.1 Pro บนแพลตฟอร์มของเรา