gemini3.us
Julkaistu 19. helmikuuta 2026

G 3.1 Pro

Lippulaiva tekoälymallimme — merkittävillä parannuksilla päättelyssä, koodauksessa ja agenttiälykkyydessä

2× G 3 Pron päättelykyky • #1 12/18 vertailussa • Natiivi SVG- ja 3D-koodirenderöinti

Katso vertailut
77.1%
ARC-AGI-2
94.3%
GPQA Diamond
80.6%
SWE-Bench
2887
LiveCodeBench Elo

Uutta G 3.1 Prossa

Päättely, koodaus, multimodaalinen ymmärrys — kaikki uudelleen kuviteltu

Abstrakti päättely 2×

77.1% pisteet ARC-AGI-2:ssa — yli kaksinkertaisesti G 3 Pro. Ylittää Claude Opus 4.6:n.

1M tokenin konteksti, 65K tuloste

Käsittelee kokonaisia koodikantoja, 8.4 tuntia ääntä, 900-sivuisia PDF-tiedostoja tai tunnin videota yhdessä kehotteessa.

Huippuluokan ohjelmistosuunnittelu

SWE-Bench läpäisyprosentti 80.6%. LiveCodeBench Pro Elo 2887, ylittää GPT-5.2:n.

Natiivi SVG- ja 3D-renderöinti

Luo, animoi ja renderöi SVG-grafiikat ja 3D-koodi luonnollisen kielen kuvauksista — kyky, jota harvoin löytyy muista malleista.

Pitkäkestoiset agenttityönkulut

APEX-Agents 33.5%, MCP Atlas 69.2%, BrowseComp 85.9%. Vahva suorituskyky agenttibenchmarkeissa.

Kolmitasoinen ajattelujärjestelmä

Valitse matalan, keskisuuren tai korkean laskennan tila. Tasapainota tulosteen viive ja päättelyn syvyys.

G 3.1 Pro vertailusuorituskyky

#1 12/18 vertailussa päättelyssä, koodauksessa, multimodaalisuudessa ja agentissa

Abstrakti päättely

ARC-AGI-2
2× G 3 Pro, ylittää Claude Opus 4.6:n
77.1%
GPQA Diamond
Tiede ja tutkimus tohtorin tasolla
94.3%
SciCode
Tieteellinen ongelmanratkaisu
59%
APEX-Agents
Autonomiset agenttehtävät
33.5%

Ohjelmistosuunnittelu

SWE-Bench Verified
Todellisten ohjelmisto-ongelmien ratkaisu
80.6%
SWE-Bench Pro
Kehittyneet suunnittelutehtävät
54.2%
LiveCodeBench Pro Elo
#1, ylittää GPT-5.2:n ja G 3 Pron
2887
Terminal-Bench 2.0
Tiedostojärjestelmänavigaatio ja riippuvuuksien hallinta
68.5%

Multimodaalinen ymmärrys

Äänisyöte
Jopa 8.4 tuntia per kehote
8.4h
Kuvia per kehote
Jopa 900 kuvaa
900
Videosyöte
Jopa 1 tunti sisältöä
1h
Konteksti-ikkuna
1 048 576 tokenin syöte
1M

Agenttiominaisuudet

MCP Atlas
Työkalukoordinaation tarkkuus
69.2%
BrowseComp
Autonominen web-tutkimus
85.9%
Yleinen älykkyysindeksi
Artificial Analysis -arvio (57.0)
57.0
Koodausindeksi
Artificial Analysis -arvio (55.5)
55.5
Benchmark Comparison

G 3.1 Pro vs kilpailijat

G 3.1 Pro vs Claude Opus 4.6, GPT-5.2 ja GPT-5.4 tärkeimmissä benchmarkeissa ja hinnoissa

Päättely ja tieto

BenchmarkG 3.1 ProClaude Opus 4.6GPT-5.2GPT-5.4
ARC-AGI-277.1%68.8%52.9%73.3%
GPQA Diamond94.3%91.3%92.4%92.8%
OSWorld (Tietokoneen käyttö)72.7%47.3%75.0%
GDPval (Tietotyö)78.0%70.9%83.0%

Koodaus ja agenttitehtävät

BenchmarkG 3.1 ProClaude Opus 4.6GPT-5.2GPT-5.4
SWE-Bench Verified80.6%80.8%80.0%
SWE-Bench Pro54.2%55.6%57.7%
LiveCodeBench Pro Elo28872393
Terminal-Bench 2.068.5%65.4%54.0%75.1%
MCP Atlas69.2%59.5%60.6%67.2%

Hinnoittelu

BenchmarkG 3.1 ProClaude Opus 4.6GPT-5.2GPT-5.4
Syöttöhinta / 1M tokenia$2.00$15.00$1.75$2.50
Tulostushinta / 1M tokenia$12.00$75.00$14.00$15.00

G 3.1 Pro UKK

Usein kysytyt kysymykset G 3.1 Prosta

Mikä on G 3.1 Pro?
G 3.1 Pro on lippulaiva-tekoälymallikokemuksemme, julkaistu 19. helmikuuta 2026. Se tarjoaa yli kaksinkertaisen päättelykyvyn verrattuna G 3 Prohon, sijoittuu 1. sijalle 12/18 benchmarkissa ja tukee 1M tokenin kontekstia 65K tokenin tulosteella. Se on rakennettu Transformer MoE -arkkitehtuurille.
Milloin G 3.1 Pro julkaistiin?
G 3.1 Pro julkaistiin 19. helmikuuta 2026. Se on ensimmäinen '.1'-inkrementti Gen pääversioiden välillä. Nimenmuutos heijastaa merkittävää suorituskyvyn hyppyä päättelyssä ja agenttitehtävissä.
Paljonko G 3.1 Pro maksaa?
G 3.1 Pro maksaa $2 per 1M syötetokenia ja $12 per 1M tulostetokenia — sama hinta kuin G 3 Pro. Yli 200K tokenin prompteille hinta nousee $4/$18. Kontekstin välimuisti voi vähentää kustannuksia jopa 75%. Tämä tekee siitä 7,5× halvemman kuin Claude Opus 4.6 syötössä.
Miten G 3.1 Pro vertautuu GPT-5.4:ään?
G 3.1 Pro johtaa ARC-AGI-2:ssa (77.1% vs 73.3%), GPQA Diamondissa (94.3% vs 92.8%) ja MCP Atlasissa (69.2%). GPT-5.4 johtaa Terminal-Bench 2.0:ssa (75.1% vs 68.5%), SWE-Bench Prossa (57.7% vs 54.2%), OSWorldissa (75.0%) ja tietotyössä (83.0% GDPval). G 3.1 Pro on halvempi: $2/$12 vs $2.50/$15 per 1M tokenia.
Miten G 3.1 Pro vertautuu Claude Opus 4.6:een?
G 3.1 Pro johtaa ARC-AGI-2:ssa (77.1% vs 68.8%), GPQA Diamondissa (94.3% vs 91.3%), LiveCodeBench Prossa (2887 Elo) ja MCP Atlasissa (69.2% vs 59.5%). Claude Opus 4.6 on niukasti edellä SWE-Bench Verifiedissä (80.8% vs 80.6%). G 3.1 Pro on 7,5× halvempi syötössä ($2 vs $15 per 1M tokenia).
Kuinka suuri on G 3.1 Pron konteksti-ikkuna?
G 3.1 Pro tukee 1 048 576 tokenin (1M) syöttökonteksti-ikkunaa ja jopa 65 536 tokenin tulostetta. Se voi käsitellä kokonaisia koodikantoja, 8.4 tuntia ääntä, 900-sivuisia PDF-tiedostoja tai 1 tunnin videota yhdessä kehotteessa.
Voiko G 3.1 Pro luoda SVG:tä ja 3D-koodia?
Kyllä. G 3.1 Pro voi luoda, animoida ja renderöidä SVG-grafiikat ja 3D-koodin suoraan luonnollisen kielen kuvauksista. Tämä natiivi SVG- ja 3D-renderöintikyky on harvinainen muissa frontier-malleissa.
Mitkä ovat G 3.1 Pron ajattelutasot?
G 3.1 Pro tarjoaa kolme ajattelutasoa: Matala (nopein, yksinkertaisille kyselyille), Keskitaso (tasapainoinen, koodin tarkistukseen ja data-analyysiin) ja Korkea (maksimaalinen päättelysyvyys, monimutkaiseen koodaukseen ja tutkimukseen). Keskitaso on uusi 3.1 Prossa ja auttaa optimoimaan kustannuksia tehtäville, jotka eivät vaadi täyttä päättelyä.

Tietoa G 3.1 Prosta

G 3.1 Pro on lippulaiva-tekoälymallikokemuksemme, julkaistu 19. helmikuuta 2026. Edistyneeseen päättelyyn, koodaukseen ja multimodaalisiin työnkulkuihin suunniteltuna se tarjoaa parannuksia keskeisissä mittareissa samalla hinnalla: 2 dollaria per 1M syötetokenia ja 12 dollaria per 1M tulostetokenia.

Tärkeä huomio: G on itsenäinen harrastaja- ja kehittäjäyhteisöalusta. Emme ole Google LLC:n tytäryhtiö, hyväksymä tai virallisesti yhteydessä Google LLC:hen.

Kokeile G 3.1 Proa tänään

Kokeile G 3.1 Proa alustassamme