Grok 4.6 hosszú feladatokon dolgozó AI-ügynököket jelképező digitális hálózat

Grok 4.6 bemutató: mit tud az xAI új modellje?

500 ezres kontextus, képbemenet, eszközhasználat és hosszú ügynöki feladatok: a Grok 4.6 legfontosabb képességei és korlátai egy helyen.

Röviden: a Grok 4.6 az xAI 2026. augusztus 12-én kiadott, kódolásra, hosszú AI-ügynöki folyamatokra és tudásmunkára szánt csúcsmodellje. 500 000 tokenes kontextusablakot, szöveg- és képbemenetet, reasoning módokat, valamint web-, X- és kódvégrehajtó eszközöket kínál. Rövid kontextusnál az API listaára 2 USD/millió bemeneti és 6 USD/millió kimeneti token.

Frissítve: 2026. szeptember 7. A Grok 4.6 nem egyszerű csevegőfrissítés. Az xAI elsősorban olyan munkákra pozicionálja, amelyek sok lépésen át tartanak: kutatás, teljes kódbázis elemzése, hibajavítás, dokumentumkészítés vagy összetett vizuális felület felépítése. A modell az xAI API-ban grok-4.6 azonosítóval, továbbá Grok Buildben, Cursorban és több modellplatformon is elérhető.

Az adatok az xAI hivatalos bejelentéséből, a Grok 4.6 fejlesztői útmutatóból és a hivatalos API-árazásból származnak. A teljesítményértékek gyártói vagy a gyártó által összegyűjtött mérések, ezért saját próbát nem helyettesítenek.

Grok 4.6: a legfontosabb adatok

TulajdonságGrok 4.6
Modellazonosítógrok-4.6
Kontextusablak500 000 token
Bemenet és kimenetSzöveg és kép be; szöveg ki
Reasoning effortlow, medium, high, xhigh
EszközökFüggvényhívás, webkeresés, X-keresés, kódfuttatás
Tudáslezárás2026. január
API-kResponses API és Chat Completions

A tudáslezárás és az élő keresés két külön dolog. A modell alapból 2026. januárig betanított ismeretekre támaszkodik, de megfelelő eszközzel frissebb webes vagy X-adatot kérhet le. Ettől a válasz még nem lesz automatikusan hibátlan: a forrást, a dátumot és a következtetést továbbra is ellenőrizni kell.

Miben új a Grok 4.5-höz képest?

Az xAI hosszabb kiegészítő tréninget, továbbfejlesztett optimalizálót és újragenerált tanítási példákat ír le. A fókusz a soklépéses folyamatok következetes végigvitelén, az interaktív és vizuális munkán, valamint a mérnöki feladatokon van. A gyártó által közölt tesztekben a Grok 4.6 High az elődhöz képest 56-ról 61-re javult az Artificial Analysis Intelligence Indexen, 66,7%-ról 69,9%-ra a CursorBench 3.2-n, 54%-ról 65,9%-ra a DeepSWE 1.1-en és 15,7%-ról 26%-ra a Terminal-Bench 3.0-n.

Ezek a számok irányt mutatnak, de nem jelentik azt, hogy minden repositoryn, nyelven vagy eszközkészlettel ugyanekkora lesz a javulás. A külön Grok 4.6 vs Grok 4.5 összehasonlításban részletesen is végigvesszük az eltéréseket.

Árazás és a 200 ezres határ

Prompt hosszaBemenetCache-elt bemenetKimenet
200 000 token alatt2 USD / 1M0,50 USD / 1M6 USD / 1M
200 000 tokentől4 USD / 1M1 USD / 1M12 USD / 1M

A hosszú kontextus felára az egész kérésre vonatkozik, amikor a prompt eléri a küszöböt. Ezért nem jó stratégia automatikusan minden fájlt és korábbi üzenetet a modellnek adni. Kódbázisnál először keress, válaszd ki a releváns részeket, és csak azután bővítsd a kontextust. Ismétlődő beszélgetésnél az xAI kifejezetten ajánlja a prompt_cache_key használatát a megbízható cache-találatokhoz.

Mire lehet jó a gyakorlatban?

  • Kódolás: több fájlon átívelő hibakeresés, refaktorálás és tesztelés, megfelelő sandbox és felülvizsgálat mellett.
  • Kutatás: több forrás összegyűjtése, összevetése és egy strukturált anyag előkészítése.
  • Tudásmunka: dokumentumok, adatok és jegyzetek összefésülése jelentéssé vagy döntési anyaggá.
  • Vizuális munka: képernyőkép vagy terv értelmezése, majd alkalmazás- vagy felületmódosítás megtervezése.
  • Eszközös ügynök: webkeresés, kódfuttatás és saját függvények összehangolása több lépésen át.

Egy kisvállalkozás számára a legjobb első próba nem egy korlátlan autonóm ügynök. Válassz egy jól körülhatárolt folyamatot, például heti versenytársi összefoglalót vagy hibajegy-előszűrést, és hagyd meg az emberi jóváhagyást a publikálás, törlés, fizetés vagy ügyfélkommunikáció előtt.

Korlátok, amelyekkel számolni kell

A nagy kontextus nem azonos a tökéletes emlékezettel, az élő keresés nem garantál hiteles forrást, a reasoning mód pedig nem tesz minden következtetést helyessé. Hosszú futásnál nőhet a költség, felhalmozódhat egy korai tévedés, vagy egy eszköz hibás eredménye rossz irányba viheti a teljes folyamatot. Bizalmas adatnál vizsgáld meg a szerződési, régiós, naplózási és megőrzési feltételeket is.

Kritikus feladatnál legyen költségkeret, maximális lépésszám, napló, visszagörgethető módosítás és egyértelmű jóváhagyási pont. Modellválasztás előtt a Grok 4.6 vs GPT-5.6 Sol cikk segít az ár és a nyilvános mérések összevetésében.

Egyszerű bevezetési ellenőrzőlista

  1. Írj össze 20 valós, korábban már megoldott feladatot.
  2. Rögzítsd az elfogadható eredményt, időt és maximális költséget.
  3. Azonos prompttal és eszközökkel futtasd a jelölt modelleket.
  4. Mérd külön a helyességet, a futásidőt és az emberi javítás perceit.
  5. A külső műveletek előtt tarts meg emberi jóváhagyást.
  6. Csak a stabilan teljesítő feladatot automatizáld nagyobb volumenben.
Vissza a bloghoz