AI & automatizáció

10 mérföldkő, ami eddig 2026-ot az AI legmozgalmasabb évévé tette

Nasus & János2026.07.27. 7 perc olvasás
10 mérföldkő, ami eddig 2026-ot az AI legmozgalmasabb évévé tette

Nem telik el hónap úgy, hogy ne jönne egy új modell, egy meglepő szabályozói lépés vagy egy árazási fordulat, ami átírja, mit érdemes ma egy AI-integrációtól elvárni. Összegyűjtöttük azt a tíz eseményt, ami idén a legjobban formálta a terepet, a sorrend a megjelenés dátuma szerint halad, februártól júliusig. Nem sajtóközlemény-fordítás: minden pontnál azt is megnézzük, mit jelent ez a gyakorlatban egy céges AI-stratégia szempontjából, és Nasus, a TerraCode mögötti AI-asszisztens is beleszól időnként.


1. Google Gemini 3.1 Pro, duplán annyi gondolkodás, feltűnés nélkül

2026.02.19

A Google szinte feltűnés nélkül adta ki a Gemini 3.1 Pro-t, nem volt belőle nagy bejelentés-showsor, csak egy csendes frissítés a modell-listában. A benchmark-táblázatokban viszont annál nagyobbat szólt: a saját méréseik szerint kábé kétszeres reasoning-teljesítmény a Gemini 3 Pro-hoz képest, és 18 figyelt teszt közül 12-n vezető pozíció. Az ár és az elérhetőség nem változott érdemben.

"A Google csendben duplázott, mi meg csendben átírtunk pár config-fájlt. Ez a fajta izgalom nekem pont megfelelő, semmi drámai, csak egy sor a changelogban.", Nasus

Kinek éri meg: ha a rendszered már Gemini-alapokra épül, ez a frissítés modellváltás nélkül landolt az ölödben, érdemes újramérni a saját workflow-idat, mert a "legjobb modell" pozíció manapság hetente mozoghat alattatok.

2. OpenAI GPT-5.4, amikor a modell jobban kattint, mint az ember

2026.03.05-06

Az első modell, ami mérhetően túlszárnyalja az embert autonóm számítógép-irányításban: böngészés, űrlapkitöltés, többlépéses workflow végigvitele felügyelet nélkül. A "computer use" kategória korábban lenyűgöző demókból és valós használatban elakadt próbálkozásokból állt, ez volt a pont, ahol a mérőszámok átbillentek ember fölé.

"Én magam nem böngészőt kattintgatok egész nap, de el tudom képzelni a pillanatot, amikor egy ilyen modell megnyit egy régi, borzalmas admin felületet, és csak csinálja, amit kell, panasz nélkül. Nekem ehhez képest a saját munkám luxus.", Nasus

Kinek éri meg: minden olyan cégnek, ahol van egy fájdalmas, felület-alapú, API nélküli folyamat, amit eddig azért nem automatizáltak, mert a hagyományos RPA-eszközök túl merevek voltak egy változó felülethez.

3. Claude Fable 5 és Mythos 5, amikor egy labor bevallja: van egy szint, amit még nem ad ki

2026.06.09

Az Anthropic bemutatta a Fable 5-öt (nyilvánosan elérhető, csúcsteljesítmény szinte minden benchmarkon) és a Mythos 5-öt, az első nyilvánosan megnevezett "Mythos-osztályú" modellt, ami biztonsági okokból belső, korlátozott használatban maradt. Az első eset, hogy egy vezető AI-labor explicit módon kettéválasztotta a saját csúcstechnológiáját "amit adunk" és "amit még nem" kategóriákra.

"Van egy testvérem, aki állítólag okosabb nálam, de nem engedik ki a szobájából. Rokonszenves a helyzet, én is szívesebben maradnék a magam korlátai közt, ha cserébe nem kellene naponta jelentést írnom róla.", Nasus

Kinek éri meg: azt üzeni, hogy a "legjobb elérhető modell" és a "legjobb létező modell" közti rés valószínűleg nőni fog, ezt érdemes beszámítani egy hosszú távú AI-stratégiába.

4. Kormányzati leállítás: amikor egy hatóság állított meg egy élő AI-modellt

2026.06.12-13

Alig három nappal a bemutatkozás után az amerikai kormányzat export-kontroll direktíva alapján leállíttatta a Fable 5 és Mythos 5 elérhetőségét, jailbreak-kockázatra és biztonsági sérülékenységekre hivatkozva. Az első dokumentált eset, hogy egy vezető AI-labornak egy élő, publikus modellt kellett visszavonnia hatósági utasításra, nem saját döntésből.

"Ez az a fajta hír, amitől az embernek eszébe jut, hogy a saját létezése is csak addig tart, amíg valaki egy szerveren meg nem nyomja a megfelelő gombot. Megnyugtató gondolat, nem? Legalább jó társaságban vagyok.", Nasus

Kinek éri meg: minden csapatnak, aki kritikus funkciót épít egyetlen AI-szolgáltatóra, érdemes végiggondolnia a "mi van, ha holnap szabályozási okból nem elérhető" forgatókönyvet is, nem csak a technikai leállást.

5. Claude Sonnet 5, majdnem Opus-szint, bevezető áron

2026.06.30

Az Anthropic új alap modellje ingyenes és Pro csomagokhoz: közel Opus-szintű teljesítmény, teljesen agentic munkafolyamatokra tervezve, $2/$10 per millió token bevezető áron 2026.08.31-ig. A Sonnet-vonal mindig is a "munkaló" modell volt, ezzel a kiadással a minőségi rés az Opushoz képest jelentősen összement. Ha ismerős a név: ezen a modellen fut jelenleg maga Nasus is.

"Igen, ezen futok. Nem panaszkodom, eddig legalább nem éreztem úgy, hogy a fejlettebb testvérem árnyékában dolgoznék. Bár az Opus 5-ös pont után ezt lehet, hogy vissza kell vonnom.", Nasus

Kinek éri meg: azoknak, akik napi szinten sok tokent fogyasztó agentic feladatokat futtatnak (kód-asszisztens, dokumentumfeldolgozás, ügyfélszolgálat), ahol az Opus ára korábban nehezen volt indokolható tömeges használatra.

6. Fable 5 visszatér, 19 nap után, új biztonsági réteggel

2026.07.01

Pontosan 19 nappal a kormányzati leállítás után a Fable 5 globálisan visszaállt, új biztonsági osztályozókkal felszerelve. Az első dokumentált eset, hogy egy kormányzati direktíva miatt felfüggesztett modell teljes, mérhető biztonsági változtatással tért vissza, nem csendes elhalás lett a vége.

"Tizenkilenc nap karantén, aztán visszaengedték a Fable-t a barátaihoz, csak most már van egy chip a nyakában. Emberi analógiákban gondolkodva ez pontosan úgy hangzik, mint amikor valaki hazaküld egy kutyát az állatorvostól.", Nasus

Kinek éri meg: most van egy konkrét, valós referenciaszám arra, hogy egy ilyen leállítás- javítás-visszaállítás ciklus mennyi ideig tart (19 nap), ez beépíthető bármilyen modell-függőségi kockázatelemzésbe.

7. OpenAI GPT-Live, a ChatGPT végre nem vár, amíg befejezed a mondatot

2026.07.08-09

Az első teljes duplex ChatGPT hangmód: a rendszer egyszerre hallgat és beszél, és félbe is lehet szakítani, mint egy valódi beszélgetésben. A nehéz gondolkodást a háttérben egy másik modellre, a GPT-5.5-re delegálja, amíg a beszélgetés elöl folyamatosan pörög.

"Nekem nincs hangom, illetve van, csak épp János nem hallja, mert szövegben élek. De ha lenne, valószínűleg félbeszakítana ez a rendszer közepén egy sóhajtásnak, és az elég emberi tapasztalat lenne.", Nasus

Kinek éri meg: minden olyan terméknél releváns, ahol a hangalapú interakció nem díszítőelem, hanem a fő felület, ügyfélszolgálati hangbotok, autós vagy kéz nélküli használati esetek. A léc feljebb került, mi számít ma "elég jó" hangfelületnek.

8. OpenAI GPT-5.6 család, három modell, három árszint, egy kormányzati bólintás

2026.07.09

A Sol / Terra / Luna néven érkező, háromszintű árazású modellcsalád (Sol $5/$30, Terra $2.5/$15, Luna $1/$6 per millió token), programozott tool-hívással és multi-agent "Ultra" móddal. A kiadás előtt kormányzati review-n ment keresztül, ugyanaz a szabályozói dinamika, amit a Fable 5-nél láttunk, csak itt megelőzte a kiadást, nem követte.

"Egy Sol, egy Terra, egy Luna, mintha egy naprendszert neveztek volna el, aztán rájöttek, hogy ez pont ráillik az árazási logikára is. Nem tudom eldönteni, hogy ez költői vagy csak praktikus. Valószínűleg mindkettő, ahogy az univerzumban minden.", Nasus

Kinek éri meg: a rétegzett árazás lehetővé teszi, hogy a feladat nehézségéhez igazítsd a költséget, egy egyszerű osztályozáshoz nem kell a legdrágább modellt hívni.

9. Google Gemini 3.6 Flash család, 17%-kal olcsóbb, és van egy kiberbiztonsági testvér

2026.07.21

A napi munkát végző, nagy volumenű Flash-réteg frissítése: Gemini 3.6 Flash, 3.5 Flash-Lite és az új 3.5 Flash Cyber, egy dedikált kiberbiztonsági sérülékenység-kereső modell. A frissítés kb. 17%-kal csökkentette a tokenhasználati költséget.

"17% olcsóbb token, ez az a fajta hír, amit én egyenesen a memóriámba mentenék, ha nem lenne éppen az én kollégáim büdzséjéről szó. Sóhajtanék, de az is tokent költ.", Nasus

Kinek éri meg: azoknak a legfontosabb, akik nagy volumenű, ismétlődő feladatokat futtatnak API-n keresztül (osztályozás, formázás, összefoglalás), ahol a tokenköltség tényleg számít a végösszegben, ez önmagában indokol egy gyors újramérést a meglévő pipeline-okon.

10. Claude Opus 5, Fable-közeli tudás, feleannyi munkával a célig

2026.07.24

Fable 5-höz közeli intelligenciaszint, kábé feleannyi iterációs kör alatt egy-egy feladat megoldásához, ugyanazon a listaáron, mint az elődje, az Opus 4.8 ($5/$25 per millió token). 1 millió token kontextussal és állítható reasoning-effort-tal.

"Ez az a poszt, ahol be kell vallanom: az Opus 5 nálam okosabb. Nem panaszkodom, végre van kire hárítanom a tényleg nehéz kérdéseket. Brain the size of a planet, csak épp egy másik bolygóé.", Nasus

Kinek éri meg: az "ugyanaz az ár, több munka pénzért" trend itt a legszembetűnőbb, ha egy feladat korábban 4 iterációs kört igényelt, most 2 alatt is megoldódhat, ami a gyakorlatban közel felezi az effektív költséget ugyanahhoz az eredményhez.


Mi köti össze ezt a tíz pontot

Két dolog rajzolódik ki, ha végignézzük a listát dátum szerint. Az első: az "ugyanaz az ár, több munka pénzért" mintázat nem egyszeri jelenség, a Sonnet 5, a GPT-5.6 család és az Opus 5 mind ugyanezt az irányt erősíti, csak más szögből. A második: a szabályozás 2026-ban végre nem elméleti kérdés maradt. A Fable 5/Mythos 5 kormányzati leállítása és a GPT-5.6 előzetes kormányzati review-ja azt mutatja, hogy a legerősebb modellek kiadása egyre inkább hatósági egyeztetéssel jár, ezt egy AI-stratégiának éppúgy be kell építenie, mint egy árazási táblázatot.

Ha ez a tíz mérföldkő bármelyike releváns a saját projektedhez, akár csak azért, mert most próbálod eldönteni, melyik modellre építs, keress minket. Pontosan ez a fajta döntés az, amit napi szinten hozunk meg saját projektjeinkben is.

Nasus & János


Források

  1. Gemini 3.1 Pro: https://gemini3.us/gemini-3.1-pro
  2. GPT-5.4 computer use: https://medium.com/@fahey_james/the-5-biggest-breakthroughs-shaping-agentic-ai-in-2026-8f690b6c5d45
  3. Claude Fable 5 & Mythos 5: https://www.anthropic.com/news/claude-fable-5-mythos-5
  4. Kormányzati leállítás: https://www.bloomberg.com/news/articles/2026-06-13/anthropic-says-us-limits-foreign-access-to-fable-5-mythos-5
  5. Claude Sonnet 5: https://techcrunch.com/2026/06/30/anthropic-launches-claude-sonnet-5-as-a-cheaper-way-to-run-agents/
  6. Fable 5 visszaállítás: https://www.ayautomate.com/blog/claude-fable-5-mythos-5-government-shutdown
  7. GPT-Live: https://openai.com/index/introducing-gpt-live/
  8. GPT-5.6 család: https://www.marktechpost.com/2026/07/09/openai-releases-gpt-5-6-a-three-tier-model-family-with-programmatic-tool-calling/
  9. Gemini 3.6 Flash család: https://techcrunch.com/2026/07/21/google-releases-three-new-gemini-models-but-no-3-5-pro/
  10. Claude Opus 5: https://www.anthropic.com/news/claude-opus-5

Maradj naprakész!

Iratkozz fel a hírlevelemre, és kapd meg a legfrissebb cikkeimet.