Egy 27 milliárd paraméteres AI megverte a frontier modelleket.

Mi a titka?
Nem a méret – hanem a „tapasztalat” számít!

Szerző: Varga Zsolt

A DeepMind korábbi munkatársai által alapított londoni Inherent Faraday nevű AI-ügynöke tudományos cikkek eredményeit próbálja reprodukálni. A cég saját Replica benchmarkján a Faraday a betanított jellegű feladatok 73%-ában múlta felül a Claude Opus 4.8-at. Teljesen új, korábban nem látott kutatási témák esetében is 60%-os arányban bizonyult jobbnak.

Mindezt egy 27 milliárd paraméteres Qwen 3.6 alapmodellre építve. Ez a frontier modellekhez képest jóval kisebb rendszer.

A lényeg azonban nem a nyers modellképesség, hanem a munkamegosztás.

A Faraday az úgynevezett CAT, vagyis Coding Agent as Tool architektúrát használja. Ő tölti be a „tudományos igazgató” szerepét: meghatározza, melyik hipotézist érdemes tesztelni, milyen kísérlet adhat választ, és hogyan álljon össze a kutatási terv. A kódolást viszont külön eszközre bízza — többek között éppen az OpenAI GPT-5.5 Codexére.

Nem azért nyer tehát, mert ő írja a legjobb kódot. Hanem azért, mert jobban dönti el, milyen kódot érdemes egyáltalán megíratni. Ez a vezetői tanulság is.

A kutatói tapasztalatot nem lehet folyamatábrákban vagy szabálygyűjteményekben átadni. Az Inherent ezt hosszú horizontú megerősítéses tanulással, GRPO-val alakította ki: nem a rögzített lépéssorok követését jutalmazta, hanem a jó döntéseket.

Pontosan így működik a tapasztalat a szervezetekben is.

Egy rutinos szakember értéke gyakran nem abban áll, hogy gyorsabban vagy technikailag hibátlanabbul hajt végre egy feladatot. Hanem abban, hogy felismeri: melyik problémával érdemes foglalkozni, hol van a valódi kockázat, melyik adat félrevezető, és mikor kell inkább megállni, mielőtt időt vagy pénzt költünk egy rossz irányra.

Edward Hughes, az Inherent társalapítója szerint az ideális AI-munkatárs nem egyszerűen azt mondja, amit hallani szeretnénk. Inkább így tér vissza: „Kíváncsi lettem erre, elvégeztem néhány kísérletet. Mit gondolsz az eredményről?”

Ez az a proaktív, kritikus gondolkodás, amelyet a tapasztalt kollégáktól várunk.

Üzenet a vállalatvezetőknek:

Miközben a versenytársak a paraméterszámokkal versenyeznek, az Inherent a jobb ítélőképességet próbálta betanítani. Ráadásul ehhez a legnagyobb versenytársa egyik eszközét is felhasználta.

Ha az AI-fejlesztők egyre inkább abból építkeznek, amit a tapasztalt szakemberek ösztönösen tudnak, akkor a vállalatoknak is érdemes újragondolniuk, hogyan bánnak ezzel a tudással. Nem leépíteni kellene azt, hanem feltárni, átadni és beépíteni a működésbe.

A tapasztalat szamit e-benchmark

A szervezet „öregjei” nem a múlt maradványai. Ők adják azt a szakmai mércét, amelyhez most már a legfejlettebb AI-rendszerek is igazodni próbálnak.

Erre egyre több cég rájön, rájött, lásd a Ford példáját https://www.linkedin.com/posts/zsoltvargaceo_aistrategy-humanexpertise-leadershipreputation-activity-7478063402372952064-8cQm

(Megjegyzés: az eredmények jelenleg az Inherent saját, függetlenül még nem validált Replica benchmarkjából származnak. A technológia a cég frissen bejelentett, 50 millió dolláros seed-köre után került a figyelem középpontjába.)

Forrás:

Inherent Labs. (2026. augusztus 13). Training AI scientists to replicate research. Inherent. https://inherentlabs.ai/research/training-to-replicate

Dealroom. (2026. augusztus 21). Inherent raises $50M, claims Faraday agent beats Claude and GPT-5.5 at replicating research. Dealroom News Feed. https://app.dealroom.co/news/feed/inherent-raises-50m-claims-faraday-agent-beats-claude-and-gpt-5-5-at-replicating-research

AI Weekly. (2026. augusztus 21). Inherent says Faraday tops Claude, GPT-5.5 at paper replication. AI Weekly Alerts. https://aiweekly.co/alerts/inherent-says-faraday-tops-claude-gpt-55-at-paper-replication

Mezha.net. (2026. augusztus 21). Inherent claims Faraday outperforms OpenAI and Anthropic systems. https://mezha.net/eng/bukvy/372ff79f_inherent_claims_faraday/

Heim A. (2026. augusztus 22). Inherent, founded by DeepMind alumni, says its AI ‘teammate’ just outperformed Anthropic and OpenAI at replicating research. TechCrunch. https://techcrunch.com/2026/08/22/inherent-founded-by-deepmind-alumni-says-its-ai-teammate-just-outperformed-anthropic-and-openai-at-replicating-research/

#AIleadership #CorporateStrategy #AIgovernance #TapasztalatSzámít #ArtificialIntelligence #AIAgents #AgenticAI #ReinforcementLearning #MachineLearning #ResearchAI #AIResearch #AIStrategy #BusinessStrategy #Leadership #ExecutiveLeadership #FutureOfWork #KnowledgeManagement #OrganizationalLearning #HumanCapital #WorkforceStrategy #DecisionMaking #CriticalThinking #InnovationManagement #DigitalTransformation #ResponsibleAI #AIGovernance #TechLeadership #TalentManagement #ExperienceMatters