Google představil nový model umělé inteligence Gemini 4 Argon, který dosáhl skvělých výsledků v několika srovnávacích testech. Podle uvedených hodnocení obsadil první místo v Arena AI, Vows Index a Artificial Analysis Index. Model si vedl dobře také při úlohách z vědy, matematiky a práce s rozsáhlým množstvím informací.

Jedním z jeho hlavních výkonů je práce s dlouhým kontextem. Gemini 4 Argon zvládne až milion tokenů, což mu umožňuje pracovat i s velmi rozsáhlými zadáními a řešit složitější úkoly v několika krocích. Silné výsledky podle zdroje vykazuje také v prostorovém uvažování a úlohách spojených s robotikou.

Nový model má ale i slabší stránky. V testu zaměřeném na programování skončil až na osmém místě. Otázkou navíc zůstává, jak se výsledky z kontrolovaných benchmarků projeví při běžném používání. První uživatelské reakce podle zdroje naznačují, že mezi výsledky testů a praktickým využitím může být rozdíl.

Google chce model dále zlepšovat hlavně v programování a současně ověřovat jeho fungování v reálném prostředí. Gemini 4 Argon měl v jednom z testů patnáctiprocentní míru halucinací, tedy případů, kdy umělá inteligence poskytne nesprávnou informaci místo toho, aby přiznala, že odpověď nezná.

https://forbes.cz/cihla-neni-zlato-realitni-manie-v-cesku-bobtna-do-nebezpecnych-rozmeru/?_gl=1*fv27uf*_up*MQ..*_ga*OTQ5MzE2ODM2LjE3ODg1MTY3NTk.*_ga_K8TJSQ5ZTZ*czE3ODg1MTY3NTkkbzEkZzAkdDE3ODg1MTY3NTkkajYwJGwwJGgxOTAyMTg4NTU0