Google představil nový model umělé inteligence Gemini 4 Argon, který dosáhl skvělých výsledků v několika srovnávacích testech. Podle uvedených hodnocení obsadil první místo v Arena AI, Vows Index a Artificial Analysis Index. Model si vedl dobře také při úlohách z vědy, matematiky a práce s rozsáhlým množstvím informací.
Jedním z jeho hlavních výkonů je práce s dlouhým kontextem. Gemini 4 Argon zvládne až milion tokenů, což mu umožňuje pracovat i s velmi rozsáhlými zadáními a řešit složitější úkoly v několika krocích. Silné výsledky podle zdroje vykazuje také v prostorovém uvažování a úlohách spojených s robotikou.
Nový model má ale i slabší stránky. V testu zaměřeném na programování skončil až na osmém místě. Otázkou navíc zůstává, jak se výsledky z kontrolovaných benchmarků projeví při běžném používání. První uživatelské reakce podle zdroje naznačují, že mezi výsledky testů a praktickým využitím může být rozdíl.
Google chce model dále zlepšovat hlavně v programování a současně ověřovat jeho fungování v reálném prostředí. Gemini 4 Argon měl v jednom z testů patnáctiprocentní míru halucinací, tedy případů, kdy umělá inteligence poskytne nesprávnou informaci místo toho, aby přiznala, že odpověď nezná.