Společnost Celeris představila model Celeris-1 Magnus zaměřený na úlohy, v nichž AI agent opakovaně používá nástroje a plní delší pracovní postupy. Model podporuje text i volání nástrojů, nabízí kontextové okno 131 072 tokenů a maximální výstup 16 384 tokenů. Vývojáři se k němu mohou připojit přes rozhraní kompatibilní s API OpenAI, takže u existujících aplikací stačí změnit základní adresu a identifikátor modelu. Firma na testu τ³-bench Banking uvádí úspěšnost 41,2 procenta při mediánu 55 sekund na úlohu v režimu nízkého uvažování. Jde však o výsledky zveřejněné samotným výrobcem, které bude potřeba nezávisle ověřit. Novinka míří hlavně na vývojáře, kteří potřebují rychlé reakce při vícekrokové automatizaci a práci s externími nástroji.

Radyz

Radyz publikuje komentáře a praktické texty o AI nástrojích, ChatGPT, Claude a dění kolem OpenAI a Anthropicu. Na webu se soustředí na srozumitelný výklad, vlastní zkušenost a důraz na to, co je pro čtenáře skutečně užitečné.