impetroAIAI Digest

AI Digest

pátek 4. září 2026

5 novinek z 5 zdrojů

Přehled

Latent Space (swyx)3. 9.OpenAIAI agentiAI EngineeringLLM benchmarky

GPT-6 Astra: an automated AI Engineer you can hire for <$6 an hour

OpenAI vypustilo model GPT-6 Astra, který podle autorů newsletteru Latent.Space poráží konkurenční Fable 5.1 a téměř saturuje benchmarky FrontierMath (97,6 %) a ARC-AGI-3 (99,9 %). Tým Latent.Space prohnal modelem přes 20 miliard tokenů a zjistil, že Astra umí samostatně vybírat a trénovat modely, labelovat data, nasazovat a ladit celé systémy a řídit flotily podřízených agentů. Provoz vychází zhruba na 6 dolarů za hodinu (33 tokenů/s při ceně do 50 dolarů za milion tokenů), reálný dvoudenní experiment se správou agentů stál kolem 100 dolarů. Autoři tvrdí, že jde o novou třídu modelů schopných z velké části automatizovat práci AI inženýra.

Proč to je důležité: Pro firmy jde zatím spíš o signál budoucího směru než o okamžitě nasaditelné řešení – jde o rané testy s omezeným přístupem a chybí nezávislé ověření mimo autora newsletteru, ale nízké provozní náklady agentního inženýrství stojí za sledování.

AINews (swyx)3. 9.MetaMuse SparkOpen-weight modelyAI agentiGoogle Gemini

[AINews] Muse Spark 1.3 matches GPT-5.6-Sol, confirming Meta Superintelligence as the newest Frontier Lab, >90% discount for data sharing

Meta spustila Muse Spark 1.3, nejsilnější model řady Spark pro agentní a kódovací úlohy, který se podle AAII žebříčku umístil jako třetí model na světě a benchmarky se vyrovná GPT-5.6-Sol i Opus 5. Zuckerberg model prezentoval jako extrémně levný provoz a oznámil, že brzy vyjdou i otevřené váhy (open weights) Muse Spark. Meta zároveň nabízí neobvyklý cenový model s více než 90% slevou pro zákazníky, kteří souhlasí s využitím jejich dat k dalšímu trénování. Vydání dále zmiňuje Gemini 3.8 Flash Cyber (kybernetický model od Googlu se skóre 86,2 % na CyberGym), video model Wan 3.0 od Alibaby a rostoucí trend agentních harnessů a RL post-tréninkové infrastruktury (Miles, HarnessDev).

Proč to je důležité: Pokud se otevřené váhy Muse Spark skutečně objeví, jde o zásadní posun v dostupnosti frontier-úrovně AI pro firmy bez závislosti na uzavřených API; prozatím je to ale ohlášení, ne produkčně ověřená realita pro nasazení.

AI Secret4. 9.AI agentiBenchmarkyOpenAIGPT-6 Astra

Benckmarks Are Died

OpenAI vydalo model GPT-6 Astra a prezentuje ho jako vstup do „éry AGI“ s výrazným posunem v ovládání počítače, kódování, výzkumu a dlouhých, méně dohlížených úkolech. Autor newsletteru argumentuje, že klasické benchmarky (otázka – předem daná správná odpověď) fungovaly pro chatboty, ale u agentů, kteří dostanou vágní cíl na skutečném počítači, žádná jednotná „správná“ cesta neexistuje. Zmiňuje neověřené, ale výmluvné zprávy, že OpenAI nakoupilo desítky tisíc spotřebitelských Maců pro trénink pomocí reinforcement learningu a computer-use scénářů. Jako náhradu za žebříčky navrhuje hodnocení podobné stáži – dát agentovi laptop, účet, rozpočet a týden času a sledovat spolehlivost, náklady, rychlost a míru potřebné lidské asistence, ne jen procento úspěšnosti.

Proč to je důležité: Pro firmy je to signál, aby při výběru AI agentů nespoléhaly na marketingová čísla z benchmarků, ale testovaly nasazení na vlastních reálných a „špinavých“ procesech – jde ale zatím spíš o koncepční výzvu než o hotovou metodiku hodnocení.

McKinsey Insights3. 9.AI adopceROIAI agentiMcKinsey

AI adoption is surging. Where's the ROI?

Nejnovější McKinsey výzkum State of AI ukazuje, že podíl velkých podniků škálujících autonomní AI agenty vzrostl na 40 % oproti loňským 27 %. Téměř třetina firem nyní vyvíjí software interně pomocí agentického kódování (agentic coding). Navzdory rostoucí adopci zůstává dopad na EBIT na úrovni celého podniku beze změny na 37 %. Autoři Dan Tinkoff, Lieven Van der Veken, Michael Chui a Tara Balakrishnan zkoumají, co dělají jinak organizace, které z nasazení AI skutečně těží měřitelnou hodnotu.

Proč to je důležité: Pro české firmy jde o varování, že masové nasazení AI samo o sobě negarantuje návratnost - rozhodující je škálování napříč podnikem a přestavba procesů, ne jen pilotní projekty.

AI For Work3. 9.Gemini 3.8 FlashGoogleLLM cenyCrowdStrikeAI agenti

Gemini 3.8 Flash makes efficiency its calling card

Google ve středu uvedl Gemini 3.8 Flash, třetí model řady Flash za posledních šest týdnů, který má být jeho nejlepší model pro reasoning a programování při stejné rychlosti a ceně jako předchůdce Gemini 3.7 Flash. Úvodní ceny jsou 0,75 USD za milion vstupních a 3,75 USD za milion výstupních tokenů, model zlepšuje softwarové inženýrství, agentní úlohy a víceúrovňové uvažování. Souběžně Google spustil i Gemini 3.8 Flash Cyber, specializovaný bezpečnostní model s frontier úrovní výkonu v detekci zranitelností a automatizovaném patchování. Google tak sází na poměr cena/výkon v době, kdy ceny tokenů celkově klesají díky přechodu firem na open-source a menší modely.

Proč to je důležité: Levnější a rychlejší modely s dobrým poměrem výkon/cena umožňují firmám nasazovat AI agenty do produkce bez extrémních nákladů na tokeny, což je pro české B2B firmy prakticky využitelné hned – nejde jen o hype kolem frontier modelů.

McKinsey Insights3. 9.Fyzická AIRobotikaMcKinseyWebinář

[Save your spot] Join us for a McKinsey Live virtual event on physical AI

E-mail je pozvánkou na živý webinář McKinsey Live dne 9. září, kde partneři Mark Patel a Ani Kelkar rozeberou téma fyzické AI. Zdůrazňují, že humanoidní roboti přitahují pozornost, ale představují jen zlomek celkové hodnoty fyzické AI. Skutečná konkurenční výhoda podle nich vzniká ve vrstvě softwaru, dat a orchestračních platforem umožňujících autonomním systémům učit se a škálovat, kterou McKinsey odhaduje na 330 miliard dolarů do roku 2035. Součástí e-mailu je i odkaz na související report „The State of AI in 2026“ o firmách s nejlepšími výsledky v nasazení AI.

Proč to je důležité: Pro české B2B firmy je zajímavý odhad 330 miliard dolarů v softwarové a datové vrstvě fyzické AI, který naznačuje, kde vzniká skutečná konkurenční výhoda mimo hardware robotů.

Gartner HR Leaders3. 9.Rozvoj dovednostíHR strategieCHROInterní mobilita

3 Answers to Strengthen Your Skills Strategy

Gartner HR Leaders propaguje report „The 2026 State of Skills“ určený CHRO a HR liderům. Podle Gartneru tři z pěti CHRO uvádí, že potřeby dovedností se mění rychleji, než jejich organizace dokážou připravit podpůrné plány. Report má pomoci zodpovědět tři otázky: které dovednosti by měly dostat prioritní investice, kde může AI přinést největší hodnotu v klíčové práci a jak může interní mobilita zaměstnanců zacelit prioritní mezery v dovednostech. Newsletter dále odkazuje na webinář „Develop a Skills Strategy That Accelerates Organizational Performance“ s návodem na tvorbu strategie rozvoje dovedností.

Proč to je důležité: Pro české firmy je téma relevantní jako rámec pro prioritizaci vzdělávacích investic a interní mobility v době rychle se měnících požadavků na dovednosti, včetně otázky, kde má smysl nasadit AI.

← Všechna vydání