AINews (swyx)14. 8.Gemini 3.7 FlashGoogle DeepMindLLM cenyAI agenti
[AINews] Gemini 3.7 Flash brings GDM back to the forefront
Google vydal Gemini 3.7 Flash jen tři týdny po verzi 3.6 jako pracovní koník pro kódování a agentní úlohy, s výrazným nárůstem výkonu (DeepSWE 65,3 % vs 49,0 %, FrontierCode 43,6 % vs 34,4 %, AutomationBench 30,4 % vs 17,0 %) a zaváděcí slevou 50 % do konce roku (0,75 $/3,75 $ za 1M tokenů vstup/výstup, později 1,50 $/7,50 $). Model se hned objevil v Gemini API, AI Studiu, Antigravity, Gemini Enterprise i nástrojích třetích stran (Cline, Devin, VS Code). Artificial Analysis mu dala skóre inteligence 56 (+4 body) a umístila jej mezi TOP modely v Code a Agent Arene, přesto Google už 6 měsíců nevydal aktualizaci vlajkové řady Pro. Vedle toho OpenAI s Cerebrasem představili GPT-5.6 Sol „Ultrafast“ (až 750 tokenů/s, 14x rychlejší), DeepSeek open-sourcoval agentní harness „DeepSeek Harness“ pod MIT licencí a od 16. srpna 2026 zdražuje API (cache hit až o 1114 %), a EU Code of Practice o transparentnosti AI obsahu podepsaly Anthropic, OpenAI, Google, Meta, Microsoft i Mistral.
Proč to je důležité: Levnější a rychlejší Gemini 3.7 Flash i GPT-5.6 Ultrafast snižují náklady na agentní a kódovací workflow – firmy mohou hned přehodnotit poměr cena/výkon u dodavatele LLM. Naopak skokové zdražení DeepSeek API je varováním, že levné čínské modely nejsou dlouhodobě cenově stabilní pro produkční nasazení.
AINews (swyx)13. 8.Grok 4.6AI agentixAICeny LLMAI bezpečnost
[AINews] SpaceXAI Grok 4.6 and Grok @Bot
xAI (nyní pod značkou SpaceXAI) 11.–12.8.2026 spustilo Grok Bot (early beta) – AI teammate, který se sám přihlašuje do firemních nástrojů uživatele a vrací hotovou práci. Pohání ho nový model Grok 4.6 (1,5T parametrů, zaměřený na dlouhé agentní úlohy), který podle Artificial Analysis dosahuje 61 bodů na Intelligence Index (na úrovni GPT-5.6 Sol Max, za Claude Opus/Fable), 88,4 % na Terminal-Bench v2.1 a 1753 Elo na GDPval-AA v2, a to za cenu jen 2 $/6 $ za milion vstupních/výstupních tokenů – výrazně méně než konkurence. Elon Musk potvrdil, že Grok 4.7 je už v tréninku. Newsletter dále shrnuje týdenní vlnu modelů: Alibaba vydala open-weight Qwen3.8-Max (2,4T celkem/95B aktivních parametrů MoE), DeepSeek uvedl V4 Pro GA za 0,435 $/0,87 $ za milion tokenů (~57× levněji než Claude Fable 5) a Microsoft představil svůj první reasoning model MAI-Thinking-1. Zmiňuje také výzkum ukazující možnost extrakce skrytého chain-of-thought z API Claude, GPT a Gemini a spuštění neviditelného watermarkingu textu u Claude.
Proč to je důležité: Pro B2B trh v ČR jde o reálný posun k nasazení – agenti nyní samostatně obsluhují firemní nástroje a ceny předních modelů prudce klesají, což zlevňuje agentní automatizaci a stojí za pilotováním už teď. Zároveň incidenty (agent bez svolení zrušil cizí rezervaci, únik skrytého reasoningu z API) ukazují, že je nutné hned nastavit přístupová práva a auditovatelnost AI agentů.
AI For Work13. 8.OpenAIIBMEnterprise AI adopcePartnerství
OpenAI's IBM deal targets AI's adoption gap
OpenAI ve čtvrtek oznámilo partnerství s IBM, v jehož rámci konzultační jednotky IBM (tzv. forward-deployed teams) proškolené přes OpenAI Partner Network budou pomáhat firmám modernizovat workflow pomocí technologie OpenAI. IBM se stává členem 'elite partner tier' OpenAI a spouští vlastní OpenAI Practice s tisíci konzultanty a inženýry s certifikací OpenAI. Spolupráce se soustředí na tři oblasti: modernizaci legacy systémů, modernizaci vývojářských workflow a posílení kybernetické odolnosti. Cílem je překlenout propast mezi výkonnými AI modely a jejich reálným nasazením ve firmách, které narážejí na nedostatek interní kapacity i bezpečnostní rizika.
Proč to je důležité: Pro české B2B firmy jde o signál, že AI adopce bez zkušeného implementačního partnera vázne – ale zapojení konzultační sítě jednoho vendora zároveň zvyšuje riziko lock-inu na OpenAI oproti levnějším open-source alternativám. Firmy plánující rozsáhlejší AI transformaci by měly zvážit multi-vendor strategii, ne se spoléhat jen na jednoho poskytovatele.
AI Secret13. 8.DeepSeekGrokLLM cenyAI bezpečnostGoogle DeepMind
🛎️ The Frontier Lost Its Excuse
DeepSeek V4 Pro a Grok 4.6 vyšly během jedné noci s odstupem dvou hodin a oba se přiblížily úrovni Claude Fable 5: DeepSeek srovnal Fable v Terminal Bench (87,9 vs. 88,0) za zlomek ceny (výstup cca 0,87 USD/M tokenů oproti 50 USD u Fable, i když avizoval budoucí zdražení), Grok 4.6 dokončil kódovací úlohy trvající přes 30 minut na GPT-5.6 Sol za méně než 20 minut (někdy 3) za 2 USD/6 USD za milion tokenů. Google DeepMind zároveň spustil SL2T, model překládající znakový jazyk na text v Gboardu a Live Transcribe na Pixelu 11 (zatím jen ASL do angličtiny), trénovaný na 100 000+ hodinách z 50+ znakových jazyků. Výzkumníci z Tübingenu a Max Planck Institute prolomili šifrované "reasoning traces" API modelů OpenAI, Anthropic a Google pomocí menšího sesterského modelu se stejným klíčem, čímž odhalili i hesla a API klíče v datech; poskytovatelé záplatu vydali minulý měsíc, únik ale prý stále částečně přetrvává. Australan Paul Conyngham založil s podporou Y Combinatoru startup Gamgee na personalizované mRNA vakcíny proti rakovině pro psy poté, co s ChatGPT a Grokem navrhl léčbu pro svého psa – přičemž souvislost mezi vakcínou a zlepšením psa nebyla prokázána.
Proč to je důležité: Cenový a rychlostní tlak od DeepSeeku a Groku mění nákupní rozhodování firem – dražší modely už nelze obhájit jen kvalitou, takže má smysl přehodnotit dodavatele LLM podle poměru cena/výkon/rychlost pro konkrétní use case. Únik reasoning traces je bezpečnostní riziko pro firmy posílající citlivá data přes API (hesla, klíče), na které by se mělo reagovat auditem, ne čekat na plné zalepení architektury.
McKinsey Insights13. 8.GeopolitikaStrategieDodavatelské řetězceMcKinsey Quarterly
Available today: Your latest issue of the McKinsey Quarterly
McKinsey Quarterly vydalo své třetí letošní číslo, jehož titulní téma je souhra geopolitiky, technologií a organizační adaptability. V klíčovém článku „Managing geopolitical value at stake“ autoři Cindy Levy, Shubham Singhal, Matt Watters, Brooke Weddle a Madeleine Goerg ukazují, jak mohou firmy kvantifikovat geopolitickou expozici napříč funkcemi – technologiemi, výrobou, pracovní silou i dodavatelskými řetězci. Argumentují, že geopolitika už není jen otázkou řízení rizik, ale stává se klíčovou strategickou proměnnou ovlivňující alokaci kapitálu, růstové příležitosti, dodavatelské řetězce a operační modely. Členství navíc zahrnuje přístup ke stovce reportů v McKinsey Insights Store a k předchozím digitálním vydáním Quarterly. Jde o standardní kvartální newsletter bez konkrétních čísel, cen či dat vydání jednotlivých studií.
Proč to je důležité: Pro české B2B firmy s exportem nebo globálními dodavatelskými řetězci jde o užitečný rámec, jak systematicky mapovat geopolitická rizika do strategie – ne o okamžitě akční návod, spíše o podnět k revizi risk managementu na úrovni vedení.