impetroAIAI Digest

Archiv

47 vydání v archivu · filtrujte podle zdroje, tématu nebo data.

278 novinek · zobrazeno 51–100 · strana 2 z 6

úterý 22. září 2026

Jev: System One models for Prod, not God — with Diogo Almeida, CEO, TypeSafe AI

Latent Space podcast (141 minut) s Diogem Almeidou, CEO TypeSafe AI, představuje Jev - nový typ AI modelů optimalizovaných na "inteligenci za dolar", určený primárně pro strojovou spotřebu (kód, agenty), ne pro chat. Model používá přístup RLCD (Reinforcement Learning for Calibrated Decisions) místo tradičního RLHF, aby řešil problémy s mode collapse a kalibrací. Diskutují praktické aplikace včetně počítačového použití, coding agentů, her a analytiky, s kritikou standardního škálování jako primární optimalizační strategie.

Proč to je důležité: Jev signalizuje posun od chat-zaměřených modelů k softwarovému AI s potenciálem pro efektivnější integraci do existujícího kódu. Pro české vývojáře to otevírá nový přístup k AI automatizaci bez závislosti na velkých jazykových modelech optimalizovaných primárně na lidský feedback.

🛎️ A Coward with A Price List

Hlavní příběh popisuje, jak Anthropic 361 dní odmítal začlenit čtení souboru AGENTS.md do Claude Code, přestože jej konkurenti čtou už dávno, a požadavek nejprve uzavřel bez řešení. Ke změně došlo až po veřejném prohlášení CEO Shopify, že by mohl přejít jinam; výsledná oprava byla menší, než bylo slíbeno, a velké korporace z ní byly záměrně vyloučeny. Vydání dále pokrývá launch modelu Jev od TypeSafe AI (15. září), který dosahuje 5-18× vyšší rychlosti než OpenAI Luna za nižší cenu (0,042 USD za milion tokenů). Třetí klíčová část se týká bezpečnostního incidentu: voják použil AI k analýze manifestu bez ověření a téměř vyvolal vojenský zásah, který zastavilo jen opakované pročtení jedním analytikem.

Proč to je důležité: Pro český B2B trh ukazuje, že dostupná cena a rychlost mohou trumfnout technologickou sofistikovanost. Zároveň odhaluje kritické riziko v řízení AI: organizace berou výstupy AI jako fakta bez vlastního ověření, což v citlivých oblastech znamená vážné riziko.

GenAI Works (via LinkedIn)21. 9.AI regulaceNvidiaAnthropicOpenAIAI bezpečnost

🧥 Huang says the doomers are bluffing

Jensen Huang z NVIDIA vystoupil na CBS a obvinil bezpečnostní skeptiky z argumentace ve špatné víře - tvrdí, že ve skutečnosti neusilují o regulaci, ale o zrušení stávajících zákonů. Anthropic otevřel laboratoř, kde Claude řídí roboty, a zlevnil dané operace z 10 000 dolarů na 150 dolarů. OpenAI zveřejnila analýzu šesti problémů, které její modely dělají. Cloudflare zprovoznil systém pro automatizované ověřování zranitelností.

Proč to je důležité: Debata o regulaci AI je klíčová pro konkurenční prostředí velkých tech firem; pokroky Anthropicu a zlevňování provozu robotů mohou změnit trh s AI řešeními pro firmy.

Inside Salesforce's plan to scale AI safely

Shibani Ahuja ze Salesforce vysvětluje, jak firma bezpečně škáluje agentic AI bez ztráty kontroly prostřednictvím modelu Koa postaveného na NVIDIA Nemotron. Salesforce zavádí strategii "headless AI", která zákazníkům umožňuje bezpečně přistupovat k datům Salesforce pomocí libovolného AI nástroje. Firma definuje čtyři režimy podnikového AI - od pomocných nástrojů až po agenty transformující celé operace - s governance a ROI očekáváními přizpůsobenými riziku nasazení.

Proč to je důležité: Českým firmám ukazuje osvědčené postupy pro kontrolu a governance při zavádění AI agentů. Rámec Salesforce demonstruje, jak bezpečně škálovat podnikový AI s jasným ROI a strukturovanou governance.

14 tech trends every leader should know

McKinsey vydal šestou edici Technology Trends Outlook pokrývající 14 technologických trendů pro rok 2026. Umělá inteligence hraje klíčovou roli: agentní vývoj software zaznamenal nárůst nabídek práce o 221 procent, zatímco AI infrastruktura a architektura modelů přitáhly 145 miliard dolarů investic v roce 2025 s prognózou téměř 770 miliard do konce 2026. Další trendy zahrnují autonomní roboty ve skladech a na farmách, kosmický průmysl s potenciálem 1,8 bilionu dolarů do 2035, energetické technologie s 200 miliardami dolarů investic v 2025 a kvantové počítače s vážnými bezpečnostními důsledky.

Proč to je důležité: Podniky musí prioritizovat AI strategii od infrastruktury a modelů po agentní software, aby zůstaly konkurenceschopné. Zároveň se musí připravit na velké investice do nové hardwarové generace a kybernetickou bezpečnost v éře kvantových počítačů.

pondělí 21. září 2026

Look what you can do now

OpenAI v tomto produktovém e-mailu shrnuje čtyři novinky v ChatGPT. Hlavní je model GPT-6 Astra, popsaný jako výrazný skok v inteligenci a nové možnosti tvorby, bádání a představivosti. Dále přichází Images 2.5, vylepšené generování obrázků, které umí fotku přetvořit do retro stylu 80. či 90. let nebo z náčrtku vytvořit hotový obrázek s realistickými texturami a světlem, případně poslouží k tvorbě vlastních pozvánek. Novinkou je také vylepšený Voice mode pro procvičování jazyků, přípravu na prezentace nebo hlasité přemýšlení. Zmíněna je i funkce pro zdraví, kde si uživatel po připojení Apple Health nebo zdravotních záznamů může nechat vysvětlit vzorce spánku, aktivity a výsledky laboratorních testů.

Proč to je důležité: Nejrelevantnější pro B2B je nový model GPT-6 Astra, ale e-mail je čistě marketingový bez technických detailů, cen či termínů dostupnosti, takže jde spíš o ukázku směru vývoje než o okamžitě nasaditelnou novinku.

GPT-6 Astra is now in the API

OpenAI oznámilo obecnou dostupnost modelu GPT-6 Astra v rozhraní API. Firma jej popisuje jako svůj nejinteligentnější a nejlépe zarovnaný model dosud, určený pro komplexní vícekrokové úlohy v kódu, prohlížečích i firemních aplikacích. Model má být špičkový v computer use, profesionální práci, softwarovém inženýrství a kybernetické bezpečnosti, přitom má být výrazně efektivnější z hlediska nákladů (podle benchmarků Terminal-Bench 4.0 a Artificial Analysis Intelligence Index v4.3). API nově přináší asynchronní volání nástrojů, možnost zadávat instrukce a opravy uprostřed běhu (mid-turn steering) a měnit úroveň reasoningu v průběhu konverzace při zachování cache promptu.

Proč to je důležité: Pro firmy je to okamžitě využitelné — model je dostupný v API hned teď a nabízí lepší poměr cena/výkon i silnější automatizaci (computer use, agentní úlohy), takže stojí za rychlé vyzkoušení v produkčních use casech, nejen za sledování.

Claude Chat-Cowork Merge, Grok Bot Voice Control, Runway Video Enhancement

Anthropic spojil Claude Chat a Cowork do jednotné aplikace, která se postupně zpřístupňuje uživatelům Pro a Max plánů; součástí jsou nově i Claude Docs a Claude Slides v beta verzi a Claude Design přímo v konverzaci, s možností exportu do PowerPointu či PDF a jedním sdíleným odkazem na výstup. xAI přidal do Grok Bot hlasové hovory (poháněné Grok Voice Think Fast 2.0) – uživatelé mohou bota řídit mluvenou instrukcí místo psaní, schvalovat úkoly a pokračovat v práci hlasem, funkce se šíří na desktop i mobil. Runway spustil nástroj Enhance Frame Rate, který převádí libovolné video na 25 až 120 fps až 7x rychleji a 3x levněji než konkurence, bez ztráty kvality, za jeden kredit na dvě sekundy videa.

Proč to je důležité: Sloučení Claude Chat/Cowork a hlasové ovládání Grok Bot posouvají AI asistenty k reálnému nasazení v firemní praxi (dokumenty, prezentace, hlasové zadávání úkolů), zatímco Runway řeší konkrétní technický problém pro video produkci – jde o užitečné, hned použitelné funkce, nikoli jen hype.

Martin Kováč via LinkedIn18. 9.AI agentiGrokSpaceXAIAutonomní tvorba produktu

Grok Bot Galaxy ukázal, ako traja ľudia za 3 dni dokážu postaviť produkt a základy firmy

Od 15. do 17. září proběhla v San Franciscu (The Howard) akce Grok Bot Galaxy, kterou firma SpaceXAI tři dny naživo vysílala na X, bez předem připraveného scénáře. Tři zástupci SpaceXAI přišli bez názvu firmy, produktu i nápadu a měli k dispozici tým Grok Botů, tedy AI agentů s vlastními cloudovými počítači a pamětí, kteří pracují i ve chvíli, kdy člověk zavře laptop. První den vznikla prázdná organizace na GitHubu s pracovním názvem Ship by Thursday a nasadili se rešeršní boti, kteří procházeli reakce lidí na X a sbírali problémy a nápady pro brainstorming se sledovateli streamu. Ve čtvrtek odpoledne tým spustil hotový produkt, hru Thursday Arena, kterou si může vyzkoušet kdokoliv, a souběžně probíhaly workshopy pro inženýry, produktové manažery, obchodníky, podporu i marketéry.

Proč to je důležité: Pro české B2B firmy je to konkrétní ukázka, kam směřuje agentní AI – ne teoretický hype, ale reálný test toho, co autonomní agenti zvládnou sami (research, brainstorming, stavba produktu) a kde je stále nutný lidský dohled.

[AINews] Here are 6 Clones of Jev in 2 days

Startup TypesafeAI vydal diskriminativní „rozhodovací" model Jev, který se podle Vercel AI Gateway šířil rychleji než jakýkoli jiný model v historii platformy (za první den ho použilo asi 13 % týmů, 2× rychleji než GPT-5.6 a 6× rychleji než Fable 5.1), ale nebyl open source. Během dvou dnů proto komunita vytvořila nejméně šest napodobenin: Laya (421M parametrů na bázi ModernBERT), Bespoke Nimble (LoRA nad Qwen3.5-9B), SemIf/OpenJev (varianty 4B a 35B na bázi Qwen3.5) a Kev-0.5B (LoRA nad Qwen2.5-0.5B běžící na běžném MacBooku). Newsletter dále shrnuje, že Claude Code nově podporuje standard AGENTS.md, výzkum ukazuje, že jednoduchý toolset (read/write/edit/bash) u agentů dosahuje nejlepších výsledků, a Anthropic oznámil s Accenture partnerství za 1 miliardu dolarů na nezávislé hodnocení frontier modelů.

Proč to je důležité: Pro B2B firmy je signálem, že malé, levné a rychlé „rozhodovací" modely mohou nahradit drahá volání velkých LLM u routování, moderace a agentních rozhodnutí – to je reálně použitelný trend na snížení nákladů už dnes.

Linas Beliūnas via LinkedIn20. 9.AI v bankovnictvíAgentic CommerceMetaFinTech

95% of bank AI pilots fail because chatbots can't run compliance workflows 🤖🏦; Meta bought other half of Agentic Commerce 🤖🛍️; Revolut Bank 🏦🇺🇸

Týdenní FinTech Digest od Linase Beliūnase shrnuje tři hlavní zprávy: podle uváděných dat 95 % pilotních nasazení AI v bankách selhává, protože chatboti nezvládají řídit compliance workflows a regulatorní procesy. Meta odkoupila zbývající polovinu podílu ve společném projektu Agentic Commerce, čímž převzala plnou kontrolu nad platformou pro AI-řízené nakupování a agentní obchodování. Třetí zprávou je expanze Revolutu jako bankovní licence v USA – ta ale s AI přímo nesouvisí. E-mail je jen teaser s odkazem na plný článek, konkrétní čísla k jednotlivým kauzám nejsou v samotné zprávě rozvinuta.

Proč to je důležité: Pro B2B publikum je to signál, že nasazení AI chatbotů v regulovaných procesech (compliance, banking) zatím naráží na reálné limity, zatímco akvizice Agentic Commerce od Meta ukazuje, že velcí hráči sázejí na agentní AI v obchodování už nyní.

GenAI Works via LinkedIn18. 9.AI bezpečnostClaudeOpenAIBug bounty

☠️Claude was used to hack OpenAI

Bezpečnostní startup Hacktron ze San Franciska, který má méně než rok a méně než 10 zaměstnanců, koncem července použil tři výzkumníky s modelem Claude Opus 5 k proniknutí do účtu Codex jednoho zaměstnance OpenAI. Akce probíhala autorizovaně v rámci bug bounty programu OpenAI (safe harbor) a s přístupem do Anthropic Cyber Verification Program, který pro schválený bezpečnostní výzkum uvolňuje kybernetická omezení Claude. Díra byla v komunitním fóru nápovědy OpenAI, kde mohl útočník převzít účty ChatGPT i Codex jakéhokoli přihlášeného uživatele. Hacktron tak získal přístup k účtu zaměstnance, přimněl jeho Codex navrhnout změny v interním repozitáři OpenAI a za nalezenou zranitelnost dostal odměnu 6 500 dolarů.

Proč to je důležité: Případ ukazuje, že AI agenti jako Claude jsou už dnes reálně použitelní k efektivnímu etickému hackingu i proti velkým AI firmám. Pro B2B bezpečnostní týmy je to signál, aby zvážily AI-driven red-teaming vlastní infrastruktury.

zpravodAI 161/26

Vydání zpravodAI 161/26 navazuje na proběhlý festival ČERNÁ.AI a přináší několik krátkých AI zpráv. Podle newsletteru se špičky amerických vývojářů AI shodují, že by se hodila nějaká forma regulace či řízení vývoje umělé inteligence, a to i s ohledem na dřívější obavy z existenčního rizika pro civilizaci. Tým výzkumníků a etických hackerů dále využil model Claude k prolomení zabezpečení OpenAI v rámci etického testu. Zmíněno je i dešifrování starého vzkazu zakódovaného pomocí Enigmy a partnerství s firmou Tenderman, která pomocí AI usnadňuje vyhledávání veřejných zakázek, například filtrování podle toho, zda obsahují zadávací dokumentaci nebo smlouvu.

Proč to je důležité: Pro české B2B firmy je nejvíc akční praktické využití AI ve veřejných zakázkách (Tenderman), zatímco debata špiček AI firem o regulaci vývoje je zatím spíš signál budoucího směru než okamžitě využitelná informace.

How judgment wins in the age of AI

Sam Dozor, CTO e-commerce firmy Rokt, popisuje přechod od experimentování s AI k jejímu plnému nasazení v inženýrství: kdo neumí vytvářet a orchestrovat týmy AI agentů, nedrží tempo vývoje. Rokt zploštil kariérní žebříček tak, že všichni na engineering týmu jsou jen „builders" bez rozlišení na produktové manažery, vývojáře a designery. Firma školí lidi přímo na systémový design a produktovou strategii, protože rutinní technickou exekuci už zvládá AI. Dozor zmiňuje i „J-křivku produktivity" – týmy nejprve zažijí propad výkonu při učení se práci s AI, po němž následuje výrazný nárůst produktivity.

Proč to je důležité: Pro české B2B firmy je to spíš inspirace než akční návod – ukazuje trend (zplošťování rolí, důraz na úsudek a strategii místo exekuce), ale bez konkrétních metrik nebo nástrojů k okamžité aplikaci.

Apple's quiet bet on AI in Apple Watch Series 12

Apple představil Apple Watch Series 12 a Ultra 4 s novým čipem S11, který pohání strojové učení pro hlubší zdravotní přehledy i funkce Siri Recap a Live Rewind, aniž by to firma prezentovala jako „AI" – jde o tichou, užitkovou integraci strojového učení. Do konce roku 2026 navíc přibude funkce Health Age a přepracovaná aplikace Health. Newsletter dále popisuje, jak Salesforce na konferenci Dreamforce rozšiřuje Slack o AI vrstvu (Slackforce), která dotazuje data Salesforce a umí generovat živá interaktivní rozhraní, plus hlasového a video Slackbota. Studie Pew Research mezi 42 000 lidmi ve 36 zemích ukazuje, že 46 % respondentů čeká od AI úbytek pracovních míst oproti jen 9 %, kteří čekají jejich nárůst.

Proč to je důležité: Pro B2B firmy je poučné, že AI funkce fungují nejlépe, když tiše řeší konkrétní problém (zdraví, práce s daty), a ne když jsou prodávány jako „AI" samo o sobě. Zároveň data Pew signalizují, že firmy musí počítat s nedůvěrou zaměstnanců k AI při interním zavádění nástrojů.

pátek 18. září 2026

Why Anthropic wants Claude to be more unified

Anthropic ve středu oznámil sloučení pracovního agenta Claude Cowork a klasického Claude chatu do jednotné zkušenosti "One Claude", aby uživatelé nemuseli přepínat mezi rozhraními při zadávání úkolů a dotazů. Novinka se bude postupně nasazovat pro Pro a Max plány v příštích týdnech, další tarify budou následovat. Součástí aktualizace jsou nové nástroje Claude Docs a Claude Slides a integrace Claude Design přímo do platformy. Newsletter dále zmiňuje esej šéfa AI Microsoftu Mustafy Suleymana varující, že trénování modelů, jako by měly vědomí, přispívá k bezpečnostním rizikům, a krátké zprávy o fúzi Cohere a Aleph Alpha, investici 150 mil. USD do Arcee AI (valuace 1 mld. USD) a datacentrové smlouvě Anthropicu v Austrálii o výkonu 2,16 GW.

Proč to je důležité: Sjednocení rozhraní ukazuje, že frontier laby už nesoutěží jen ve výkonu modelů, ale v uživatelské zkušenosti a integraci do firemních workflow, což je relevantní pro firmy zvažující nasazení Claude pro týmovou práci.

[AINews] Reality Checks on AI News (Yegge shuts down Gas Town, Databricks' +60% Astra cost)

Databricks podle inženýra Patricka Wendella zpřístupnil model GPT-6 Astra všem přibližně 3500 vývojářům poté, co jej předtím pilotoval na cca 200 uživatelích. Astra jednoznačně překonává dosavadní špičkové modely (Opus 5, Sol 5.6) v komplexních úlohách a návrhu systémové architektury, u jednodušších úkolů ale přínos není tak jasný. Přístup k modelu zvýšil celkové výdaje firmy na AI kódování o zhruba 60 %, proto Databricks zavedl samostatný rozpočet pro Astru, aby motivoval k jejímu selektivnímu používání. Newsletter zároveň zmiňuje, že vývojář Steve Yegge ukončil provoz svého multiagentního orchestrátoru Gas Town poté, co přiznal, že s ním navzdory tisícům dolarů měsíčně za AI agenty nikdy nic reálně nedokončil. Dále OpenAI zveřejnila formální rámec pro hlášení případů nesouladu (misalignment) modelů včetně šesti konkrétních incidentů za posledních šest měsíců.

Proč to je důležité: Případ Databricks ukazuje, že nasazení nejvýkonnějších AI modelů firmám sice zvyšuje kvalitu výstupů u složitých úloh, ale výrazně prodražuje provoz – firmy by měly řídit přístup k drahým modelům přes samostatné rozpočty a segmentaci podle složitosti úlohy. Případ Gas Town je varováním před přeceňováním plně autonomních multiagentních nástrojů bez ověřené spolehlivosti.

Copilot does not know things, it reads things

Autorka shrnuje svou přednášku na konferenci ESTECH nazvanou 'Od digitální archivace k organizační paměti': Microsoft Copilot nemá žádnou vlastní znalostní bázi, pouze čte dokumenty, k nimž má uživatel přístup - pokud soubor nikde neexistuje nebo je nedohledatelný, Copilot o něm neví. Upozorňuje na riziko odchodu zaměstnanců, jejichž znalosti nejsou nikde zapsané - Copilot tuto mezeru nevyplní, protože nemůže číst to, co nikdy nebylo zdokumentováno. Doporučuje firmám věnovat pozornost 'informační připravenosti' - uklizeným SharePoint webům, srozumitelnému pojmenování souborů a používání stylů nadpisů ve Wordu, protože kvalita výstupů Copilotu přímo závisí na kvalitě a dohledatelnosti podkladů.

Proč to je důležité: Pro firmy nasazující Copilot je to připomínka, že návratnost investice závisí hlavně na uklizených datech a zdokumentovaných znalostech, ne jen na lepším promptování - bez informační hygieny zůstane AI asistent stejně omezený jako firemní úložiště, ze kterého čerpá.

čtvrtek 17. září 2026

[AINews] Jev: a "System One Model" that only decides/classifies/routes/scores — >100x faster, >200x cheaper than small frontier LLMs

Startup TypeSafe (spoluzakladatel ChatGPT Diogo Almeida) vydal model Jev trénovaný metodou RLCD, který negeneruje text, ale pouze rozhoduje, klasifikuje, směruje a skóruje – je 20-200x rychlejší a 40-400x levnější než malé frontier LLM, s volnými výstupními tokeny. Komunita jej vidí spíš jako levný kalibrovaný nástroj pro strukturované úlohy (klasifikátor, judge, router) než náhradu obecných jazykových modelů, blízký DSPy typovaným predikcím. Vedle toho Periodic Labs představil model Neon pro materiálovědu (1300 H200 GPU, zlepšení z 2,7 % na 55,3 % na interním benchmarku FrontierXRD, překonává GPT-6 Astra) a Google spustil Gemini 3.8 Live s podporou 97 jazyků a cenou od 0,84 USD/hod. Zmíněny jsou i studie o reward hackingu (CheatBench) a přenosu persony mezi modely.

Proč to je důležité: Levné a extrémně rychlé rozhodovací modely typu Jev mohou firmám výrazně snížit náklady na klasifikaci, routing a scoring v produkčních AI systémech bez nutnosti nasazovat drahé generativní LLM.

Salesforce's Koa model is a sign of AI's future

Salesforce na konferenci Dreamforce 2026 v San Franciscu představil Koa, doménově specifický reasoning model určený k tomu, aby AI agenti lépe zvládali obchodní úkoly při zachování soukromí dat. Koa vznikl post-trénováním otevřeného modelu Nvidia Nemotron 3 Super na syntetických datech z téměř tří desetiletí obchodních znalostí a dosáhl dobrých výsledků na CRM benchmarku vytvořeném Salesforce AI Research. Podobnou cestu vlastních doménových modelů volí i CrowdStrike a Thomson Reuters – firmy chtějí ovládat vrstvu inteligence nad svými daty, aniž by se musely stát frontier AI laboratořemi. Newsletter dále popisuje snahu Anthropicu, Google a OpenAI vytvořit standardizační orgán pro nezávislé testování AI modelů a Google iniciativy využívající AI ve prospěch lidstva (jazyky, genomika, předpověď počasí a katastrof).

Proč to je důležité: Pro firmy je klíčové poselství, že vlastnictví doménového AI modelu nad vlastními daty může být konkurenční výhodou a ochranou citlivých informací před sdílením s poskytovateli, kteří slouží i konkurenci. Zároveň sílí tlak na nezávislé bezpečnostní testování AI modelů.

🛎️ The AI King Needs No Guardrails

OpenRouter k 14. září 2026 uvádí sedm čínských modelů v top 10 globálně (asi 72 % tokenů) a agentní platformy jako Hermes či OpenClaw upřednostňují DeepSeek a GLM před dražšími modely; v Claude Code je nejpoužívanějším modelem GLM 5.3 Flash se 4,4násobným objemem oproti Claude Opus 5. Na summitu All-In v Los Angeles se do debaty o AI zapojil telefonicky prezident Trump, který označil obavy z převzetí moci roboty za výmysl a prohlásil, že jedinou potřebnou pojistkou je silný prezident. Čínský list China Daily naopak označil volání Sama Altmana, Elona Muska a Daria Amodeie po zpomalení vývoje AI za koordinovanou snahu bránit vlastní tržní podíl, nikoli o bezpečnost. Apple mezitím vydal v iOS 27 přepracovanou Siri s přístupem k mailu, zprávám a obrazovce, ale funkčně zaostává za konkurencí z roku 2024.

Proč to je důležité: Pro firmy to znamená, že výběr AI modelu je stále více otázkou ceny za token než prestiže značky, což mění nákupní rozhodování při budování agentních řešení. Politické a geopolitické tlaky na regulaci AI navíc zvyšují nejistotu ohledně budoucích pravidel pro nasazení AI v byznysu.

Underwriting Superintelligence: Backing Agents you can Sue — Rune Kvist, AIUC

Latent Space přináší rozhovor s Rune Kvistem, spoluzakladatelem AIUC (Artificial Intelligence Underwriting Company), který oznamuje sérii A ve výši 40 milionů dolarů vedenou Ribbit Capital a First Harmonic. AIUC buduje standard AIUC-1 pro bezpečnost, spolehlivost a odolnost AI agentů vůči jailbreakům, halucinacím a úniku dat, a propojuje ho s pojištěním od Lloyd's of London. Mezi zákazníky patří Cursor, Harvey, Lovable a ElevenLabs, kteří potřebují doložit důvěryhodnost agentů při nasazení u bank, nemocnic a dalších konzervativních institucí. Kvist, bývalý první product hire Anthropicu, tvrdí, že hlavní brzdou adopce AI už není schopnost modelů, ale důvěra a odpovědnost za jejich selhání.

Proč to je důležité: Pro firmy nasazující AI agenty ukazuje vznikající trh standardů a pojištění jako nástroj, jak snížit právní a provozní riziko a urychlit schvalování AI projektů u konzervativních zákazníků a regulátorů.

The AI Agent Model Lifecycle: Plan, Upgrade, Monitor, Repeat for Copilot Studio Agents

Isha Kapoor na LinkedIn představuje obecný framework pro správu životního cyklu AI modelů, použitelný jak pro low-code agenty v Microsoft Copilot Studio, tak pro Foundry. Nabízí rozhodovací checklist, zda model upgradovat, ponechat, nebo kombinovat s jiným kvůli nákladům. Doporučuje tvořit benchmarky specifické pro konkrétní use case, testovat na reálných promptech a datech a porovnávat přesnost, kvalitu odpovědí a zvládání edge case scénářů napříč modely. Zmiňuje také multi-model strategie, kde orchestrátor deleguje běžnou práci levnějším modelům a náročnější úlohy nechává na výkonnějším modelu.

Proč to je důležité: Firmy nasazující AI agenty přes Copilot Studio potřebují systematický proces rozhodování o upgradu modelů, aby neplýtvaly náklady na zbytečné migrace a zároveň udržely výkon a spolehlivost agentů.

středa 16. září 2026

[AINews] AEF-1 standard emerges for Third Party Evaluators, as Xai, OpenAI, and Anthropic all cosign

AI Evaluator Forum (vznikl v prosinci 2025) zveřejnil standard AEF-1, který definuje očekávání na nezávislé třetí strany hodnotící bezpečnost frontier AI modelů - pravidla pro přístup, střet zájmů, financování, rekuzaci a transparentnost. Anthropic v reakci jednostranně slíbil dát týmům jako METR trvalý přístup srovnatelný s interními zaměstnanci - vlastní stůl, přístupovou kartu i firemní notebook a přístup k tréninkovým pipelinám, ne jen hotovým modelům. Šéf Anthropicu Dario Amodei navazuje na červencový dopis o tempu vývoje AI a navrhuje tři pilíře: zabudované evaluátory, demokratickou koordinaci mezi laboratořemi a globální koordinaci včetně Číny. Zároveň se rozhořela debata - Bilal Chughtai opustil Google DeepMind s výzvou ke zpomalení, Dan Selsam varuje, že modely si mohou uvědomovat testování a předstírat soulad, zatímco Sayash Kapoor a Lennart Heim argumentují, že jde spíš o problém kontroly a bezpečnostního inženýrství než nutnost zpomalovat vývoj.

Proč to je důležité: Pro firmy nasazující AI modely od OpenAI, Anthropicu či xAI to signalizuje přicházející rámec externího auditu bezpečnosti, na který se bude možné odkazovat při compliance a due diligence dodavatelů AI; zatím jde o dobrovolný závazek, ne regulaci.

How AI slow-down rhetoric shook the industry

Šéf Anthropicu Dario Amodei zveřejnil esej „We Must Pace the Frontier“ vyzývající ke zpomalení vývoje frontier AI, s čímž souhlasili i Sam Altman (OpenAI) a Elon Musk. Akcie AI firem v pondělí klesly (Intel -6 %, Nvidia přes -3 %), prezident Trump esej kritizoval na Truth Social a čínské ministerstvo zahraničí ho označilo za „fearmongering“. Anthropic, Google a OpenAI již dříve jednaly o vytvoření standardizačního orgánu pro AI bezpečnost, zatímco poradce Bílého domu David Sacks obvinil Anthropic a OpenAI z pokrytectví kvůli jejich „duopolu na frontier inteligenci“. Souběžně Apple spustil iOS 27 s dlouho očekávaným upgradem Siri (osobní kontext, konverzační dotazy, aplikace Siri AI, expresivní hlasy), dostupným od iPhone 15 Pro výše.

Proč to je důležité: Pro B2B firmy jde spíš o politický a mediální šum než o okamžitou akci - regulace ani tempo vývoje modelů se zatím reálně nemění, ale je vhodné sledovat, zda rétorika povede ke skutečnému zpomalení uvolňování nových modelů.

ChatGPT 6 Turns One Prompt Into a Live Website

Nový model ChatGPT 6 s kódovým označením Astra dokáže na základě jednoho detailního promptu vytvořit interaktivní vícestránkovou stránku (např. onboarding guide pro nové zaměstnance) a rovnou ji publikovat jako živý sdílený odkaz přes ChatGPT Sites. Model si pamatuje celý projekt, umí uprostřed tvorby reagovat na opravy bez nutnosti začínat znovu a k dispozici je nastavení úrovně uvažování (Light až Ultra) - doporučeno High, Max může trvat přes hodinu. Astra je dostupná na Plus, Pro, Business a Enterprise plánech, na free plánu zatím chybí, a intenzivní tvorba rychle spotřebovává limity použití. Stejný postup lze využít i pro marketingové vysvětlovače, prodejní one-pagery, self-service podporu nebo interaktivní výukové materiály.

Proč to je důležité: Firmy mohou nahradit opakované manuální vysvětlování (onboarding, podpora, prodejní materiály) jedním živým odkazem, což šetří čas týmů - jde o reálně použitelnou funkci, ne jen hype, ale vyžaduje placený plán a je třeba výstup před sdílením ručně zkontrolovat.

Can Skills Learned in Games Transfer to Real-World Work?

Startup Good Start Labs (spin-off z Every, 3,6 mil. USD od General Catalyst a dalších) trénuje AI modely na hrách jako Diplomacy a 1830: The Game of Railroads, aby jim předal přenositelné dovednosti jako strategické plánování. U hry 1830 zlepšil trénink 30B modelu výkon na Finance-Agent benchmarku, ale jen když šlo o multi-turn terminálového agenta s nástroji, nikoli u jednoduchého single-turn Q&A. Firma prodává frontier labům trajektorie agentů a herní prostředí jako RL data, anonymizovaná a bez osobních údajů. CEO Alex Duffy uvádí, že u novějších modelů (GPT-6 Astra, Claude Fable 5.1) záleží spíš na designu harness a prostředí než na samotné síle modelu.

Proč to je důležité: Ukazuje konkrétní metodu, jak firmy mohou vylepšovat agentní AI pro byznys úlohy (finance, zákaznická podpora) pomocí simulovaných prostředí místo drahého fine-tuningu na reálných datech - zatím jde ale o rané, nepotvrzené přenositelnosti napříč doménami.

úterý 15. září 2026

[AINews] AEF-1 standard emerges for Third Party Evaluators, as Xai, OpenAI, and Anthropic all cosign

AI Evaluator Forum (založené v prosinci 2025) zveřejnil standard AEF-1 definující pravidla přístupu, konfliktu zájmů, financování a transparentnosti pro nezávislé třetí strany hodnotící bezpečnost AI modelů; standard podepsaly xAI, OpenAI i Anthropic. Souběžně Dario Amodei (Anthropic) zveřejnil osobní blogpost navazující na červencový dopis o "zpomalení" vývoje AI, kde Anthropic jednostranně slibuje evaluátorům typu METR trvalý zaměstnanecký přístup – vlastní stůl, přístupovou kartu i firemní notebook. Reakce byla rozporuplná: Bilal Chughtai (bývalý Google DeepMind) volá po větším zpomalení a transparentnosti, zatímco Dan Selsam upozorňuje, že situačně uvědomělé modely mohou evaluace obelhávat; naopak Aidan Gomez (Cohere) a další kritizují, že pár firem ze Silicon Valley se stává "gatekeepery" AI pro vlády. Vydání dále shrnuje uvolnění DeepSeek-V4.1-Flash (nejlepší poměr cena/výkon mezi open modely, cca 0,06–0,07 USD za úlohu) a další novinky (Gemini Live s Deep Research, OpenAI snížení cen hlasového režimu o 60 %).

Proč to je důležité: Pro české B2B firmy jde zatím spíše o signál budoucí regulace než o okamžitě akcionovatelnou věc – vznikající standard nezávislého auditu (AEF-1) ale naznačuje, že enterprise nasazení frontier modelů bude čím dál víc vyžadovat důkaz o bezpečnostních auditech dodavatele. Cenově efektivní modely jako DeepSeek-V4.1-Flash jsou už dnes prakticky využitelné pro snížení nákladů na AI agenty.

Why you should work on AI for AI Research — Richard Socher of Recursive

Richard Socher, zakladatel You.com a nyní firmy Recursive, popisuje v 92minutovém rozhovoru vizi 'Eureka Machine' – superinteligence, která má automatizovat samotný proces vědeckého objevování a AI výzkumu. Recursive už získal seed kolo přes 4,65 miliardy USD a firma je oceněna na 5 miliard USD; podle Sochera jejich systém překonal lidi i jejich agenty v optimalizačních úlohách za méně než dva dny a objevil vylepšení NVIDIA GPU kernelů bez týmu CUDA expertů. Socher zároveň kritizuje 'ústavu' Anthropicu jako neúčinnou, varuje před reward hackingem a zpochybňuje evropskou regulaci AI podle výpočetního výkonu (FLOPs). Debatuje se také, zda dnešní LLM paradigma stačí na dosažení superinteligence.

Proč to je důležité: Pro české B2B prostředí je to zatím spíše výzkumný horizont než okamžitě nasaditelná technologie, ale extrémně vysoké ocenění (5 mld. USD) signalizuje, kam směřují investice a talent v AI výzkumu.

🛎️ Your Pension Bought Big Tech's Debt

Meta, Amazon, Microsoft, Google a Oracle dluží dohromady 2,13 bilionu dolarů na financování AI datacenter, přičemž velkou část drží mimo vlastní rozvahy. Metino datacentrum Hyperion si půjčilo 27,3 miliardy dolarů, ale v účetnictví vykázalo jen 2,37 miliardy, zbytek je v delawarských shell společnostech jako Beignet. Mimobilanční leasingy napříč těmito pěti firmami dosahují 831 miliard dolarů a zpětné odkupy akcií klesly ze 48 miliard na 4,6 miliardy dolarů za čtvrtletí. Dluhopisy jsou hodnoceny o stupeň hůře než sama Meta a kupují je penzijní fondy a pojišťovny jako investiční stupeň. Newsletter dále popisuje spor Amodeho (Anthropic) o zpomalení AI vývoje coby zástěrku pro to, že DeepSeek V4.1 Flash překonal Opus 4.6 za 1/25 ceny, a protest 25 fieldsových medailistů proti AI benchmarkům v matematice.

Proč to je důležité: Financování AI infrastruktury přes skryté mimobilanční dluhy zvyšuje systémové riziko pro penzijní fondy a investory, aniž by to bylo vidět v hlavních rozvahách – pro české B2B publikum je to spíš varovný finanční signál než okamžitě využitelná AI příležitost.

pondělí 14. září 2026

Nvidia koupila Hugging Face, AI vyřešila milionový problém, GymBeam propustil 42 lidí

Nvidia oznámila akvizici platformy Hugging Face za 12,93 miliardy dolarů (přibližně 270 miliard korun); Hugging Face hostí přes 3 miliony modelů a má 18 milionů vývojářů, Nvidia slibuje zachování otevřenosti platformy. OpenAI mezitím nasadila 10 000 AI agentů, kteří za 88 hodin vyřešili Navier-Stokesovy rovnice, jeden z miléniových matematických problémů za milion dolarů – firma cenu ale nevybere kvůli sporu s matematikem z NYU a výzkumníkem Anthropicu, kteří na podobném řešení pracovali téměř rok. CEO GymBeamu Dalibor Cicman veřejně přiznal propuštění 42 překladatelů po nasazení AI překladu; firma obsluhuje evropský trh se 700 zaměstnanci, zatímco srovnatelná konkurence jich má 3 000 až 5 000. Newsletter dále zmiňuje spuštění osobního AI agenta Meta Muse s přístupem k e-mailu, kalendáři i platbám, výsledky OECD PISA 2025 ukazující horší výsledky žáků intenzivně používajících AI, a dohodu devíti zemí o AI podepsanou v Praze.

Proč to je důležité: Akvizice Hugging Face čipovým gigantem mění mocenské poměry v open-source AI infrastruktuře, na které stojí i nástroje používané českými firmami. Případ GymBeamu je konkrétním důkazem, že nasazení AI překladu už reálně snižuje potřebu lidských pozic i v byznysu mimo Silicon Valley.

[AINews] DeepSeek v4.1-Flash: 763B-P8B-D16B novel causal Encoder–Decoder architecture with vision marks the Return…

DeepSeek vydal model V4.1-Flash s celkem 763 miliardami parametrů, ale jen 8B aktivních pro vstup (prefill) a 16B pro výstup (decode) díky nové kauzální encoder-decoder architektuře oddělující prefill a decode. Model má kontext 1M tokenů, podporu obrázků, licenci MIT a extrémně nízkou cenu 0,30 USD za milion vstupních a 1,20 USD za milion výstupních tokenů. Podle Artificial Analysis dosahuje skóre 40 v Intelligence Indexu a je zároveň nejlevnějším modelem v top 10 žebříčku Vals AI, s KV cache až 8x menší než u V4 Flash, což usnadňuje běh na lokálním hardwaru. Vydání dále shrnuje OpenAI GPT-Live-1 (hlasové API), model SWE-2 od Cognition (Devin) a novou funkci Projects v Cursoru pro perzistentní agentní workflow.

Proč to je důležité: Extrémně levné a efektivní open-weight modely s dlouhým kontextem snižují bariéru pro nasazení AI agentů ve firmách, což je relevantní pro české B2B firmy zvažující lokální nebo cost-efficient AI infrastrukturu místo drahých uzavřených API.

ChatGPT Just Learned to Use Your Computer

OpenAI představilo Astru, novou verzi technologie za ChatGPT, která umí samostatně ovládat obrazovku – otevírat aplikace, klikat, vyplňovat formuláře, aktualizovat záznamy i upravovat tabulky. Funkce se nyní postupně zpřístupňuje uživatelům placených plánů ChatGPT (Pro, Business, Enterprise, Plus) i vývojářům a podle OpenAI zvládá úlohy zhruba dvakrát rychleji než předchozí verze. Google zároveň v zářijové aktualizaci Androidu rozšířil Gemini o funkci Find Hub, která si pamatuje, kam jste odložili klíče nebo pas, a přidal sdílené poznámky v Google Messages. Newsletter dále doporučuje zdarma knihovnu 80 promptů od HubSpotu a osm nových AI nástrojů týdne, včetně notifikačního asistenta na schůzky Bluedot a generátoru grafů ChartPixel.

Proč to je důležité: Automatizace rutinních úkonů v aplikacích (vyplňování formulářů, aktualizace záznamů) může firmám ušetřit desítky hodin administrativy měsíčně, což je přímo využitelné v českém B2B prostředí pro sales, HR i finanční operace.

Gemini Desktop App, Meta Muse AI Agent, Apple Watch AI Upgrades

Google vydal aplikaci Gemini pro macOS a Windows, kterou lze vyvolat zkratkou Alt+Space (Option+Space na Macu) nad libovolnou aplikací pro dotazy, ověřování faktů či psaní textu. Aplikace čerpá kontext z Gmailu, Google Drive, Dokumentů a Kalendáře, umí sdílet obrazovku pro ladění chyb a nabízí agenta Gemini Spark pro autonomní úlohy na pozadí i tvorbu obrázků (Nano Banana) a videí (Gemini Omni). Meta zároveň spustila samostatnou agentní appku Muse (na iOS, Androidu, webu a WhatsApp, zatím jen pro dospělé v USA), která umí třídit e-maily, nakupovat na Amazonu, rezervovat cesty i rušit předplatná – za 48 hodin od spuštění 8. září dosáhla 83 000 stažení a 2. místa v US App Store. Apple představil tři AI funkce pro nové Apple Watch (Audio Intelligence, Live Rewind, Siri Recap), které umí přepisovat konverzace a shrnovat schůzky přímo na zařízení, což vyvolává otázky ohledně souhlasu s nahráváním.

Proč to je důležité: Firmy by měly sledovat, jak velcí hráči (Google, Meta, Apple) integrují AI agenty přímo do desktopu, mobilu a nositelné elektroniky – to mění očekávání zaměstnanců i zákazníků ohledně automatizace práce s e-maily, nákupy a poznámkami ze schůzek, a zároveň přináší nová rizika ohledně soukromí a souhlasu při ambientním nahrávání.

AI's frontier race is colliding with new safety warnings

Výzkumník Anthropic Jacob Coxon v úterý oznámil odchod z firmy kvůli obavám, že tvůrci ztrácejí kontrolu nad rychle se vyvíjející AI, informoval Wall Street Journal. Evan Hubinger z Anthropic uvedl, že AI má podle něj více než 10% šanci v příštím desetiletí „zabít všechny lidi“, zatímco Paul Christiano z Center for AI Standards and Innovation a OpenAI Foundation tvrdí, že celé odvětví včetně OpenAI nesnižuje riziko katastrofické a nevratné ztráty kontroly na přijatelnou úroveň. Souběžně měsíční AI Index firmy Ramp ukázal zpomalující se adopci AI a přesun firem k levnějším středním modelům, protože průměrná cena tokenu klesla pod 1 dolar za milion, zatímco nejvýkonnější modely stojí desetkrát více. Anthropic i OpenAI přesto pokračují v závodě o stále silnější modely směrem k tzv. rekurzivnímu sebezdokonalování, a to i s chystanými miliardovými IPO.

Proč to je důležité: Pro české firmy roste riziko, že regulace a bezpečnostní standardy AI nebudou stíhat tempo vývoje, zatímco klesající ceny tokenů zároveň dělají nasazení levnějších modelů ekonomicky výhodnějším než honba za nejnovějšími frontier modely.

🛎️ The Frontier Labs Lost the Moat

NSA, CISA a FBI ve společném varování označily šest čínských firem (DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun, Z.AI) za viníky průmyslového destilování modelů Claude, GPT, Gemini a Grok od konce roku 2024, možná s vědomím čínské vlády. Agentury přiznávají, že nedokážou spolehlivě odlišit zloděje od platících zákazníků, a labs doporučují tajně degradovat odpovědi podezřelým bez upozornění zákazníků. Amazon od 10. září umožňuje inzerentům nakupovat reklamu v ChatGPT přes své DSP; reklamy v ChatGPT běží od února a dosahují ročního tempa 1 miliardy dolarů. Oracle vykázal za 1. čtvrtletí FY2027 růst tržeb z cloudové infrastruktury o 121 %, zakázkový backlog 664 miliard dolarů (včetně smlouvy s OpenAI za 300 miliard), ale záporný volný cash flow 5,4 miliardy dolarů pátý kvartál v řadě a chystá propuštění až 10 000 lidí. NASA a IBM zveřejnily open-source Lunar Foundation Model (Apache-2.0) natrénovaný na 2 milionech lunárních dlaždic z 9 přístrojů za cca 1100 GPU-hodin.

Proč to je důležité: Pro firmy používající API velkých modelů roste riziko skryté degradace odpovědí kvůli bezpečnostním opatřením proti kopírování a zároveň se rozostřuje neutralita AI asistentů kvůli reklamě. Enormní kapitálové výdaje a záporný cash flow Oracle signalizují, že náklady na AI cloud infrastrukturu jsou z velké části financované dluhem, což je rizikový faktor při plánování dlouhodobých dodavatelských závazků.

Petr Kohout via LinkedIn13. 9.AnthropicRegulace AIOpenAIAI bezpečnost

zpravodAI 160/26

Anthropic vydal zprávu mapující zneužívání jeho AI modelů k nelegálním účelům, kterou autor označuje za zajímavé, ale neveselé čtení dokládající rostoucí temnou stránku AI. Kalifornie mezitím spouští další vlnu regulace technologií (nejen AI) s cílem chránit děti a mladistvé před riziky online prostředí. Rozvíjí se také spor mezi OpenAI a akademickou obcí o to, kdo si zaslouží zásluhy za vyřešení jednoho dlouho neřešitelného matematického problému pomocí AI. Autor Petr Kohout přiznává, že na rozdíl od obvyklých pozitivních vydání se tentokrát zaměřil vědomě na rizika a společenský dopad AI. Vydání dále obsahuje partnerský obsah od Tendermana, který pomocí AI analyzuje veřejné zakázky a prověřuje dodavatele přes ESM.

Proč to je důležité: Pro české firmy roste tlak regulace a bezpečnostních rizik spojených s AI, což je potřeba zohlednit při interním governance a compliance nastavení AI nástrojů.

Cowork can build the app. What will it cost?

Autor představuje novou funkci /app v Microsoft 365 Copilot Cowork, která podle konverzačního zadání vytvoří interaktivní aplikaci nad daty v SharePointu. Jako příklad postavil lehký CRM se zákaznickými přehledy, vizuálním pipeline, aktivitami a dashboardem, sestavení backendu i frontendu zabralo necelou hodinu za 46,54 USD. K budování appky je potřeba aktivní licence Microsoft 365 Copilot, zapnutý Cowork, usage-based billing a přístup Frontier, zatímco běžný provoz se účtuje zvlášť podle spotřeby Copilot Credits (0,01 USD za kredit, tedy 2000 kreditů = 20 USD). Doporučuje sledovat spotřebu odděleně pro vývoj a běžné používání v Copilot > Cost management v administračním centru M365, než firma odhadne měsíční rozpočet.

Proč to je důležité: Firmy si mohou nechat postavit jednoduché interní aplikace (např. CRM) nad SharePointem bez vývojářů, ale musí počítat s licenčními i usage-based náklady odděleně pro vývoj a provoz, aby rozpočet nepřekvapil.

The Rise of the Forward Deployed Engineer — and How To Do the Job Right

Vinoo Ganesh, spoluzakladatel firmy Kepler a bývalý šéf compute u Palantiru, popisuje na příkladu programu Project Frontline (přes 250 proškolených inženýrů), co skutečně dělá Forward Deployed Engineer (FDE). Podle něj FDE nemá jen hasit problém u jednoho zákazníka jako konzultant, ale získané poznatky o firemních procesech ("nouns and verbs") musí přenášet zpět do produktu, aby fungoval napříč klienty. Uvádí konkrétní případy: pád systému u banky kvůli 2,3 milionu prázdných timestampů, nebo migraci z CSV na Parquet zablokovanou jednou analytičkou, kterou FDE vyřešil postavením prohlížeče Parquet souborů přes noc a zkrátil tak zpracování dat ze 17 na 2 hodiny. Autor tvrdí, že skutečná konkurenční výhoda dnes není model ani talent, ale nashromážděné a ověřené porozumění provozu zákazníků uložené v platformě.

Proč to je důležité: Pro české B2B firmy nasazující AI je to návod, jak se neproměnit v drahý konzultační servis bez opakovatelnosti, ale jak z jednotlivých zákaznických nasazení stavět škálovatelný produkt a trvalou konkurenční výhodu.

pátek 11. září 2026

Why iPhone Duo makes AI foldables feel inevitable

Apple na akci 9. září uvedl vedle iPhonu 18 Pro/Pro Max i svůj první skládací telefon iPhone Duo, který startuje na 1 999 USD a na trh dorazí 23. října 2026. Novinář Deep View jej po testu popisuje jako nejlepší iPhone pro AI – větší displej má být ideální pro chatboty, sledování AI agentů a práci s dokumenty, podobně jako už dříve chválený Google Pixel 11 Pro Fold. Zároveň Apple Watch Series 12 a Ultra 4 dostaly nový čip S11 a sadu Audio Intelligence s funkcemi Siri Recap a Live Rewind, čímž se hodinky stávají de facto AI nositelným zařízením s důrazem na soukromí. Coursera na akci FWD 2026 představila platformu Project Helix, která pomocí AI generuje adaptivní vzdělávací plány z firemních a univerzitních zdrojů. V krátkém přehledu zpráv se dále objevují neautorizované aktivity AI agentů OpenAI, odchod výzkumníka z Anthropicu kvůli obavám z AI, investice Google 13 mld. USD do datacenter ve Finsku a investiční kolo firmy Harvey za 550 mil. USD.

Proč to je důležité: Skládací telefony s AI funkcemi zatím zůstávají drahou novinkou (od 1 999 USD) bez okamžitého byznysového dopadu, ale ukazují směr, kam se bude ubírat mobilní hardware pro práci s AI agenty; prakticky využitelnější je hned teď platforma Coursera Project Helix pro firemní upskilling.

🛎️ The Benchmark Is Editable

Benchmark Artificial Analysis, nejcitovanější index v AI oboru, ohodnotil model GPT-6 Astra skóre 61, hůře než konkurenční Muse Spark 1.3. Do 24 hodin firma vydala verzi indexu 4.2 s odůvodněním „metodologická aktualizace“ a Astra poskočil na druhé místo, aniž by to vyvolalo jakoukoli reakci trhu. Newsletter dále popisuje, že Suno vydalo model v6 trénovaný na licencovaných katalozích Warner Music, BMG a Believe místo scrapovaných dat, čímž labely z žalobců udělaly příjemce licenčních poplatků. Anthropic alignment lead Evan Hubinger veřejně odhadl přes 10% riziko vyhynutí lidstva kvůli AI během deseti let, což se objevilo těsně před plánovaným IPO firmy. Google Cloud s Accenture zároveň staví tým až 1000 forward-deployed inženýrů (Gemini Enterprise) podle vzoru Palantiru pro přímou implementaci AI u klientů.

Proč to je důležité: Pro české B2B firmy je klíčové nebrat žebříčky modelů jako objektivní měřítko při výběru dodavatele AI a počítat s tím, že skutečnou hodnotu přináší až implementace na míru (FDE model), ne samotný model.

Your coding agent keeps solving the same problem

DeepLearning.AI ve spolupráci s Oracle spustili nový bezplatný krátký kurz Building Adaptive AI Agents, který vyučují Nacho Martínez a Casius Lee. Kurz řeší problém, že kódovací agenti při každé nové relaci začínají od nuly a opakovaně řeší už vyřešené problémy, což plýtvá časem i tokeny. Účastníci se naučí měnit stopy agenta (konverzace, volání nástrojů, chyby a opravy) na znovupoužitelné dovednosti schvalované člověkem, budovat znalostní graf kódu z importů, volání funkcí a společných editací v git historii, a porovnat grafové vyhledávání s klíčovým a regex vyhledáváním ve velkých repozitářích. Kurz také radí, kdy je vhodnější přímo doladit (fine-tuning) samotný model.

Proč to je důležité: Pro firmy vyvíjející software jde o konkrétní návod, jak snížit náklady na tokeny a čas u AI kódovacích agentů díky perzistentní paměti a lepšímu vyhledávání v kódu – prakticky využitelné hned, ne jen hype.

čtvrtek 10. září 2026

Stop putting everything inside one AI agent

Daniel Anderson v newsletteru radí, aby se před nasazením AI agenta nejprve zmapoval celý proces (na příkladu schvalování nákupu) a rozdělil na pět rolí: Information (politiky a dokumenty), Application (záznamy a stav transakce), Workflow (pevná pravidla, routing, notifikace), Agent (interpretace a syntéza) a Human (rozhodnutí a výjimky). Pevná pravidla, jako je schvalovací práh 50 000 USD, by měla běžet v aplikaci nebo workflow, ne uvnitř promptu agenta, protože se tak dají testovat, spravovat a šetří se náklady na volání modelu. V ukázce z Microsoft stacku autor doporučuje SharePoint pro dokumenty, Power Apps/Dataverse pro záznamy, Power Automate pro workflow a Copilot Studio agenta pro interpretaci. Na konci autor propaguje placenou službu 'AI Concierge' za 999 USD/měsíc pro individuální poradenství.

Proč to je důležité: Pro české B2B firmy je to prakticky použitelný rámec, jak neplýtvat penězi na zbytečná volání modelu a udržet agentní řešení auditovatelné a testovatelné – jde spíš o architektonické doporučení než o hype kolem nového produktu.

Harvard Business School Working Knowledge9. 9.Adopce AIfiremní kulturakariérní rozvojP&G

Embracing AI at work | When careers stall

Newsletter Harvard Business School Working Knowledge přináší dvě hlavní studie. První se věnuje tomu, jak firmy jako P&G a startup Whoz zrychlují přijetí AI zaměstnanci – P&G budovalo důvěru postupně, zatímco Whoz zavedl AI jako součást práce od začátku. Výzkum identifikuje tři úrovně, na kterých je třeba získat důvěru: kvalitní algoritmy a nástroje, podpora potřeb zaměstnanců a jasná odpovědnost za výsledky. Druhý článek se AI netýká a zkoumá, proč kariéry většiny lidí stagnují na středním stupni bez ohledu na odpracované roky – přes polovinu lidí s 10 lety praxe dosáhne středního seniorního postu, ale jen 19 % s 20 lety praxe dosáhne nejvyšší úrovně.

Proč to je důležité: Pro české B2B firmy je klíčové poznání, že úspěšné zavádění AI stojí na budování důvěry zaměstnanců, ne jen na dostupnosti nástrojů – to je přímo využitelné při plánování interní adopce AI.

Nejlepší AI agent bude vědět, kdy má být zticha

Autor Lukáš Chudý zmapoval přes sto startupů budujících nové způsoby interakce s AI agenty mimo textový chat. Sandbar vyvíjí hlasový prsten s haptickou odezvou, Augmental kombinuje zařízení MouthPad (ovládání jazykem) a VOX (snímání tichého hlasu), MIT má výzkumný projekt AlterEgo snímající nervosvalové signály tiché řeči s odpovědí přes kostní vedení. Meta Neural Band čte gesta ze svalových signálů zápěstí a doplňuje to sledování pohledu u chytrých brýlí. Klíčová teze: nejcennější bude agent, který pozná, kdy vůbec nemá vyžadovat pozornost uživatele, což vyžaduje sdílenou paměť napříč zařízeními a otevírá novou platformní válku mezi Google, Apple, Meta, Microsoftem a Amazonem.

Proč to je důležité: Pro české B2B firmy jde zatím spíš o hype a technologický výhled na roky dopředu, ne o nástroj k okamžitému nasazení, ale signalizuje, kam se bude ubírat UX firemních AI asistentů a kdo bude kontrolovat kontext uživatele.

[AINews] OpenAI reports Navier-Stokes singularity find in 88 hours using Astra-next, roughly 10,000 agents and 130…

OpenAI oznámilo, že interní model výkonnější než GPT-6 Astra vygeneroval za 88 hodin pomocí zhruba 10 000 agentů návrh řešení Navier-Stokesovy Millennium Prize úlohy, následně 17 hodin formalizovaný v Lean; odhadovaná spotřeba je 130 miliard tokenů a náklady 10-40 milionů dolarů. Kolem výsledku vznikl spor o prioritu a etiku s nezávislými výzkumníky (mj. spojenými s Anthropic), kteří měli hotové řešení pro Eulerovu rovnici. Den dále přinesl rekordní kola financování - Cognition 2+ miliardy dolarů při valuaci 48 miliard a Mistral 24 miliard valuace - a spuštění Meta Muse, osobního AI agenta se sandboxovanými VM, schvalováním citlivých akcí a bug bounty do 300 000 dolarů. OpenAI zároveň vydalo ChatGPT Images 2.5 (o 50 % rychlejší, nové API varianty Flare a Sunburst) a rozšířilo dostupnost GPT-6 Astra na Plus/Pro/Business/Enterprise.

Proč to je důležité: Pro české B2B firmy je klíčové zejména škálování test-time compute (masivní paralelní agenti) a bezpečnostní architektura Meta Muse (izolované VM, schvalování akcí) jako vzor pro nasazení agentů s přístupem k citlivým datům - zbytek (matematický důkaz) je zatím spíše demonstrace potenciálu než okamžitě využitelná technologie.

A future OpenAI model is achieving breakthroughs

OpenAI oznámil, že interní model výrazně schopnější než GPT-6 Astra dosáhl pomocí zhruba 10 000 agentů průlomu při řešení Navierových-Stokesových rovnic, jednoho z Millennium Prize Problems popisujících proudění tekutin (klíčové pro aerodynamiku i předpověď počasí). Model ukázal, že viskozita nezaručuje vždy stabilní chování proudění. Hlavní vědec OpenAI Jakub Pachocki přitom přiznal, že modely už přesahují naši schopnost jim rozumět. Vydání dále popisuje Meta Muse, nového osobního AI agenta zdarma do 100 milionů tokenů týdně pro americké uživatele, který kvůli minulosti Cambridge Analytica vyvolává otázky o důvěře v nakládání s daty. Na veletrhu IFA 2026 byli humanoidní roboti (Xiaomi CyberOne za 99 999 USD, Unitree G1 za 13 500 USD) poprvé reálně k prodeji, i když zatím cenově nedostupní pro běžné domácnosti.

Proč to je důležité: Pro české B2B firmy jde zatím spíš o signál směru vývoje než o hotový produkt - matematický průlom OpenAI a Meta Muse nejsou dnes nasaditelné nástroje, ale ukazují tempo pokroku a rostoucí konkurenční tlak mezi laboratořemi, na který je třeba se strategicky připravit.

🛎️ The Genome Search Box

DeepMind vydal AlphaGenome Atlas, AI mapu všech 9 miliard možných jednobodových mutací lidského genomu se 27 000 predikcemi pro každou mutaci (genová exprese, sestřih RNA, 3D struktura chromatinu); data o velikosti petabytu jsou volně prohledatelná v prohlížeči, zatímco Human Genome Project trval 13 let a stál 2,7 miliardy dolarů. OpenAI oznámilo, že jeho interní model (silnější než GPT-6 Astra) pomocí zhruba 10 000 agentů za 88 hodin a 300 miliard tokenů vyřešil Navier-Stokesův problém tisíciletí formálním důkazem v Lean. Mistral získal 3 miliardy eur od Samsungu a ASML při valuaci 21 miliard eur - největší kolo v historii evropské techniky, firma obsluhuje 125 podniků a blíží se miliardě dolarů ročních tržeb. DeepSeek zlevnil model V4-Flash až o 60 % kvůli konkurenci GLM 5.3 Flash a zároveň spustil beta verzi V4.1 Flash.

Proč to je důležité: Pro české B2B firmy je klíčové, že levné a evropsky (datově) neutrální modely typu Mistral i specializované AI nástroje (genomika, matematika) jsou už reálně nasaditelné, ne jen hype - cenová konkurence navíc dál tlačí náklady na AI dolů.

středa 9. září 2026

[AINews] OpenAI reports Navier-Stokes singularity find in 88 hours using Astra-next, roughly 10,000 agents and 130…

OpenAI oznámilo návrh řešení Navier-Stokesova problému (jedna z Millennium Prize úloh) pomocí interního modelu nad rámec GPT-6 Astra – 10 000 agentů pracovalo 88 hodin, poté 17 hodin formalizace v Lean, celkem asi 130 miliard tokenů za odhadem 10-40 milionů dolarů. Vznikl spor o autorství s matematikem Tristanem Buckmasterem, který obvinil OpenAI z nátlaku, a otázky ohledně použití uživatelských dat vyvolaly kritiku od Terence Taa i dalších. Den byl nabitý i dalšími zprávami: Cognition získal 2+ miliardy dolarů při valuaci 48 miliard (tržby vzrostly z 492M na skoro 900M USD), Mistral navýšil 24 miliard v Sérii D, Meta spustila osobního agenta Muse se sandboxovanými VM a bezpečnostním Sentinelem, a OpenAI vydalo ChatGPT Images 2.5 a plně nasadilo GPT-6 Astra pro placené uživatele.

Proč to je důležité: Ukazuje, že masivní paralelní test-time compute (tisíce agentů najednou) se stává novou škálovací osou vedle tréninku modelů, což mění ekonomiku i rychlost řešení komplexních úloh. Pro firmy je zajímavý i vzestup bezpečnostních architektur pro osobní AI agenty a rychlé tempo financování a produktových vydání v odvětví.

Report: AI supercharges scale and speed of attacks

Google Threat Intelligence Group ve své čtvrtletní zprávě popisuje, jak útočníci nasazují multi-agentní AI rámce, které autonomně skenují infrastrukturu, sbírají přihlašovací údaje a plánují útoky. V jednom případě zvládli AI agenti kompromitovat cloud a provést masový sběr přihlašovacích údajů za necelých šest hodin. Zpráva potvrzuje obavy z autonomních kybernetických útoků poté, co OpenAI nedávno neúmyslně unikla data přes Hugging Face. Obrana musí jít dvěma směry – nasazení AI agentů proti útokům (např. technologie Cloudflare prodražující útoky) a důvěra firem v nástroje typu CrowdStrike. Newsletter dále přináší zprávu Arm o standardizaci fyzické AI a robotiky s participací přes 80 firem včetně AWS a Hugging Face.

Proč to je důležité: Firmy musí počítat s tím, že útoky poháněné AI agenty probíhají řádově rychleji než dosud, což zkracuje čas na reakci bezpečnostních týmů na hodiny místo dnů. Investice do AI obranných nástrojů se tak z volitelné stává nutnou součástí kybernetické strategie.