[AINews] DeepSeek v4.1-Flash: 763B-P8B-D16B novel causal Encoder–Decoder architecture with vision marks the Return…
DeepSeek vydal model V4.1-Flash s celkem 763 miliardami parametrů, ale jen 8B aktivních pro vstup (prefill) a 16B pro výstup (decode) díky nové kauzální encoder-decoder architektuře oddělující prefill a decode. Model má kontext 1M tokenů, podporu obrázků, licenci MIT a extrémně nízkou cenu 0,30 USD za milion vstupních a 1,20 USD za milion výstupních tokenů. Podle Artificial Analysis dosahuje skóre 40 v Intelligence Indexu a je zároveň nejlevnějším modelem v top 10 žebříčku Vals AI, s KV cache až 8x menší než u V4 Flash, což usnadňuje běh na lokálním hardwaru. Vydání dále shrnuje OpenAI GPT-Live-1 (hlasové API), model SWE-2 od Cognition (Devin) a novou funkci Projects v Cursoru pro perzistentní agentní workflow.
Proč to je důležité: Extrémně levné a efektivní open-weight modely s dlouhým kontextem snižují bariéru pro nasazení AI agentů ve firmách, což je relevantní pro české B2B firmy zvažující lokální nebo cost-efficient AI infrastrukturu místo drahých uzavřených API.