🔑 How Claude's text watermark works
Anthropic zveřejnil detailní vysvětlení mechanismu textového vodoznaku pro Claude: do textu se nic nevkládá, nepoužívají se skryté znaky ani extra tokeny a nemění se cena ani rychlost generování. Místo náhodného výběru mezi rovnocennými slovy (např. "overcast" vs. "grey") model používá kombinaci tajného klíče a předchozích slov, díky čemuž může držitel klíče zpětně ověřit, zda text pochází od Claude. Newsletter dále zmiňuje, že do 24 hodin od zveřejnění vznikl nástroj (Skill) na odstranění vodoznaků z Claude, Gemini i OpenAI výstupů, přičemž autor nástroje sám doporučuje jeho polovinu nepoužívat. Krátce se věnuje i GitHub Spec Kitu (agent nejprve napíše spustitelnou specifikaci) a výzkumu NVIDIA o sdílení KV cache mezi modely pomocí ridge regrese.
Proč to je důležité: Pro české firmy nasazující AI je to spíš signál k sledování než akce hned – detekce AI textu zůstává nespolehlivá, protože vodoznak lze obejít nástrojem dostupným do 24 hodin od jeho popisu. Firmy řešící compliance nebo autenticitu obsahu by měly watermarking vnímat jako doplňkovou, ne definitivní ochranu.