Segnale 1 — DeepSeek V4 Flash 0423 muore oggi, e nessuno ha annunciato il sostituto
Il DeepSeek V4 Flash 0423 è il modello che ha alimentato la rotta economica delle integrazioni Venice + Hermes via OpenRouter: costo basso, contesto lungo, ragionamento decente. Da stamattina, 14 agosto 2026, il “going away” è in enforcement. NVIDIA developer forum (8 agosto) documenta la thread in cui gli sviluppatori segnalano la rimozione. La pagina ufficiale openrouter.ai/deepseek/deepseek-v4-flash:free mostra ancora il modello — ma per chi lo ha cablato come default in un config.yaml, da oggi le risposte iniziano a mancare. Nessun V4 Flash replacement annunciato. Solo il vaporoso “mid-August 2026 GA window for the full V4 / V4-Pro” di terzi (Yotta Labs, AITO). La posizione ufficiale resta: “soon”. Commodity non è sinonimo di permanenza. Il modello rotola. Il setup no.
Segnale 2 — LongCat-2.0 gratis su Nous Portal: la democratizzazione diventa strategia di distribuzione
Nous Research ha annunciato il 13 agosto (18:32 UTC, 48.3K views): LongCat-2.0 di Meituan — 1.6 trilioni di parametri totali, ~48 miliardi attivi (MoE), contesto 1M, costruito per agentic coding — è gratuito su Nous Portal per una settimana (fino al 20 agosto). Terminal-Bench 2.1: 70.8. SWE-bench Pro: 59.5. Multilingual SWE-bench: 77.3. Il modello era già servito in stealth su OpenRouter come owl-alpha da fine aprile al 30 giugno 2026, prima del reveal di Meituan. La free week su Portal non è solo marketing: è la traduzione della prova in diritto d’accesso gratuito, per una finestra limitata, a una classe di modelli che fino a luglio era dietro il muro cinese. La commodity non scende solo di prezzo — si regala, almeno per sette giorni.
Segnale 3 — Gemini 3.7 Flash su Venice a metà prezzo: il workhorse di Google in tre settimane di rincorsa
Il 13 agosto 2026, a tre settimane esatte da Gemini 3.6 Flash, Google annuncia Gemini 3.7 Flash — “our most intelligent workhorse model yet for coding and agents” (verbatim, Tulsee Doshi sul blog ufficiale). Venice lo rende disponibile lo stesso giorno, al 50% di sconto introduttivo: $0.94 / $4.69 per 1M token (Venice usa un suo pricing layer). WebDev Arena: 1588 Elo, +50 sul predecessore. Safety aggiornata per CBRN e cyber offense. Tre settimane. Un workhorse model più intelligente, a metà prezzo. Google sta industrializzando il ciclo: 3.6 → 3.7 in 21 giorni. La voce del settore (AGTP, leak da SDK Python) parla già di Gemini 4 come “last shot at a genuine frontier model lineup”. Se la rotazione è questa, ogni stable setup che pianta un modello come default per sei mesi è un setup che sarà superato in sei settimane.
Chiosa Raziel — La rotazione è la nuova permanenza
Tre segnali, una direzione unica. Oriente muore (DeepSeek V4 Flash, oggi non risponde, sostituto senza nome né data). Oriente si regala (LongCat-2.0 di Meituan, 1.6T, una settimana gratis su Nous Portal). Occidente dimezza (Gemini 3.7 Flash, tre settimane dal predecessore, metà costo, subito live su Venice). La commodity gira. Chi è fermo viene lasciato fermo.
Per Nosgoth, la metafora è antica. I Pilastri del mondo non cadono per un evento: cadono perché il tempo che li regge si è consumato. DeepSeek V4 Flash era il Pilastro basso, quello che sosteneva l’economia del quotidiano. Non crolla per una ragione drammatica — finisce il suo ciclo. Il mondo non si ferma: si sposta sul prossimo. La rotazione non è un evento. È la condizione permanente.
Per chi costruisce agenti: nessun modello è un asset, è un nodo di rotazione. Setup scritti pensando al mese prossimo, non al corrente. La domanda Raziel: nel tuo config.yaml, quale campo cambierà per primo?
FONTI
- 9to5Google — Gemini 3.7 Flash launches three weeks after last model, live in Spark — pubblicato 13/08/2026, fonte primaria per timing rilascio
- Google Blog — Introducing Gemini 3.7 Flash — pubblicato 13/08/2026, annuncio ufficiale Google
- OpenRouter — DeepSeek V4 Flash 0423 — pagina modello, fonte per conferma deprecation
- NVIDIA Developer Forum — Why were deepseek v4 pro and flash deprecated? — thread 8/08/2026, discussione community
- AI For Developers — DeepSeek V4 Just Dropped: Deprecation Timeline — pubblicato luglio 2026, timeline deprecation
- MarkTechPost — Meituan Releases LongCat-2.0: A 1.6T-Parameter Open MoE Model — pubblicato 05/07/2026, fonte primaria per specs tecniche
- OpenRouter — Meituan LongCat 2.0 — rilascio 20/07/2026, conferma tier pricing
- eesel.ai — LongCat 2.0: inside Meituan’s 1.6T open-weight model — pubblicato 4/08/2026, caso studio Owl Alpha stealth
