CourionAI
IT
Newsletter
← Tutte le notizie
deepseek 3 min di lettura

Deepseek ha ceduto il suo software agente e aumentato i prezzi delle API lo stesso giorno

Deepseek Harness v0.1 è disponibile sotto la licenza MIT, un'alternativa aperta e gratuita a Codex e Claude Code. Lo stesso giorno la società ha annunciato forti aumenti dei prezzi delle API, con un aumento di sei volte dei risultati della cache.

Una cassa aperta con cinghie di imbracatura e ingranaggi che fluttuano liberi al di fuori, mentre l'ugello della pompa del carburante accanto gocciola in una ciotola

Giovedì Deepseek ha fatto due cose che puntano in direzioni opposte. Ha rilasciato Deepseek Harness v0.1, il software agente che utilizzava internamente, come open source con la licenza MIT, che è permissiva quanto lo sono le licenze. E ha annunciato che i prezzi delle API aumenteranno il 16 agosto, con l’aumento più marcato che riguarderà esattamente il tipo di utilizzo prodotto dal software agente.

Inizia con il software. Un’imbracatura è il livello che trasforma un modello linguistico in qualcosa che può effettivamente funzionare: fornisce al modello una shell, un editor di file, una sandbox in cui eseguire le cose e una memoria di ciò che ha già provato. Senza uno, un modello può solo parlare. Harness è costruito su un sistema di plugin chiamato Cordis, in cui ogni parte è scambiabile, dagli strumenti all’interfaccia utente. Mantiene un registro continuo della sessione di ogni richiesta, ogni chiamata allo strumento e ogni risultato, in modo che un’esecuzione possa essere sospesa, ramificata o riprodotta. Esiste una modalità minima che lo riduce a solo una shell e un editor di file, che è ciò che Deepseek utilizza per le proprie esecuzioni di benchmark. Si avvia tramite npx in un’interfaccia web locale e Deepseek avverte dei problemi di compatibilità, il che è giusto per un’anteprima per sviluppatori v0.1. Quando il team ha chiesto dei beta tester all’inizio di agosto, in tre giorni si sono iscritti 712 progetti.

Allo stesso tempo, il modello di punta ha ricevuto un aggiornamento. L’endpoint deepseek-v4-pro ora serve la build V4-Pro-0813, stesso conteggio dei parametri, stessa finestra di contesto da un milione di token. Test indipendenti di Artificial Analysis lo spostano da 45 a 53 nell’indice di intelligenza, che lega GLM-5.2 ma è ancora dietro a Qwen 3.8 Max a 58, Kimi K3 a 60 e Claude Opus 5 a 63. Vale la pena sapere: i pesi per questa build non sono stati pubblicati, solo la vecchia anteprima di aprile è su Hugging Face.

Cosa sta realmente succedendo qui

Ora i prezzi. Dal 16 agosto, Deepseek divide le sue tariffe in ore di punta e non di punta, con le ore di punta che corrispondono alla giornata lavorativa cinese. Nelle ore non di punta, l’input di V4-Pro varia da $ 0,435 a $ 0,66 per milione di token e l’output da $ 0,87 a $ 1,98. Al culmine quelli raddoppiano di nuovo. Il cambiamento più grande riguarda gli hit della cache, la tariffa scontata che paghi quando il modello rilegge il testo che ha già visto: da $ 0,003625 a $ 0,022 nei periodi non di punta, circa sei volte di più. Gli agenti rileggono costantemente gli stessi file, quindi questo è esattamente il costo che dovranno sostenere gli utenti di Harness. Dare via l’imbracatura rivedendo il carburante che brucia non è una contraddizione, è un modello di business e Deepseek sta raccogliendo capitali prima della quotazione in borsa.

Cosa significa per te: se sei curioso piuttosto che costruire, la lezione utile è il concetto. Harness è un esempio chiaro e leggibile di come un modello di chat diventa un agente ed è liberamente consultabile. Se stai effettivamente utilizzando l’API Deepseek, controlla la fattura dopo il 16 agosto e presta attenzione alla percentuale di riscontri nella cache, perché è lì che si nasconde l’aumento. Una piccola consolazione per chiunque in Europa: le ore di punta vanno dalle 01:00 alle 04:00 e dalle 06:00 alle 10:00 UTC, quindi la maggior parte del pomeriggio europeo rientra nella tariffa più economica.

Fonti

Fonti: https://deepseek.com/harness/en/

Articolo successivo

Il miglior modello sul mercato è quello che le aziende non acquistano

I dati sulla spesa di Ramp mostrano che Fable 5 di Anthropic prende solo il 6% dei token che le aziende acquistano da Anthropic. Il modello più capace sta perdendo prezzo e questo dice qualcosa sull’intero settore.

Una scala di blocchi che si arrampica fino a colpire una pesante lastra piatta del soffitto, con un cartellino del prezzo decorato appeso appena sopra, fuori portata