DeepSeek, fondata nel 2023 da Liang Wenfeng, sta sconvolgendo il settore dell’AI grazie ai suoi modelli di linguaggio avanzati, capaci di competere con colossi come OpenAI, ma con un budget ridotto che sfida le logiche tradizionali di sviluppo.
Un modello di successo che riscrive le regole
La vera rivoluzione di DeepSeek è il suo approccio alla costruzione di modelli AI. La startup ha appena lanciato DeepSeek-R1, un modello di linguaggio LLM che si posiziona al livello di GPT-4 di OpenAI e Claude di Anthropic, ma con costi che sono solo una frazione di quelli tradizionali. Il suo modello di punta, DeepSeek-V3, ha richiesto meno di 6 milioni di dollari per essere addestrato, utilizzando i chip Nvidia H800, un risultato sorprendente se confrontato con le centinaia di milioni di dollari necessari per addestrare i modelli dei concorrenti.
L’approccio open-source
Ciò che distingue davvero DeepSeek è la sua filosofia open-source. Rendendo i propri modelli accessibili a sviluppatori e ricercatori di tutto il mondo, la startup ha innescato una corsa all’innovazione collaborativa che potrebbe cambiare per sempre il volto dell’AI. Questo approccio non solo accelera lo sviluppo tecnologico, ma mette in discussione la politica di protezione dei modelli seguiti da altre aziende del settore, che tendono a limitare l’accesso alla loro tecnologia.
La rivoluzione dei costi e dell’efficienza
Tradizionalmente, i modelli AI di alta qualità sono estremamente costosi e richiedono enormi quantità di energia. Per esempio, costruire un modello top-tier può costare più di 100 milioni di dollari e richiede data center pieni di GPU Nvidia da 40.000 dollari. DeepSeek ha deciso di affrontare questa sfida puntando su un approccio innovativo: una combinazione tra reti neurali e sistemi esperti.
Questo approccio modulare prevede la creazione di “esperti” specializzati per compiti specifici, riducendo drasticamente la necessità di modelli monolitici e costosi. Ad esempio, se un’analisi riguarda documenti legali, il sistema esperto legale entra in azione, rendendo il processo molto più veloce ed economico rispetto a un modello generico.
Inoltre, la tecnica di “attenzione sparsa” di DeepSeek migliora ulteriormente l’efficienza, concentrandosi solo sugli aspetti cruciali di un testo, riducendo i tempi di elaborazione senza sacrificare l’accuratezza. Questo permette a DeepSeek di essere due volte più veloce rispetto ai modelli tradizionali, con un margine di precisione del 90%.
Impatto che fa tremare il mercato delle Tech
L’ascesa di DeepSeek non è passata inosservata. La sua app di intelligenza artificiale è diventata l’app gratuita più scaricata sull’App Store negli Stati Uniti, superando persino ChatGPT.
L’impatto di DeepSeek si è fatto sentire immediatamente anche nei mercati finanziari. L’annuncio di DeepSeek-R1 ha provocato una reazione a catena nel settore tecnologico, con Nvidia che ha visto un crollo del 17% delle sue azioni, perdendo 593 miliardi di dollari in valore di mercato in un solo giorno. Questo calo drammatico evidenzia la sensibilità dei mercati alle nuove minacce alla dominanza dei giganti dell’AI, con DeepSeek che si preannuncia come una sfida concreta per i leader di settore.
Sostenibilità e accessibilità
I modelli di DeepSeek utilizzano meno energia rispetto alle configurazioni tradizionali, un aspetto cruciale per settori come la sanità, la tecnologia climatica e la robotica, dove l’impatto ecologico dell’AI è un tema sempre più dibattuto.
Questo approccio non solo rende DeepSeek più competitivo sul piano dei costi, ma contribuisce anche a una visione di un’AI più sostenibile e accessibile. Con il suo impegno per ridurre i costi e democratizzare l’accesso alla tecnologia, DeepSeek sta creando nuove opportunità per le startup e le piccole imprese, aprendo la strada a un futuro dove l’AI non è più esclusiva dei giganti, ma disponibile a un pubblico più ampio. Questo scenario potrebbe accelerare la democratizzazione dell’AI, con benefici diffusi su scala globale.
Le controversie e le sfide da affrontare
Alcuni esperti hanno sollevato dubbi sulla trasparenza dei suoi costi di addestramento e sull’utilizzo di chip Nvidia H100, che potrebbero violare le restrizioni sulle esportazioni imposte dagli Stati Uniti. Ad oggi, DeepSeek non ha risposto a queste accuse, lasciando alcune domande senza risposta.
Un nuovo capitolo per l’Intelligenza Artificiale
DeepSeek rappresenta un manifesto di innovazione che sfida le convenzioni del settore e che mostra come il talento e la visione possano ribaltare paradigmi consolidati. La sua combinazione di modelli potenti, approccio modulare e costi contenuti sta riscrivendo le regole del mercato dell’AI. Il viaggio di DeepSeek è appena iniziato, ma le sue premesse promettono di lasciare un segno indelebile nel futuro dell’intelligenza artificiale, un futuro più economico, più efficiente e più accessibile.






