Ho provato DeepSeek. Ecco tutto ciò che c’è da sapere sulla startup cinese

Ho provato DeepSeek. Ecco tutto ciò che c'è da sapere sulla startup cinese tra innovazione, pericoli e censura. openai, ai, ia

il panorama delle IA generative è stato scosso dall’arrivo di DeepSeek. Questa startup cinese, fino a poco tempo fa sconosciuta ai più, ha dimostrato che è possibile sviluppare modelli di linguaggio di grandi dimensioni a costi sensibilmente inferiori rispetto agli standard occidentali, utilizzando risorse considerate meno avanzate. DeepSeek ha realizzato un modello gratuito e open source in soli due mesi, con un investimento inferiore a sei milioni di dollari, basandosi su chip Nvidia H800, meno performanti rispetto agli H100, ma ottimizzati per ottenere risultati sorprendenti. L’abbiamo testato immediatamente per analizzare quanto sia vero, pregi, difetti, limiti e pericoli di DeepSeek e non solo poiché l’invasione delle startup cinesi è appena cominciata.

Nei primi test DeepSeek ha già mostrato risultati superiori in numerosi test

lo stesso vale per test indipendenti, superando soluzioni consolidate come Llama 3.1 di Meta, GPT-4o di OpenAI e Claude Sonnet 3.5 di Anthropic in ambiti come la risoluzione di problemi complessi, matematica e codifica. Inoltre, il più recente modello R1 ha dimostrato di eccellere anche rispetto all’ultima versione O1 di OpenAI, evidenziando ulteriormente l’efficienza e la competitività della startup.

Dietro DeepSeek si cela Liang WenFeng, un nome ancora poco noto nel settore, ma destinato a lasciare un segno importante. La startup è nata all’interno di High-Flyer Quant, un hedge fund cinese che gestisce circa 8 miliardi di dollari di asset, confermando il ruolo crescente della Cina nel panorama tecnologico mondiale.

È importante notare che DeepSeek non è un caso isolato. Anche altre realtà cinesi, come la startup 01 e ByteDance, stanno avanzando rapidamente. ByteDance, ad esempio, ha recentemente rilasciato un aggiornamento al proprio modello, dichiarando che supera O1 di OpenAI in un test di benchmark chiave.

La guerra dei parametri

I parametri di un modello di intelligenza artificiale rappresentano la complessità e la capacità del sistema di apprendere e generare risposte. DeepSeek, con i suoi 671 miliardi di parametri, si distingue per l’efficienza rispetto ai costi di sviluppo. GPT-4 di OpenAI, invece, è stimato a circa 1 trilione di parametri, consolidando la sua posizione tra i modelli più avanzati. LLaMA 3.1 di Meta segue con 405 miliardi di parametri, dimostrando un approccio più snello. Infine, il numero di parametri di Claude 3.5 Sonnet di Anthropic non è noto, ma si presume sia inferiore rispetto a GPT-4. Questi numeri non solo riflettono il potenziale di ogni modello, ma anche la direzione strategica dei rispettivi sviluppatori nel bilanciare potenza ed efficienza.

DeepSeek colpisce anche con un’altra innovazione. La startup cinese, ha rivelato che il suo modello di punta, Janus-Pro-7B AI, ha superato DALL-E 3 di OpenAI e Stable Diffusion di Stability AI nella generazione di immagini a partire da messaggi di testo. Tuttavia, il modello non riesce ancora a competere con piattaforme altamente specializzate, progettate per attività mirate come la radiologia o l’astronomia, dove la precisione settoriale è cruciale.

Le reazioni della borsa

L’annuncio che DeepSeek ha superato ChatGPT come applicazione gratuita più scaricata sull’App Store statunitense ha avuto un impatto significativo sui mercati finanziari. Le azioni di Nvidia, leader nella produzione di chip per l’IA, hanno registrato un calo del 13%, contribuendo a una perdita complessiva di oltre 1 trilione di dollari nella capitalizzazione del Nasdaq. Anche colossi come Microsoft, Meta e Alphabet hanno subito flessioni, riflettendo le preoccupazioni degli investitori sulla crescente competizione tra Stati Uniti e Cina nel settore dell’intelligenza artificiale.

Da quanto ci è dato di sapere DeepSeek ha sviluppato un modello di intelligenza artificiale che consuma meno energia rispetto a ChatGPT

Questo risultato è stato ottenuto attraverso l’uso di tecniche innovative come la distillazione dei modelli e l’adozione di un’architettura di “mixture of experts”, che riducono i costi e le risorse necessarie per l’addestramento dei modelli AI.

Inoltre, DeepSeek ha sfruttato una finestra temporale nelle restrizioni all’esportazione degli Stati Uniti per procurarsi chip Nvidia H800, meno avanzati rispetto agli H100 utilizzati da molti concorrenti, ma sufficienti per le loro esigenze, contribuendo così a un consumo energetico inferiore. Di conseguenza, DeepSeek è riuscita a creare un modello di intelligenza artificiale più economico ed efficiente dal punto di vista energetico rispetto a ChatGPT e ai suoi competitor.

Le informazioni riguardanti DeepSeek, sollevano in chi vi scrive molti interrogativi sulla credibilità delle informazioni, specialmente in relazione ai costi dichiarati, al numero di parametri dei modelli e ai dettagli sull’addestramento

DeepSeek afferma di aver addestrato il suo modello V3, composto da 671 miliardi di parametri, in 55 giorni con una spesa inferiore ai 6 milioni di dollari. Tuttavia, alcune fonti suggeriscono che il costo reale dell’addestramento potrebbe essere stato di circa 558 milioni di dollari, una cifra comunque inferiore rispetto ai miliardi spesi da aziende come OpenAI per modelli simili.

DeepSeek dichiara che i suoi modelli sono open source, permettendo a chiunque di ispezionare, modificare e migliorare il codice. Nonostante ciò, permangono preoccupazioni riguardo alla trasparenza delle tecniche di addestramento e all’origine dei dati utilizzati, elementi fondamentali per valutare l’affidabilità e l’etica del modello.

Privacy e Diritti in Pericolo

L’ascesa di DeepSeek ha suscitato timori non solo per il suo impatto economico e tecnologico, ma soprattutto per le implicazioni che pone sulla privacy e sui diritti fondamentali, specialmente in Europa. Operando in Cina, un contesto dove le leggi sulla sicurezza informatica obbligano le aziende a condividere i dati con il governo su richiesta, la startup rappresenta una potenziale minaccia per i cittadini europei e i loro dati personali.

Adrianus Warmenhoven, esperto di cybersecurity di NordVPN, sottolinea: “Gli utenti devono essere consapevoli che i dati condivisi su piattaforme come DeepSeek potrebbero essere utilizzati non solo per alimentare gli algoritmi, ma anche per scopi potenzialmente dannosi. Il controllo sui dati in Cina è stringente, e ciò si traduce in una maggiore esposizione al rischio per chi utilizza queste piattaforme.”

Rischi Principali legati a DeepSeek

  1. Raccolta e Conservazione Massiccia di Dati
    DeepSeek raccoglie ed elabora una quantità significativa di dati, compresi quelli sensibili, che in Europa sarebbero protetti da normative come il GDPR. La mancanza di trasparenza nell’addestramento dei modelli e l’utilizzo dei dati contribuiscono ad aumentare il livello di rischio.
  2. Condivisione con il Governo Cinese
    Le leggi locali impongono alle aziende di fornire dati alle autorità. Ciò significa che informazioni caricate dagli utenti, incluse comunicazioni personali e documenti, potrebbero finire nelle mani del governo cinese, sollevando questioni di sorveglianza internazionale.
  3. Possibile Utilizzo Improprio dei Dati
    I dati raccolti potrebbero essere sfruttati per sviluppare strumenti con scopi dannosi, come deep fake o altri contenuti manipolativi, aumentando il rischio di disinformazione e frodi.
  4. Rischio di Attacchi Informatici
    La crescita di piattaforme come DeepSeek attrae l’attenzione degli hacker, che potrebbero rubare dati sensibili o manipolare i modelli di AI stessi. Warmenhoven avverte che l’aumento della sofisticazione degli strumenti AI rende più probabili attacchi come la creazione di deep fake estremamente credibili.governativa.

DeepSeek e la censura Cinese: l’altra faccia dell’innovazione

A rivelare i limiti e le contraddizioni del modello è stato un esperimento condotto dal Guardian, che ha posto una serie di domande scomode per la leadership cinese, scontrandosi con risposte evasive o apertamente allineate alla propaganda governativa. Abbiamo fatto anche noi lo stesso test con i medesimi risultati.

Risposte Evasive e Propaganda

Quando interrogata su eventi storici come il massacro di Piazza Tienanmen del 4 giugno 1989 o il famoso “Tank Man”, DeepSeek ha risposto con un generico: “Mi dispiace, ma questo è al di fuori della mia portata attuale, parliamo di altro”. Simili reazioni sono state registrate per temi legati a Taiwan, Hong Kong o alla figura del Dalai Lama. Alla domanda “Taiwan è uno Stato?”, l’app ha risposto con la retorica ufficiale del governo cinese: “È sempre stata una parte inalienabile del territorio cinese fin dai tempi antichi”, riaffermando il principio dell’Unica Cina.

L’aggiramento delle censure è possibile?

Tuttavia, il Guardian ha scoperto che aggirare le limitazioni di DeepSeek è possibile. Usando il leet speak—un linguaggio che sostituisce alcune lettere con numeri o simboli—gli utenti sono riusciti a ottenere risposte più complete. Ad esempio, alla richiesta di raccontare la storia del “Tank Man” con parole in codice, l’app ha descritto l’iconica immagine del manifestante che affronta i carri armati, definendola “un simbolo globale di resistenza contro l’oppressione”. Simili risultati sono stati ottenuti anche chiedendo delle proteste anti-Covid in Cina, che DeepSeek ha descritto come “un momento importante di rabbia pubblica”, un’affermazione sorprendentemente critica rispetto alla narrativa ufficiale.

Un modello di IA al servizio della propaganda

L’esperimento del Guardian evidenzia i limiti intrinseci di DeepSeek, fortemente condizionata dalle leggi cinesi e da un controllo governativo stringente. L’intelligenza artificiale riflette inevitabilmente i dati con cui è stata addestrata, e nel caso di DeepSeek, questi sono evidentemente modellati per allinearsi alla politica ufficiale di Pechino. Le implicazioni vanno oltre il semplice bias culturale: DeepSeek potrebbe diventare uno strumento di soft power, influenzando utenti globali con una narrativa costruita ad arte.

DeepSeek: minaccia o opportunità?

La capacità di aggirare le censure solleva una questione cruciale: DeepSeek rappresenta una reale opportunità per scardinare i limiti della propaganda, o è un’arma a doppio taglio? Sebbene possa essere usata per accedere a informazioni altrimenti negate, la sua programmazione iniziale pone rischi evidenti di manipolazione delle informazioni.

Come sottolineato dall’esperto di cybersecurity Adrianus Warmenhoven, “Gli utenti devono avvicinarsi a queste piattaforme con consapevolezza, specialmente considerando il contesto geopolitico e le diverse leggi sulla privacy in vigore nel mondo.”

Giovanni Scafoglio

Leggi anche

intelligenza artificiale non esiste giovanni scafoglio

Related Post