DeepSeek V3 (DeepSeek)
La società cinese DeepSeek pubblica DeepSeek V3, un grande modello ad accesso libero con architettura Mixture-of-Experts (671 miliardi di parametri, 37 miliardi attivati per token), con prestazioni paragonabili ai migliori modelli proprietari a un costo di addestramento molto ridotto.
Punti chiave
- DeepSeek pubblica DeepSeek V3 il 26 dicembre 2024, un grande modello ad accesso libero.
- Architettura Mixture-of-Experts da 671 miliardi di parametri, di cui 37 miliardi attivati per token.
- Prestazioni comparabili ai migliori modelli proprietari a un costo di addestramento molto ridotto.
- Conferma l'ascesa dei modelli aperti a basso costo come possibili fonti degli assistenti IA.
Analisi
DeepSeek V3 illustra l'irruzione di modelli aperti ed economici capaci di competere con i leader proprietari. La loro disponibilità ad accesso libero li rende facili da integrare in una moltitudine di strumenti di terzi, il che moltiplica ulteriormente i motori suscettibili di rispondere agli utenti e citare i brand.
Per la visibilità, questa diffusione significa che le risposte IA possono provenire da fonti e strumenti molto variegati, meno visibili dei grandi assistenti di massa. La coerenza delle informazioni di brand attraverso il web resta la migliore leva per restare rappresentati correttamente qualunque sia il modello sottostante.
Cosa fare
- Non limitarsi agli assistenti dominanti: integrare nel monitoraggio gli strumenti di terzi che si appoggiano su modelli aperti.
- Mantenere informazioni di brand coerenti e aggiornate sull'insieme del web, fonte comune di tutti i modelli.
- Dare priorità alla presenza su riferimenti affidabili e ampiamente ripresi, che alimentano sia i modelli aperti sia quelli proprietari.
Conferma l'ascesa dei modelli aperti a basso costo come possibili fonti degli assistenti IA. Da monitorare, perché questi modelli alimentano sempre più strumenti di risposta di terze parti.