"Soofi" diventerà la strada della Germania verso la sovranità dell'IA o è solo una bella illusione?

Ehi ragazzi! Quando si tratta di intelligenza artificiale, tutti sembrano sempre affascinati nella Silicon Valley da OpenAI (ChatGPT) o Anthropic (Claude). Ma sullo sfondo, c'è ancora una domanda fondamentale per l'Europa:

Quanto siamo indipendenti quando i giganti statunitensi staccano la spina domani, moltiplicano i prezzi o accelerano l'accesso?

Proprio qui viene Soofi L'ultimo progetto tedesco per la sovranità dell'IA digitale. (pronunciato: Cosìvereign OpenSource Foundati(A) Ma era a malapena Il primo modello a metà giugno Soofi-S all'inizio, C'era un sacco di vento contrario nella scena tecnologica: A partire da "Top performance e milestone per la Germania come location" circa “Spreco di denaro e test di performance abbelliti” fino a "Oh, si'. Così l'hanno fatto Volkswagen"Ad esempio, su X/Twitter tutto era lì per la prima volta.

Abbiamo dato un'occhiata più da vicino allo sfondo, decostruito il gergo tecnico per te e ci siamo sentiti un po 'sul dente!

Fatti chiave a colpo d'occhio:

  • Importo del finanziamento Fase 1: 25 milioni di euro dal Ministero federale dell'economia (BMWE).
  • Dimensione del modello Soofi-S: 31,6 miliardi di parametri in totale, ma solo 3,2 miliardi attivi per fase di calcolo.
  • Dati relativi alla formazione: gigantesco 26 trilioni di gettoni (dati tedeschi & inglesi di alta qualità).
  • Potenza di calcolo: 253.000 ore GPU sui chip B200 di Nvidia.
  • Licenza: Licenza Apache (open source per codice, pesi e dati).
  • Download: tramite Huggingface.co

Cos'è Soofi e perché il contribuente paga per questo?

Il Ministero dell'Economia ha investito circa 25 milioni di euro per riunire un consorzio di università, istituti di ricerca (come Fraunhofer e DFKI) e start-up (Ellamind, Merantix Momentum).. Circa 30 esperti stanno lavorando direttamente al progetto.

L'obiettivo: Uno Modello della Fondazione europea Open Source costruire. Rispetto ai fornitori statunitensi: Non solo il codice, ma anche i pesi del modello e i dati di allenamento sono aperti. Le aziende dovrebbero essere in grado di prendere questa base e adattarla alle proprie esigenze altamente specializzate. Solo open source e senza alcun dato aziendale sensibile che atterra sui server americani!

Tecnica comprensibile: Come funziona Soofi-S

Soofi-S non è un mega modello enorme e ingombrante, ma si basa su un design architettonico intelligente e moderno.

Tech Talk tradotto: Miscela di esperti (MoE) Immaginate un enorme edificio per uffici. Invece di un singolo dipendente che cerca di conoscere tutto perfettamente, ci sono molti esperti specializzati seduti in questo ufficio. Quando arriva una domanda (ad esempio sulla chimica), il gatekeeper (il cosiddetto "router") inoltra la domanda esattamente all'esperto di chimica.

Nel caso di Soofi-S, ciò significa: Dei 31,6 miliardi di parametri (conoscenza complessiva), solo circa 3,2 miliardi di parametri attivata. L'idea alla base: Ciò consente di risparmiare molta potenza di calcolo, rende le risposte fulminee e mantiene bassi i costi del server!

La base era il modello di Nvidia. Nemotron 3 Nano (che i critici hanno criticato), ma il team non si è limitato a copiare il modello. Hai sviluppato il tuo concetto di apprendimento di formazione e rinforzo e 26 trilioni di gettoni alimentati, tra cui una grande fetta di dati specialistici e di giornali tedeschi di alta qualità (compresa una licenza dall'archivio Genios).

Suona bene all'inizio, quindi perché la tempesta di merda? Soofi ha imbrogliato sul test delle prestazioni?

Non appena Soofi-S è stato rilasciato, ci sono stati i primi ammortizzatori. Il test delle prestazioni (benchmark) di Soofi-S era stato manipolato!

Il problema: Perdita dei dati di prova Quando un'IA viene addestrata e prende accidentalmente le domande dell'esame dal test delle prestazioni successivo (ad es. Test del diamante GPQA) contenuto nel materiale formativo, questo è come uno studente che ottiene esattamente il foglio di soluzione per la memorizzazione prima di un esame. Il modello brilla fenomenale nel test, ma non è così intelligente nella pratica.

Cosa dice l'agente? Prof. Dr. Alexander Löser spiegato Intervista a Golem, che un errore durante il download di un set di dati esterno (TUDA / QA-base da Hugging Face) domande d'esame parafrasate in modo errato sono scivolate nella fase di formazione. La squadra ha reso l'errore trasparente., escludere completamente il test GPQA dai parametri di riferimento e correggere la relazione scientifica. Löser sottolinea che gli oltre 80 altri test sono stati completamente puliti e il modello continua a funzionare in modo eccellente.

Il podcast VDI "Tecnologia sull'orecchio" è consigliato anche qui

Nel podcast episodio 136 Il conduttore Christopher Baczyk discute la questione se l'Europa perda la sua sovranità con questo sopra menzionato professor Löser dell'Università di Scienze Applicate di Berlino. Se ti stai chiedendo perché è la persona di contatto sia per Golem che per il VDI: Ha lavorato su Soofi.

La strategia: "Internet degli esperti" invece dei mega-monoliti

Perché non costruiamo il nostro ChatGPT con 1.000 miliardi di parametri in Germania?? Löser lo porta al punto pragmaticamente: Per questo, all'Europa mancano semplicemente i miliardi di budget e le infrastrutture energetiche necessarie per enormi data center!

La ricetta per il successo dell'Europa non sta nei giganteschi modelli a tutto tondo, ma nel Approccio dell'insieme:

  1. Esperti di IA specializzati: Un'azienda industriale tedesca adotta un modello Soofi di base e lo allena con le proprie competenze (ad esempio, ricerca sulle batterie o ingegneria meccanica).
  2. L'"Internet degli esperti": Molte IA specializzate si collegano tra loro. Quando un problema deve essere risolto (ad esempio lo sviluppo di un'auto elettrica), gli esperti di IA in chimica, regolamentazione e meccanica lavorano di pari passo.
  3. Affordable & Sicuro: Tali mini-AI specializzate funzionano su normali hardware aziendali o con fornitori di cloud europei.

Il gancio hardware: Quanto "sovrano" siamo veramente?

Qui dobbiamo essere onesti: Soofi-S era nel Cloud di intelligenza artificiale industriale di T-Systems a Monaco di Baviera (Link al white paper) il 1.024 GPU Nvidia B200 addestrati. Circa 19 milioni di euro del bilancio sono andati direttamente nel tempo di calcolo.

Ciò dimostra la più grande debolezza della politica digitale europea: Anche se il codice e i dati a 100 % sono europei, Senza l'hardware statunitense di Nvidia, quasi nulla è attualmente in esecuzione.. Se gli Stati Uniti, sotto il governo attuale o futuro, Limitare l'esportazione di hardware di IA in Europa, Se fossimo sotto la pioggia. Propri progetti europei di chip come Vsora oppure Osare Purtroppo, sono ancora all'inizio.

Poiché il progetto è ancora in fase beta e la fase di test ospitata da Telekom è in corso, il Classificazione finale ai sensi della legge sulle licenze finora aperta, Anche se il Open Source AI Definizione 1.0 è pienamente soddisfatto, l'uso in sistemi prductive è ancora fortemente scoraggiato.

Prospettive: Cosa c'è dopo?

  • Dal quarto trimestre del 2026: Le versioni migliorate e finemente sintonizzate di Soofi-S (compresi modelli di istruzione e ragionamento quali Isar e Reno) dovrebbe essere completamente gratuito su Hugging Face. Avviso legale:
  • Guida pratica per le aziende: Entro la fine del 2026, il team vuole anche pubblicare istruzioni su come le piccole e medie imprese possono preparare i loro dati in modo appropriato al fine di costruire i propri esperti Soofi.
  • Soofi Fase 2 (possibilmente dal 2027): È prevista una seconda fase di finanziamento con 30-40 milioni di euro. Questo è destinato ad essere un modello MoE ancora più grande con 300-800 miliardi di parametri essere costruito.

Prova SOOFI-S Beta per te stesso

Soofi-S localmente con LM Studio per principianti (o vLLM se non hai paura delle linee di comando)

Vuoi il modello open source tedesco Soofi-S Eseguire sul proprio hardware? Non come i soliti sospetti, ma completamente senza cloud, senza abbonamento e con 100 % Protezione dei dati? Con hardware appropriato e LM Studio (versioni GGUF) o vLLM (BF8, EntQuant, …) può farlo in pochi clic/comandi!

1. Controllo hardware (prima di iniziare)

  • Memoria (RAM/VRAM): Per la versione quantizzata di Soofi-S, di solito è sufficiente per te 24 GB di RAM (migliore: VRAM sulla scheda grafica, altrimenti lo zoccolo si addormenterà).
  • Soofi S è un modello Mixture-of-Experts con 31,6 miliardi di parametri in totale, di cui solo circa 3,2 miliardi sono attivati per token. Tuttavia, dobbiamo tutti I pesi sono nella memoria.
  • A seconda della quantizzazione è necessario secondo la pagina ufficiale GGUF: Q4 _K _M ≈ 21 GB, Q5 _K _M ≈ 25-26 GB (norma raccomandata), Q8 _0 ≈ 32-34 GB. Pianifica almeno 32 GB di RAM (o VRAM / memoria unificata su Mac). I Mac in silicio Apple (M2/M3/M4 Pro/Max con memoria unificata sufficiente) sono adatti a causa dell'architettura MoE, così come i PC Windows/Linux con potente GPU + molta VRAM
  • Spazio di stoccaggio: Tenere anche circa. Memoria NvME/SSD gratuita da 5 a 10 GB pronto.

2. Preparare LM Studio

  • Download: Se non l'hai già fatto, prendi LM Studio da lmstudio.ai e installarlo. Si prega di aggiornare le vecchie versioni e in aggiunta nelle impostazioni (modalità sviluppatore) il Aggiorna runtime/motore: Soofi S utilizza un’architettura personalizzata («nemotron _h _moe») che le versioni precedenti di llama.cpp/LM-Studio non conoscevano ancora (messaggio di errore «unknown model architecture»). Questo supporto è stato installato solo nel corso del 2026, senza runtime corrente il modello non si carica.
  • Avvia l'app: Aprire l'applicazione e passare alla barra laterale sinistra Scheda "Scopri" (Lupe o abbreviazione Ctrl + 2 / ?? + 2).

3. Trova Soofi-S su Hugging Face & scarica

  • Usa la barra di ricerca: Inserisci sopra nella ricerca Soofi-S GGUF uno. (in alternativa: Copiare direttamente l'URL Hugging Face della versione Soofi-S GGUF nella barra di ricerca).
  • Scelta della quantizzazione corretta (file GGUF):
    • Raccomandazione per iniziare: Scegli una versione come Q4_K_M Poi si può raggiungere la destinazione con 24GB (V)RAM, anche se dolorosamente lentamente.
  • Avvia il download: Fare clic accanto al file desiderato "Download". Puoi vedere i progressi nella scheda Download.

4. Modello di carico & loose shadow

  • Selezionare il modello: Passare a Scheda Chat (Parla con l'icona a forma di bolla a sinistra).
  • Carica in memoria: Clicca sulla barra a discesa in alto («Selezionare un modello da caricare») e scegli il tuo scaricato Modello Soofi-S GGUF Spegni.
  • Avvia la chat: Non appena la barra di caricamento è verde, Soofi-S è pronto per l'uso! Fai le domande sull'IA in tedesco o lascia che risolva i compiti, come ho detto, che ora vengono eseguiti completamente offline sul tuo computer.

Suggerimenti pro per gli utenti esperti:

  • Offloading su GPU: Se si dispone di una scheda grafica NVIDIA/AMD o di un chip Apple M, Offloading della GPU on/high per solleticare la massima velocità di generazione (gettoni/secondo).
  • Server API locale (opzionale): Utilizzare la modalità sviluppatore di LM Studio Server locale-Tab. LM Studio fornisce un'interfaccia compatibile con OpenAI (http://localhost:1234/v1) pronto a integrare Soofi-S nei propri script, estensioni del browser o flussi di lavoro!
  • Tutte le varianti di EntQuant sono ancora Solo vLLM, Docker + Linux (se applicabile WSL2 su Windows) non hanno bisogno di LM Studio.

TL: RD

è Soofi Il salvataggio immediato del nostro futuro AI? No, la dipendenza hardware dagli Stati Uniti è ancora troppo grande per questo.. Ma è un passo estremamente importante e riflessivo!

L'approccio di non copiare ostinatamente il concetto statunitense di gigantesche "IA monolitiche" mangia-potere, ma un Ecosistema in rete di modelli open source specializzati Si tratta di una soluzione perfetta per l'industria europea. Se la Fase 2 sarà realizzata e le aziende si trasferiranno, Soofi potrebbe diventare esattamente lo specialista di nicchia di cui l'Europa ha bisogno!

Fonti: il-decodificatore.de | fraunhofer.de | golem.de | soofi.info | huggingface.co | telekom.com | handelsblatt.com | innfactory.ai | opensource.org | cloudmagazin.com