Hé les gars! Quand il s'agit d'intelligence artificielle, tout le monde se tourne vers OpenAI (ChatGPT) ou Anthropic (Claude) dans la Silicon Valley. Mais en arrière-plan, une question fondamentale pour l'Europe reste brûlante:
À quel point sommes-nous indépendants si les géants américains se déconnectent demain, multiplient les prix ou réduisent l'accès?
C'est ici que vient Soofi Le projet le plus récent d'Allemagne pour la souveraineté numérique de l'IA. (prononcé : Ainsiexpropriation OpenSource Foundati(Mais c'était à peine A la mi-juin, le premier modèle Soofi-S au départ, Sur la scène technologique, il y a eu des vents contraires: De «Performances de pointe et jalon pour le site allemand» relative à: «gaspillage d’argent et tests de performance embellis» jusqu’à:Oh, c'est ça. So they Volkswagen’d it« Par exemple, sur X/Twitter, tout était là pour la première fois.
Nous avons examiné de plus près l'arrière-plan, gonflé le jargon technique pour vous et senti l'ensemble un peu sur la dent!
Les faits clés en un coup d'œil:
- Montant de l'aide Phase 1: 25 millions d'euros du ministère fédéral de l'Economie (BMWE).
- Taille de modèle Soofi-S: 31,6 milliards de paramètres au total, mais seulement 3,2 milliards d'actifs par étape de calcul.
- Données d'entraînement: Gigantesque 26 000 milliards de jetons (Données allemandes & anglaises de haute qualité).
- Puissance de calcul: 253 000 heures de GPU sur les puces B200 de Nvidia.
- Licence : Licence Apache (open source pour le code, les poids et les données).
- Télécharger: via Huggingface.co
Qu'est-ce que Soofi et pourquoi le contribuable paie-t-il pour cela?
Le ministère de l'Économie a investi environ 25 millions d'euros pour réunir un consortium d'universités, d'instituts de recherche (tels que Fraunhofer et DFKI) et de start-ups (Ellamind, Merantix Momentum).. Une trentaine d'experts travaillent directement sur le projet..
L'objectif: Un Modèle européen de fondation open source construire. En comparaison avec les fournisseurs américains: Non seulement le code, mais aussi les poids du modèle et les données d'entraînement sont ouverts. Les entreprises doivent pouvoir s'appuyer sur cette base et l'adapter à leurs propres besoins très spécifiques. Seulement open source et sans que les données sensibles de l'entreprise n'atterrissent sur les serveurs américains!
Techniquement compréhensible: Comment fonctionne vraiment Soofi-S
Soofi-S n'est pas un méga-modèle énorme et encombrant, mais s'appuie sur un design architectural intelligent et moderne.
Tech-Talk traduit: Mixture of Experts (MoE) Imaginez un immense immeuble de bureaux. Au lieu qu'un seul employé doive essayer de tout savoir parfaitement, il y a beaucoup d'experts spécialisés dans ce bureau. Lorsqu’une question est soulevée (par exemple sur la chimie), le portier (appelé «routeur») transmet la question précisément à l’expert en chimie.
Chez Soofi-S, cela signifie: Sur un total de 31,6 milliards de paramètres (connaissances globales), chaque tâche ne nécessite qu'env. 3,2 milliards de paramètres activé. L'idée derrière cela: Cela permet d'économiser énormément de puissance de calcul, de rendre les réponses ultra-rapides et de réduire les coûts du serveur!
C'est le modèle de Nvidia qui a servi de base Nemotron 3 Nano (ce que les critiques ont critiqué), mais l'équipe n'a pas simplement copié le modèle. Ils ont développé leur propre concept de formation et d'apprentissage par renforcement et l'ont 26 000 milliards de jetons nourris, dont un grand morceau de données allemandes de haute qualité, spécialisées et journalistiques (entre autres par le biais d'une licence des archives Genios).
Tout d'abord, ça sonne bien, alors pourquoi le shitstorm? Soofi a-t-il triché lors du test de performance?
Dès que Soofi-S a été publié, il y avait les premiers amortisseurs. Le test de performance (benchmark) de Soofi-S a été manipulé!
Le problème: Test Data Leakage Lorsqu’une IA est entraînée et que les questions d’examen du test de performance ultérieur (par exemple, le célèbre Test du diamant GPQA) inclus dans le matériel de formation, c'est comme un élève qui reçoit exactement la feuille de solution à mémoriser avant une clôture. Le modèle brille phénoménale dans le test, mais n'est pas si intelligent dans la pratique.
Qu'en dit le créateur? Prof. Dr. Alexander Löser expliqué Entretien avec Golem, qu'en raison d'une erreur lors du téléchargement d'un jeu de données externe (base TUDA/QA de Hugging Face), des questions d'examen paraphrasées par erreur ont glissé dans la phase d'entraînement. L'équipe a fait l'erreur de manière transparente, le test GPQA a été complètement exclu des benchmarks et le rapport scientifique a été corrigé. Löser souligne que les plus de 80 autres tests étaient complètement propres et que le modèle reste excellent.
Le podcast VDI «Technique à l’oreille» est également recommandé.
Dans l'épisode 136 du podcast L'hôte Christopher Baczyk discute de la question de savoir si l'Europe perd sa souveraineté avec le professeur Löser de la Berliner Hochschule für Technik. Si vous vous demandez pourquoi il est l'interlocuteur de Golem et du VDI: Il a travaillé sur Soofi!
La stratégie: «L’internet des experts» au lieu de mégamonolithes
Pourquoi ne construisons-nous pas notre propre ChatGPT en Allemagne avec 1 000 milliards de paramètres?? Le solveur le résume pragmatiquement comme d'habitude: Pour cela, l'Europe manque tout simplement des milliards de budgets et de l'infrastructure énergétique nécessaire pour d'énormes centres de données!
La recette du succès de l'Europe ne réside pas dans les gigantesques modèles polyvalents, mais dans le Approche d'ensemble:
- Experts spécialisés en IA: Une entreprise industrielle allemande adopte un modèle de base Soofi et le forme avec son propre savoir-faire (par exemple, la recherche sur les batteries ou l’ingénierie mécanique).
- L’internet des experts: De nombreuses IA spécialisées se connectent entre elles. Lorsqu’un problème doit être résolu (par exemple, le développement d’une voiture électrique), les experts en chimie, en réglementation et en mécanique de l’IA travaillent main dans la main.
- Abordable & Sûr: Ces mini-IA spécialisées fonctionnent sur du matériel d'entreprise normal ou auprès de fournisseurs de cloud européens.
Le crochet matériel: À quel point sommes-nous «souverains»?
Ici, nous devons être honnêtes: Soofi-S a été Cloud IA industriel de T-Systems à Munich (Lien vers le livre blanc) sur 1 024 GPU Nvidia B200 Entraîné. Environ 19 millions d'euros du budget ont été versés directement dans le temps de calcul.
C'est ce que montre la plus grande faiblesse de la politique numérique européenne: Même si le code et les données sont à 100 % sont européens, Sans le matériel américain de Nvidia, presque rien ne fonctionne actuellement. Si les Etats-Unis, sous un gouvernement actuel ou futur, Limiter l'exportation de matériel d'IA vers l'Europe, Nous serions sous la pluie. Propres projets européens de puces électroniques, tels que: Vsora ou Dare Malheureusement, nous n'en sommes qu'au début.
Étant donné que le projet est actuellement en phase bêta et que la phase de test hébergée par Telekom est également en cours, la classification finale en droit des licences jusqu'à présent ouverte, même si elles Définition de l'IA open source 1.0 Il est fortement déconseillé de l'utiliser dans des systèmes de traction.
Perspectives: Que se passe-t-il ensuite?
- À partir du Q4 2026: Les versions améliorées et affinées de Soofi-S (y compris les modèles d’instruction et de raisonnement tels que: Isar et Rhine) doivent être totalement libres sur Hugging Face. Mentions légales à ce sujet:
- Guide pratique pour les entreprises: D'ici la fin de 2026, l'équipe publiera également des instructions sur la façon dont les petites et moyennes entreprises peuvent traiter leurs données de manière appropriée afin de construire leurs propres experts Soofi.
- Soofi Phase 2 (peut-être à partir de 2027): Une deuxième phase de soutien est prévue avec 30 à 40 millions d'euros. Il s'agit d'un modèle MoE encore plus 300 à 800 milliards de paramètres sont construits.
Guide rapide Essayez SOOFI-S Beta par vous-même
Soofi-S local avec LM Studio Pour les débutants (ou vLLM si vous n'avez pas peur des lignes de commande)
Vous voulez le modèle open source allemand Soofi-S sur votre propre hardware? Pas comme les suspects habituels, mais sans cloud, sans abonnement et avec 100 % Protection des données? Avec du matériel adapté et LM Studio (versions GGUF) ou vLLM (BF8, EntQuant, …) le fait en quelques clics/commandes!
1. Vérification matérielle (avant de commencer)
- Mémoire vive (RAM/VRAM): Pour la version quantifiée de Soofi-S, il vous suffit généralement 24 Go de RAM (mieux: VRAM sur votre carte graphique, sinon le sabot s'endort).
- Soofi S est un modèle de mélange d'experts avec 31,6 milliards de paramètres au total, dont seulement environ 3,2 milliards sont activés par jeton. Néanmoins, il faut tous Les poids sont dans la mémoire.
- Selon la quantification, selon la page officielle de GGUF, vous aurez besoin de: Q4 _K _M ≈ 21 GB, Q5 _K _M ≈ 25-26 GB (norme recommandée), Q8 _0 ≈ 32-34 GB. Prévoyez au moins 32 Go de RAM (ou VRAM/Mémoire unifiée sur Mac). Les Mac Silicon d'Apple (M2/M3/M4 Pro/Max avec suffisamment de mémoire unifiée) sont bien adaptés en raison de l'architecture MoE, tout comme les PC Windows/Linux avec un puissant GPU + beaucoup de VRAM
- Espace de stockage: Tenez-vous aussi à environ. 5 à 10 Go de stockage NvME/SSD gratuit prêt.
2. Préparer le studio LM
- Télécharger: Si ce n'est pas déjà fait, procurez-vous LM Studio lmstudio.ai et installez-le. Veuillez mettre à jour les anciennes versions et, en outre, dans les paramètres (mode développeur), Mettre à jour Runtime/Engine: Soofi S utilise une architecture personnalisée («nemotron _h _moe») qui ne connaissait pas les anciennes versions de llama.cpp/LM Studio (message d’erreur «unknown model architecture»). Ce support n'a été mis à niveau qu'en 2026, sans runtime actuel, le modèle ne se chargera pas.
- Lancer l'application: Ouvrez l'application et passez à la barre latérale gauche. onglet «Découvrir» (Lupe ou abréviation
Ctrl + 2/⁇ + 2).
3. Trouver Soofi-S sur Hugging Face & télécharger
- Utiliser la barre de recherche: Entrez dans la recherche ci-dessus
Soofi-S GGUFun. (Alternativement: Copiez directement l'URL Hugging Face de la version Soofi-S GGUF dans la barre de recherche). - Choisir la bonne quantification (fichier GGUF):
- Recommandation d'entrée: Choisissez une version comme
Q4_K_MEnsuite, vous arriverez peut-être à destination avec 24 Go (V) de RAM, bien que lentement.
- Recommandation d'entrée: Choisissez une version comme
- Démarrer le téléchargement: Cliquez à côté du fichier de votre choix «Télécharger». Vous pouvez voir la progression dans l'onglet Téléchargements.
4. Charger le modèle & loschatten
- Sélectionner le modèle: Passer à onglet de chat (icône de bulle sur la gauche).
- Charger dans la mémoire: Cliquez sur la barre déroulante en haut («Select a model to load» (Sélectionner un modèle pour charger)) et sélectionnez votre fichier téléchargé Modèle Soofi-S GGUF à partir de.
- Démarrer le chat: Une fois que la barre de chargement est verte, Soofi-S est prêt à l'emploi! Posez des questions à l'IA en allemand ou laissez-la résoudre des tâches, comme je l'ai dit, cela fonctionne maintenant complètement hors ligne sur votre ordinateur.
Conseils pro pour les utilisateurs expérimentés:
- Déchargement sur GPU: Si vous disposez d'une carte graphique NVIDIA/AMD ou d'une puce Apple M, activez le Déchargement GPU allumé/élevé pour faire ressortir la vitesse de génération maximum (jetons/seconde).
- Serveur API local (facultatif): Utilisez le mode Développeur de LM Studio Serveur local-Tab. Avec cela, LM Studio vous fournit une interface compatible OpenAI (
http://localhost:1234/v1) prêt à intégrer Soofi-S dans vos propres scripts, extensions de navigateur ou flux de travail! - Toutes les variantes d'EntQuant sont toujours vLLM-only, Docker + Linux (WSL2 sous Windows, le cas échéant) n’ont pas besoin de LM Studio.
TL:DR
Is Soofi Sauver immédiatement notre avenir en matière d'IA? Non, la dépendance matérielle vis-à-vis des États-Unis est encore trop grande pour cela. Mais c'est une étape extrêmement importante et réfléchie!
L’approche consistant à ne pas copier obstinément le concept américain des gigantesques «IA monolithiques» gourmandes en électricité, mais à écosystème connecté de modèles open source spécialisés Elle s'inscrit parfaitement dans l'industrie européenne. Si la phase 2 livre et que les entreprises suivent, Soofi pourrait devenir le spécialiste de niche dont l'Europe a besoin!
Sources : the-decoder.de | fraunhofer.de | golem.de | soofi.info | huggingface.co | telekom.com | handelsblatt.com | innfactory.ai | opensource.org | cloudmagazin.com