¡Hola chicos! Cuando se trata de inteligencia artificial, todo el mundo siempre se ve cautivado en Silicon Valley a OpenAI (ChatGPT) o Anthropic (Claude). Pero en el fondo, todavía hay una pregunta fundamental para Europa:
¿Qué tan independientes somos cuando los gigantes estadounidenses se desconectan mañana, multiplican los precios o aceleran el acceso?
Justo aquí viene Soofi El último proyecto de Alemania para la soberanía de la IA digital. (Pronunciado: Así quevereign OpenSource Foundati(A) Pero difícilmente fue El primer modelo a mediados de junio Soofi-S al principio, Hubo mucho viento en contra en la escena tecnológica: Desde "Mejor rendimiento e hito para Alemania como ubicación" acerca «Residuos de dinero y pruebas de rendimiento embellecidas» hasta «Oh, sí. Así que Volkswagen lo hizo«Por ejemplo, en X/Twitter todo estaba allí por primera vez.
Echamos un vistazo más de cerca al fondo, deconstruimos la jerga técnica para usted y nos sentimos un poco en el diente!
Hechos clave de un vistazo:
- Importe de la financiación Fase 1: ~25 millones de euros del Ministerio Federal de Economía (BMWE).
- Tamaño del modelo Soofi-S: 31.600 millones de parámetros en total, pero solo 3 200 millones activos por fase de cálculo.
- Datos de formación: gigantesca 26 billones de tokens (datos en alemán & inglés de alta calidad).
- Potencia de cálculo: 253.000 horas de GPU en los chips B200 de Nvidia.
- Licencia: Licencia Apache (código abierto, pesos y datos).
- Descargar: vía Huggingface.co
¿Qué es Soofi y por qué el contribuyente paga por ello?
El Ministerio de Economía ha invertido alrededor de 25 millones de euros para reunir a un consorcio de universidades, institutos de investigación (como Fraunhofer y DFKI) y start-ups (Ellamind, Merantix Momentum).. Alrededor de 30 expertos están trabajando directamente en el proyecto.
El objetivo: Uno Modelo de la Fundación Europea de Código Abierto construir. En comparación con los proveedores de EE.UU.: No solo el código, sino también los pesos del modelo y los datos de entrenamiento están abiertos. Las empresas deben ser capaces de tomar esta base y adaptarla a sus propias necesidades altamente especializadas. ¡Solo código abierto y sin datos confidenciales de la compañía que aterrizan en los servidores estadounidenses!
Técnica comprensible: Cómo funciona realmente Soofi-S
Soofi-S no es un mega modelo enorme y difícil de manejar, sino que se basa en un diseño arquitectónico inteligente y moderno..
Tech Talk Traducido: Mezcla de Expertos (MoE) Imagina un enorme edificio de oficinas. En lugar de un solo empleado tratando de saber TODO a la perfección, hay muchos expertos especializados sentados en esta oficina. Cuando surge una pregunta (por ejemplo, sobre química), el guardián de acceso (el llamado «enrutador») envía la pregunta exactamente al experto en química.
En el caso de Soofi-S, esto significa: De los 31.600 millones de parámetros (conocimiento general), solo aprox. 3.200 millones de parámetros activado. La idea detrás de esto: ¡Esto ahorra una gran cantidad de potencia informática, hace que las respuestas sean rápidas y mantiene los costos del servidor bajos!
La base fue el modelo de Nvidia. Nemotron 3 Nano (que los críticos criticaron), pero el equipo no solo copió el modelo. Ha desarrollado su propio concepto de aprendizaje de entrenamiento y refuerzo y 26 billones de tokens Alimentado, incluyendo una gran cantidad de especialistas alemanes de alta calidad y datos de periódicos (incluida una licencia del archivo de Genios).
Suena bien al principio, así que ¿por qué la tormenta de mierda? ¿Soofi hizo trampa en la prueba de rendimiento?
Tan pronto como Soofi-S fue lanzado, hubo los primeros amortiguadores. ¡La prueba de rendimiento (punto de referencia) de Soofi-S había sido manipulada!
El problema: Fuga de datos de prueba Cuando una IA es entrenada y accidentalmente toma las preguntas del examen de la prueba de rendimiento posterior (por ejemplo, el reconocido Prueba de diamante GPQA) contenido en el material de capacitación, esto es como un estudiante que obtiene exactamente la hoja de solución para memorizar antes de un examen. El modelo brilla fenomenal en la prueba, pero no es tan inteligente en la práctica.
¿Qué dice el hacedor? Prof. Dr. Alexander Löser explicado Entrevista con Golem, que un error al descargar un conjunto de datos externo (TUDA / QA-base de Hugging Face) parafraseó incorrectamente las preguntas del examen se deslizó en la fase de entrenamiento. El equipo cometió el error de forma transparente., excluir completamente la prueba GPQA de los parámetros de referencia y corregir el informe científico. Löser enfatiza que las más de 80 otras pruebas fueron completamente limpias y el modelo continúa funcionando excelentemente.
El podcast VDI "Tecnología en el oído" también se recomienda aquí
En el podcast episodio 136 El anfitrión Christopher Baczyk discute la cuestión de si Europa pierde su soberanía con este mencionado profesor Löser de la Universidad de Ciencias Aplicadas de Berlín. Si te estás preguntando por qué es la persona de contacto tanto para Golem como para el VDI: Trabajó en Soofi.
La estrategia: "Internet de expertos" en lugar de megamonolitos
¿Por qué no construimos nuestro propio ChatGPT con 1.000 millones de parámetros en Alemania?? Löser lo lleva al punto pragmáticamente: Para esto, ¡Europa simplemente carece de los miles de millones en presupuestos y la infraestructura energética necesaria para enormes centros de datos!
La receta de Europa para el éxito no reside en gigantescos modelos polivalentes, sino en el Enfoque de conjunto:
- Expertos especializados en IA: Una empresa industrial alemana adopta un modelo básico Soofi y lo entrena con su propia experiencia (por ejemplo, investigación de baterías o ingeniería mecánica).
- La «Internet de los expertos»: Muchas IAs especializadas se conectan entre sí. Cuando es necesario resolver un problema (por ejemplo, el desarrollo de un automóvil electrónico), los expertos en IA en química, regulación y mecánica trabajan mano a mano.
- Asequible & Seguro: Estas mini-AI especializadas se ejecutan en hardware normal de la empresa o con proveedores europeos de nube.
El gancho de hardware: ¿Qué tan "soberanos" somos realmente?
Aquí debemos ser honestos: Soofi-S estaba en el Nube de IA industrial por T-Systems en Munich (Enlace al libro blanco) el 1.024 GPU Nvidia B200 entrenados. Alrededor de 19 millones de euros del presupuesto se destinaron directamente al tiempo de cálculo.
Esto muestra la mayor debilidad de la política digital europea: Incluso si el código y los datos a 100 % son europeos, Sin el hardware estadounidense de Nvidia, casi nada se está ejecutando actualmente.. En caso de que los Estados Unidos, bajo el gobierno actual o futuro, Restringir la exportación de hardware de IA a Europa, Si estuviéramos bajo la lluvia. Proyectos propios de chips europeos como Vsora o Atrévete Desafortunadamente, todavía están al principio.
Dado que el proyecto se encuentra actualmente en fase beta y la fase de prueba alojada por Telekom se está ejecutando, el Clasificación final con arreglo a la legislación sobre licencias abierta hasta la fecha, Incluso si el Definición de AI de código abierto 1.0 se cumple plenamente, el uso en sistemas prductivos todavía está fuertemente desaconsejado.
Perspectivas: ¿Qué sigue?
- A partir del cuarto trimestre de 2026: Las versiones mejoradas y afinadas de Soofi-S (incluyendo modelos de instrucción y razonamiento tales como Isar y Rhin) debe ser completamente gratis en Hugging Face. Aviso legal:
- Guía práctica para empresas: A finales de 2026, el equipo también quiere publicar instrucciones sobre cómo las pequeñas y medianas empresas pueden preparar sus datos adecuadamente para construir sus propios expertos Soofi.
- Fase 2 de Soofi (posiblemente a partir de 2027): Está prevista una segunda fase de financiación con De 30 a 40 millones de euros. Esto está destinado a ser un modelo de MoE aún más grande con 300 a 800 mil millones de parámetros ser construidos.
Prueba SOOFI-S Beta por ti mismo
Soofi-S localmente con LM Studio para principiantes (o vLLM si usted no tiene miedo de las líneas de comando)
Quieres el modelo de código abierto alemán Soofi-S ¿Ejecutar en su propio hardware? No como los sospechosos habituales, pero completamente sin nube, sin suscripción y con 100 % ¿Protección de datos? Con hardware apropiado y LM Studio (versiones GGUF) o vLLM (BF8, EntQuant, …) puede hacer esto en solo unos pocos clics / comandos!
1. Comprobación de hardware (antes de empezar)
- Memoria (RAM/VRAM): Para la versión cuantificada de Soofi-S, por lo general es suficiente para usted 24 GB de RAM (mejor: VRAM en su tarjeta gráfica, de lo contrario su casco se quedará dormido).
- Soofi S es un modelo de mezcla de expertos con 31.6 mil millones de parámetros en total, de los cuales solo alrededor de 3.2 mil millones se activan por token. Sin embargo, debemos todos Los pesos están en la memoria.
- Dependiendo de la cuantificación que necesite de acuerdo con la página oficial de GGUF: Q4 _K _M ≈ 21 GB, Q5 _K _M ≈ 25-26 GB (norma recomendada), Q8 _0 ≈ 32-34 GB. Planifique al menos 32 GB de RAM (o VRAM / memoria unificada en Mac). Los Mac de silicio de Apple (M2/M3/M4 Pro/Max con suficiente memoria unificada) son muy adecuados debido a la arquitectura MoE, al igual que los PC Windows/Linux con una potente GPU + una gran cantidad de VRAM
- Espacio de almacenamiento: Mantenga también aprox. 5 a 10 GB de memoria NvME/SSD gratuita listo.
2. Preparar LM Studio
- Descargar: Si aún no lo has hecho, obtén LM Studio de lmstudio.ai e instalarlo. Por favor, actualice las versiones antiguas y, además, en la configuración (modo desarrollador) el Tiempo de ejecución/motor de actualización: Soofi S utiliza una arquitectura personalizada («nemotron _h _moe») que las versiones más antiguas de llama.cpp/LM-Studio aún no conocían (mensaje de error «arquitectura modelo desconocida»). Este soporte solo se adaptó a lo largo de 2026, sin el tiempo de ejecución actual, el modelo no se carga.
- Inicie la aplicación: Abra la aplicación y cambie a la barra lateral izquierda Pestaña "Descubrir" (Lupa o abreviatura
Ctrl + 2/?? + 2).
3. Encuentra Soofi-S en Hugging Face & descargar
- Utilice la barra de búsqueda: Ingrese arriba en la búsqueda
Soofi-S GGUFuno. (Alternativamente: Copie directamente la URL de Hugging Face de la versión de Soofi-S GGUF en la barra de búsqueda). - Elegir la cuantificación correcta (archivo GGUF):
- Recomendación para empezar: Elige una versión como
Q4_K_MEntonces puede llegar a su destino con 24GB (V)RAM, aunque dolorosamente lentamente.
- Recomendación para empezar: Elige una versión como
- Inicie la descarga: Haga clic junto a su archivo deseado «Descargar». Puedes ver el progreso en la pestaña Descargas.
4. Modelo de carga & sombra suelta
- Seleccione el modelo: Cambiar a Pestaña de chat (Hablar icono de burbuja a la izquierda).
- Cargar en la memoria: Haga clic en la barra desplegable en la parte superior («Seleccionar un modelo para cargar») y elija su descarga Modelo Soofi-S GGUF fuera.
- Iniciar el chat: Tan pronto como la barra de carga es verde, Soofi-S está listo para su uso! Haga las preguntas de IA en alemán o deje que resuelva tareas, como dije, que ahora se ejecutan completamente fuera de línea en su computadora.
Consejos profesionales para usuarios avanzados:
- Descarga a la GPU: Si tienes una tarjeta gráfica NVIDIA/AMD o un chip Apple M, enciende el Descarga de GPU encendido/alto para hacer cosquillas en la velocidad máxima de generación (tokens/segundo).
- Servidor API local (opcional): Utilice el modo de desarrollador de LM Studio Servidor local-Tab. LM Studio le proporciona una interfaz compatible con OpenAI (
http://localhost:1234/v1) listo para integrar Soofi-S en sus propios scripts, extensiones de navegador o flujos de trabajo! - Todas las variantes de EntQuant son todavía vLLM-sólo, Docker + Linux (si aplica WSL2 en Windows) no necesita LM Studio.
TL:DR
Es Soofi ¿El rescate inmediato de nuestro futuro de IA? No, la dependencia de hardware en los EE.UU. sigue siendo demasiado grande para eso. ¡Pero es un paso extremadamente importante y reflexivo!
El enfoque de no copiar obstinadamente el concepto estadounidense de «IA monolíticas» gigantescas y devoradoras de energía, sino un Ecosistema en red de modelos especializados de código abierto Se adapta perfectamente a la industria europea. ¡Si la Fase 2 cumple y las empresas se mudan, Soofi podría convertirse exactamente en el especialista de nicho que Europa necesita!
Fuentes: el-decoder.de | fraunhofer.de | golem.de | soofi.info | abrazándoseface.co | telekom.com | handelsblatt.com | innfactory.ai | opensource.org | cloudmagazin.com