CourionAI
ES
Boletín
← Todas las noticias
open-weight 3 min de lectura

Granite 4.2 de IBM es gratuito, lo suficientemente pequeño como para ejecutarse localmente y diseñado para pensar primero

Tres modelos abiertos en 3B, 8B y 30B bajo una licencia Apache 2.0, además de un modelo de voz de 470 millones de parámetros que transcribe tres horas de audio en aproximadamente un segundo.

Tres bloques de piedra de tamaño decreciente apilados sobre un escritorio sencillo junto a un candado abierto

IBM ha lanzado Granite 4.2, una familia de modelos de lenguaje abierto en tamaños de parámetros de 3 mil millones, 8 mil millones y 30 mil millones, bajo una licencia Apache 2.0. Esa licencia importa más que el cuadro de referencia: significa que puedes descargar los modelos, adaptarlos y ejecutarlos en un producto sin pedir permiso ni pagar una tarifa. Están en Hugging Face, Ollama, LM Studio, GitHub y OpenRouter a partir del martes.

El cambio de titular es un razonamiento nativo. Estos modelos piensan paso a paso antes de actuar, lo que en la práctica significa planificar una secuencia de llamadas de herramientas en lugar de lanzarlas y esperar. Los parámetros, aproximadamente, son los números internos que un modelo aprende durante el entrenamiento, y el recuento es un indicador decente de cuánto hardware necesita: un modelo 3B se ejecuta cómodamente en una computadora portátil, un modelo 8B necesita una tarjeta gráfica razonable y 30B es una estación de trabajo o un servidor pequeño.

Llegar allí requirió cambios en la capacitación en lugar de una mayor escala. IBM agregó un régimen de aprendizaje por refuerzo de múltiples etapas, que es un entrenamiento en el que el modelo es recompensado por buenos resultados en lugar de mostrar respuestas correctas, comenzando con una etapa fundamental que abarca matemáticas, ciencias, codificación y uso de herramientas. Luego, los modelos 8B y 30B pasaron por una fase de “RL agente” en tareas de estilo empresarial: ingeniería de software, trabajo de terminal, flujos de trabajo basados ​​en búsquedas. Los modelos también se entrenaron con un billón de tokens de código sintético del proceso CodeAlchemy de IBM, y se entregan con una capa de decodificación especulativa, un truco que adivina varias palabras por adelantado y las verifica de una sola vez, por lo que el texto sale más rápido.

Junto al modelo se envían silenciosamente dos modelos de voz, Granite Speech 5.0 Turbo CTC y una variante no comercial, con sólo 470 millones de parámetros. No tienen ningún modelo de lenguaje en su interior, que es lo que los mantiene pequeños. IBM informa una puntuación de rendimiento de aproximadamente 12.600 en una sola GPU H200 frente a aproximadamente 6.000 para los líderes de velocidad actuales en la tabla de clasificación Open ASR de Hugging Face, y dice que el modelo transcribe tres horas de voz grabada en aproximadamente un segundo.

Qué está pasando realmente aquí: IBM no está tratando de vencer a GPT-5.6 o Claude. Está apuntando al aburrido medio del mercado, donde una empresa quiere un agente que realice de manera confiable la misma tarea de varios pasos diez mil veces, en sus propios servidores, sin una factura por token o sin que sus datos salgan del edificio. Esa es una necesidad real y desatendida, y las pesas abiertas y los tamaños pequeños son una respuesta sensata. Los gráficos competitivos que publica IBM son propios, comparados con modelos de tamaño similar, así que léalos como una afirmación más que como un veredicto.

Qué significa esto para ti: si has querido probar un modelo de IA capaz en tu propia computadora, las versiones 3B y 8B son un punto de partida inusualmente fácil. ollama run granite4.2 y te desconectas, sin enviar nada a ninguna parte. No espere una calidad de vanguardia; Espere algo útil para resumir, redactar y utilizar herramientas sencillas que no cuesten nada y que no se puedan descontinuar.

Fuentes

Fuentes: https://research.ibm.com/blog/introducing-granite-4-2

Siguiente artículo

120 empresas firman una carta diciendo que la ventana cibernética se está cerrando

OpenAI, Anthropic, Google, Microsoft, Visa y más de cien otros advierten que faltan meses para ataques habilitados por IA a hospitales y servicios de agua, y piden un esfuerzo defensivo coordinado.

Una pared de escudos entrelazados a lo largo de la página con una torre de agua y un hospital refugiándose detrás de ella.