CourionAI
ES
Boletín
← Todas las noticias
ollama 2 min de lectura

Más velocidad gratis: Ollama acelera hasta un 90 % la IA local en los Mac

Ollama, la forma más sencilla de ejecutar modelos de IA en tu propio ordenador, acaba de acelerar enormemente el modelo Gemma 4 de Google en los equipos de Apple. Sin ajustes ni contrapartidas: actualizas y funciona más rápido. Así opera el ingenioso truco que lo hace posible.

Ilustración risográfica: un portátil con líneas de velocidad coral y un conejo que corre; una gran mejora de velocidad para la IA local en los Mac

De vez en cuando, un programa mejora de la mejor forma posible: lo actualizas y sencillamente funciona más rápido, sin configurar nada, sin pagar y sin trampa. Eso es lo que ocurrió esta semana para quienes ejecutan modelos de IA en sus propios Mac. Ollama, una herramienta gratuita que permite ejecutar modelos de IA de forma local con casi la misma facilidad que instalar una aplicación, ha lanzado la versión 0.31. Con ella, el modelo Gemma 4 de Google genera ahora texto hasta un 90 % más deprisa en ordenadores Apple.

Una breve orientación si este mundo es nuevo para ti: en lugar de conversar con una IA en la nube, como ChatGPT, puedes descargar un modelo gratuito y ejecutarlo directamente en tu ordenador. Tus preguntas nunca salen del equipo, funciona sin conexión y no pagas nada por cada uso. La desventaja tradicional ha sido la velocidad: los modelos locales suelen parecer lentos frente a sus equivalentes en la nube. Por eso importan actualizaciones como esta.

El truco que permite acelerar el modelo se llama predicción de varios tokens y es realmente ingenioso. Normalmente, un modelo produce texto token a token, un token es un fragmento de una palabra; «com-pren-der» podría tener tres. Ahora, un modelo de «borrador» pequeño y rápido se adelanta y propone los siguientes tokens, y el modelo grande se limita a comprobar el grupo de una sola vez: conserva lo correcto y rehace lo que está mal. Es como si un redactor júnior preparase frases que un editor sénior aprueba por lotes. El resultado es idéntico al que habría escrito el modelo grande por sí solo, pero llega antes. El texto predecible, como el código informático, es el que más se beneficia, de ahí procede la cifra del 90 %; una conversación más libre mejora entre un 20 % y un 40 %, una diferencia que sigue siendo muy perceptible.

Por debajo hay más mejoras de velocidad para los chips más recientes de Apple, y Ollama afirma que Gemma 4 es solo el primer modelo que recibirá este tratamiento: llegarán más.

Qué significa esto para ti: Si ya utilizas Ollama con Gemma 4, instala la actualización y disfruta; no necesitas hacer nada más. Si te interesaba probar la IA en tu propio ordenador, pero pensabas que sería desesperadamente lenta, esa suposición envejece mal y deprisa. Un Mac reciente y una tarde libre bastan para probarla, y actualizaciones como esta siguen acortando discretamente la distancia frente a la nube.

Fuentes

Fuentes: https://ollama.com/blog/faster-gemma-4-mlx-mtp

Siguiente artículo

Los estafadores han encontrado un nuevo truco: registrar las direcciones web que se inventa la IA

Los chatbots de IA a veces inventan direcciones web inexistentes, y unos investigadores descubrieron que repiten las mismas una y otra vez. Ahora los atacantes compran esas direcciones y crean sitios falsos en ellas, a la espera de que lleguen usuarios de IA. Así puedes evitar ser uno de ellos.

Ilustración risográfica: la barra de direcciones de un navegador se disuelve en vapor junto a un pequeño anzuelo coral; direcciones web falsas inventadas por la IA y utilizadas como trampas