Inferencia
Ejecutar un modelo de IA ya entrenado para obtener una respuesta, en vez de entrenarlo inicialmente.
La inferencia es el acto de usar un modelo entrenado, proporcionarle un prompt y obtener una respuesta. Se distingue del entrenamiento, el proceso único y mucho más caro que crea los pesos.
La diferencia ayuda a entender los costes. Entrenar un modelo de frontera puede requerir meses y enorme capacidad de cálculo, pero se paga una vez. La inferencia se paga con cada uso; por eso los proveedores la miden, normalmente por token, y por eso importan tanto las mejoras que la abaratan o aceleran.
También explica por qué es práctico ejecutar modelos pequeños localmente: un buen portátil puede hacer inferencia para muchas tareas aunque jamás pudiera entrenar el modelo.
-
Gran Bretaña abre una puerta de £100 millones para pequeñas empresas de IA y les permite conservar la propiedad intelectual
-
Tencent Open-Sources Hy4, un modelo de 770 mil millones de parámetros creado para el trabajo de oficina
-
OpenAI construyó su propio chip y los primeros puntos de referencia son buenos
-
Anthropic contrató al hombre que construyó los chips de inteligencia artificial de Google y no es sutil sobre por qué
-
Una spin-out de Oxford vendió Anthropic 250 millones de dólares en chips que aún no existen
-
Ver su propio modelo ahora le cuesta a OpenAI un 20 por ciento más y detuvo una ejecución de entrenamiento para hacerlo
-
Se informa que Anthropic está pagando 7 mil millones de dólares por un software que hace que los chips lleguen más lejos
-
Una startup de chips duplicó su valor en un mes al ser deliberadamente inflexible
-
We Are Building an Invention Meant to Outgrow Its Inventors
-
The Most Valuable AI Skill Is Not Prompting. It Is Verification.
-
Someone Else Is Paying for Your AI, Just Not the Part You Think
-
Backflip AI convierte escaneos 3D en modelos CAD editables, un trabajo que normalmente consume horas
-
AMD compra Taalas, una startup que integra un modelo de IA completo en el chip
-
Cloudflare quiere darle una billetera a tu agente de IA y a ti el límite de gasto
-
Alguien ejecutó DeepSeek V4 Flash en producción en una sola tarjeta AMD y publicó todos los parches necesarios
-
AMD entrena un modelo totalmente abierto con sus propios chips, pero sin licencia comercial
-
Amazon reduce discretamente el desarrollo de casi todos sus modelos de IA
-
AMD y Cerebras se alían para que las respuestas de la IA lleguen más rápido
-
Los próximos chips de IA de Nvidia extraen, según se informa, diez veces más trabajo de la misma energía
-
Kimi K3 se vuelve demasiado popular: Moonshot pausa las nuevas suscripciones
-
DeepSeek busca nuevos miles de millones semanas después de su primera ronda: la IA barata sale cara
-
DeepSeek diseña su propio chip de IA y acepta capital externo por primera vez