CourionAI
ES
Boletín
← Todas las noticias
local-ai 3 min de lectura

El agente AI de Perplexity ahora se ejecuta en su propia PC con Windows, si posee la tarjeta gráfica adecuada

La Computadora Portátil llegó a Windows para tarjetas RTX con 24GB de memoria o más. Ejecuta un modelo de 27 mil millones de parámetros localmente, se conecta a Outlook, Gmail, Slack y Drive, y pide permiso antes de enviar algo a la nube.

Una torre de escritorio con una brillante tarjeta de expansión insertada y hojas de papel orbitando a su alrededor.

Perplexity trajo su agente de computadora portátil a Windows el lunes, en asociación con Nvidia. Es la versión local del producto Computer de Perplexity: un asistente que lleva a cabo tareas de varios pasos, excepto que el pensamiento ocurre en la máquina frente a usted en lugar de en un centro de datos. Hasta ahora se ejecutaba en Linux y en las cajas DGX Spark de Nvidia. El requisito de Windows es específico: una tarjeta GeForce RTX o RTX PRO con al menos 24 GB de memoria de video, lo que en la práctica significa una tarjeta de escritorio de alta gama en lugar de la computadora portátil que posee la mayoría de la gente.

El modelo que hace el trabajo es Qwen 3.8 27B, sintonizado para hardware RTX, y puede intercambiar PPLX 27B, la variante post entrenada de Perplexity, con el Nemotron 3.5 Lightning de Nvidia prometido más adelante. La parte útil son los conectores: Outlook, OneDrive, Word, Google Drive, Gmail, Slack y GitHub, para que el agente pueda trabajar en su correo y archivos reales en lugar de en cosas que usted pega en un cuadro. Cuando una tarea realmente necesita más razonamiento que el que tiene el modelo local, puede escalar a un modelo en la nube, pero solo después de preguntar. El trabajo local no consume los créditos que consume el uso de la nube, lo que significa que el costo de funcionamiento de una hora de tiempo del agente local es su factura de electricidad. El acceso viene con una suscripción Perplexity Pro a 20 dólares al mes o Max a 200.

¿Qué hay detrás de esto?

Dos cosas están convergiendo. Los modelos de peso abierto en el rango de 20 a 30 mil millones de parámetros se han vuelto silenciosamente lo suficientemente buenos para el trabajo ordinario, y las tarjetas gráficas de consumo ahora tienen suficiente memoria para contener una. Los parámetros son aproximadamente los números ajustables que un modelo aprendió durante el entrenamiento, y la memoria que tiene una tarjeta determina el tamaño del modelo que puede mantener cargado, razón por la cual existe la línea de 24 GB. El argumento es la privacidad, y aquí es más que un eslogan, porque un agente con acceso a su bandeja de entrada es exactamente el caso en el que “los datos nunca salen de esta máquina” vale algo concreto. Lo que hay que mantener en perspectiva es la capacidad. Un modelo de 27 mil millones de parámetros en su escritorio es competente, no fronterizo, y el botón de escalar a la nube existe porque Perplexity lo sabe.

Qué significa esto para ti: Revisa tu tarjeta gráfica antes de entusiasmarte, porque el requisito de 24 GB descarta la mayoría de las computadoras portátiles y una buena parte de las computadoras de escritorio para juegos. Si supera el listón y ya paga por Perplexity, esta es la configuración de agente local más práctica enviada hasta ahora, y vale la pena probar primero los trabajos aburridos: clasificar una semana de correo, sacar cifras de sus propios documentos, redactar respuestas. Si no superas la barra, la noticia sigue siendo útil como dirección. Lo que hace dos años necesitaba un centro de datos, ahora necesita una buena tarjeta gráfica, y los modelos son cada vez más pequeños para ofrecer la misma calidad. Para cualquiera que maneje datos de clientes, datos de pacientes o cualquier cosa bajo un deber de confidencialidad, esta es la categoría que vale la pena observar, porque es la única donde la pregunta sobre privacidad tiene una respuesta clara.

Fuentes

Fuentes: https://blogs.nvidia.com/blog/local-ai-perplexity-windows-pcs/

Siguiente artículo

Personas reales están leyendo conversaciones reales de ChatGPT y la mayoría de los usuarios no tienen idea

404 Media obtuvo documentos internos que describen el Proyecto Lily, el programa de OpenAI para contratar cientos de contratistas para leer indicaciones genuinas de los usuarios y calificar las respuestas. Los datos personales se escapan de los filtros y la configuración que los controla está activada de forma predeterminada.

Una pila de sobres cerrados con el superior abierto y una lupa encima de la carta.