Simon Willison
Programador y autor cuyo blog es una de las guías independientes más fiables sobre lo que los modelos de IA pueden hacer y cuáles son sus límites.
Simon Willison participó en la creación del framework web Django y ahora dedica gran parte de su tiempo a probar modelos de IA en público. Su blog mantiene un registro continuo de lo que intentó, lo que funcionó, lo que se rompió y cuánto costó. Eso lo hace mucho más útil que la mayoría de los anuncios de los proveedores.
También ideó la prueba del pelícano, una comprobación informal que pide a un modelo que dibuje un pelícano montando en bicicleta. El tema es deliberadamente absurdo para que no exista un dibujo terminado que el modelo pueda copiar y tenga que componer la escena desde cero. Se convirtió en una broma recurrente y, a la vez, en una forma rápida y realmente práctica de observar si un modelo nuevo entiende cómo encajan los objetos en el espacio.
-
Los investigadores encontraron una manera de leer los pensamientos ocultos de Claude, ChatGPT y Gemini
-
Una herramienta gratuita de línea de comandos ahora le muestra lo que piensa un modelo y habla con casi cualquier modelo
-
Karpathy convirtió un párrafo de Tolkien en una escena 3D por diez dólares y lo llamó un vibe check.
-
Anthropic asegura que Claude ha descubierto dos debilidades reales en algoritmos criptográficos
-
Hugging Face publica la cronología completa del agente de IA que entró en sus sistemas