Un nuevo tipo de modelo de IA creado por un inventor de ChatGPT entusiasma a los desarrolladores
TypeSafe AI, fundada por Diogo Almeida (ex OpenAI y coinventor de RLHF), lanzó Jev, un modelo basado en transformadores que no produce texto sino probabilidades, y que ya genera gran demanda.
ChatGPT rompió el corazón de Diogo Almeida.
Almeida fue un investigador de OpenAI que ayudó a construir el chatbot y luego inventó el aprendizaje por refuerzo con retroalimentación humana (RLHF), la técnica de entrenamiento de modelos quizás más responsable de nuestra era actual de la IA. Pero a pesar de sus capacidades, estaba decepcionado.
"Tenemos un rayo en una botella, y sin embargo no es útil", dijo Almeida a TechCrunch. "He estado luchando con ese problema desde entonces. Me tomó un tiempo llegar a la conclusión: el problema es que estamos optimizando para el lenguaje humano... Hemos sido muy buenos con el lenguaje humano durante cuatro años, pero no es útil para la automatización porque las computadoras hablan un idioma diferente".
Hace dos años, Almeida dejó OpenAI para fundar TypeSafe AI, una startup que intenta resolver ese problema. Esta semana, la compañía lanzó un nuevo modelo basado en transformadores, Jev, que no es un modelo de lenguaje grande (LLM). No genera texto, sino que produce probabilidades, o lo que la compañía llama "decisiones calibradas".
Prescindir del lenguaje hace varias cosas: hace que el modelo sea increíblemente barato y rápido, y como los usuarios definen las salidas de antemano, no puede alucinar. Sus tokens de salida son gratuitos, y los tokens de entrada se miden por miles de millones, no por millones.
Alta demanda de desarrolladores
Los desarrolladores están mostrando un gran interés en el producto; la compañía perdió brevemente la capacidad de atender usuarios de su API porque la demanda era muy alta. Jev parece más útil para la automatización de software. Hasta ahora, los desarrolladores de software lo ven como una forma más barata y robusta de incorporar inteligencia a su código.
Por ejemplo, Pranit Sharma, ingeniero de software en Vercel, una empresa que crea infraestructura agéntica, dijo que su compañía había usado ChatGPT Luna 5.6 de OpenAI para ejecutar un clasificador que revisa comandos por seguridad. Cuando Vercel reemplazó Luna de OpenAI con Jev, obtuvo resultados de cinco a 18 veces más rápido y con mayor precisión.
Otro desarrollador, Nikhil Mudholkar, CTO de Bryo AI, probó Jev contra Gemini para tareas de clasificación.
Fuente: TechCrunch
