← Volver a notas
ia,llm,modelos-pequenos,prismml,compresion

PrismML espera que su pequeño modelo de lenguaje cambie la forma en que usamos la IA

PrismML lanzó Bonsai 2 27B, que comprime el modelo Qwen3.8 de Alibaba a 5,9 GB, manteniendo el 98% del rendimiento, para que los modelos de razonamiento quepan en PCs y smartphones.

RRedacción Sandia Tech·18 de septiembre de 2026·2 min

Si el laboratorio de IA PrismML aún no está en tu radar, debería estarlo —no porque haya recaudado montones de dinero (todavía no lo ha hecho; solo una ronda semilla de 22,25 millones de dólares), sino por las mentes técnicas involucradas y la tecnología potencialmente transformadora de la industria que está desarrollando.

PrismML apuesta a que los modelos de lenguaje grandes capaces, de alto rendimiento y con razonamiento, de hecho, no tienen que ser grandes.

Está fabricando modelos de razonamiento tan pequeños que caben en PCs y smartphones. (Incluso se rumorea que está en conversaciones con Apple, aunque el CEO Babak Hassibi se negó a comentar sobre eso con TechCrunch.)

Bonsai 2 27B

El jueves, PrismML lanzó Bonsai 2 27B, su último modelo de la familia, que comprime Qwen3.8 27B, un modelo de código abierto ampliamente utilizado de Alibaba, hasta 5,9 GB. Eso es lo suficientemente pequeño para caber en una PC y, posiblemente, en un smartphone de gama alta. Representa una reducción de memoria de 9 a 10 veces frente al original.

PrismML fue fundada por un grupo de investigadores de Caltech y está liderada por Hassibi, profesor de Caltech y experto en tecnologías de compresión. La startup también cuenta con Ion Stoica como asesor. Stoica es cofundador de Databricks (y otras empresas) y director del famoso Sky Computing Lab de Berkeley, que ha dado origen a muchas tecnologías y startups, desde Letta hasta SGLang.

PrismML también cuenta con el respaldo de los inversores Khosla Ventures, Cerberus Capital y Caltech.

Esta startup ciertamente no es la única que trabaja en tecnología de compresión de LLM. Multiverse Computing, fundada por un conocido profesor del Centro Internacional de Física de Donostia en España, es otra. (Y Multiverse Computing ha recaudado mucho dinero.)

Pero Hassibi dice que la tecnología de compresión de PrismML es única porque sus LLM han perdido prácticamente nada de rendimiento en comparación con los originales. Bonsai 2 iguala el 98% de las puntuaciones agregadas de benchmarks de Qwen. Eso es un avance respecto del primer Bonsai, lanzado hace un par de meses en marzo, que alcanzaba el 95%. Ese modelo original ya ha sido descargado más de 11 millones de veces, y los modelos aún más pequeños de PrismML han sido descargados otras 2,6 millones de veces, según la compañía.

Esto demuestra que la apuesta de PrismML está encontrando tracción en el mercado.

Fuente: TechCrunch

Ver más notas →