Facultad de Ciencias Químicas y Farmacéuticas · Unidad de Inteligencia Artificial
Volver a noticias

Noticia global · 2 de junio de 2026 · HCompany

HCompany lanza Holo3.1, familia de agentes de uso de computador rápidos y ejecutables localmente

HCompany lanza Holo3.1, familia de agentes de uso de computador rápidos y ejecutables localmente

Holo3.1 mejora el soporte móvil, la compatibilidad entre frameworks y suma checkpoints cuantizados para desplegar agentes de uso de computador en local.

HCompany lanzó Holo3.1, una nueva familia de modelos de uso de computador que sucede a Holo3, lanzado en marzo de 2026 y adoptado rápidamente para automatización de navegadores, software empresarial y herramientas internas. A medida que su despliegue se expandía, los usuarios pidieron mayor flexibilidad de implementación —desde inferencia en la nube hasta ejecución completamente local en dispositivos de usuario final— junto con integración fluida entre distintos entornos.

Holo3.1 aborda estas necesidades mejorando la robustez en tres dimensiones: entornos (web, escritorio y móvil), frameworks y arneses de agentes, y objetivos de despliegue. Por primera vez, la compañía libera checkpoints cuantizados optimizados para inferencia local, en formatos FP8, Q4 GGUF y NVFP4. Basado en la familia Qwen, el modelo busca reducir el desajuste de distribución que enfrentaban los desarrolladores al llevar Holo3 a producción, donde un buen desempeño en un entorno no siempre se transfería a otro, particularmente en dispositivos móviles. La automatización móvil muestra las mejoras más notables: en AndroidWorld, el modelo 35B-A3B sube de 67% a 79,3%, mientras las variantes más pequeñas de 4B y 9B avanzan de 58% a 72%. La versión introduce soporte nativo de function-calling con salidas JSON estructuradas y logra casi paridad de desempeño en OSWorld y en benchmarks internos de comercio electrónico, software empresarial y colaboración; en el harness de producto Holotab, el rendimiento mejora más de 25% respecto de Holo3.

La familia ofrece cuatro tamaños de modelo —0,8B, 4B, 9B y 35B-A3B— para distintos escenarios de despliegue, desde agentes locales ultraligeros hasta desempeño de vanguardia. En DGX Spark, la cuantización NVFP4 W4A16 entrega 1,41 veces el throughput de FP8 y 1,74 veces el de BF16 de precisión completa, con solo dos puntos de degradación en OSWorld. Los checkpoints Q4 GGUF permiten despliegue local privado en Windows y Mac, y las optimizaciones de harness desarrolladas con NVIDIA junto a la cuantización NVFP4 logran un speedup de aproximadamente 2x de extremo a extremo frente a la base FP8, reduciendo el tiempo promedio por paso de 6,8 a 3,3 segundos.

Fuente original

Hugging Face