Tecnología• 3 min de lectura7 de octubre de 2026

Nuevos Modelos de Decisión Abiertos Manejan Texto, Imágenes y Audio Rápidamente

Liquid AI lanzó nuevos modelos de decisión abiertos llamados d1-3B y d1-omni-600M. Estas herramientas toman decisiones rápidas usando texto, imágenes y audio.

En resumen: Liquid AI lanzó nuevos modelos de decisión abiertos llamados d1-3B y d1-omni-600M. Estas herramientas toman decisiones rápidas usando texto, imágenes y audio.

Imagina un programa de computadora que mira una foto o lee un mensaje y te da inmediatamente una respuesta estructurada sin tener que chatear de ida y vuelta.

Qué ocurrió, en palabras sencillas

Liquid AI anunció dos nuevos modelos de decisión de pesos abiertos llamados d1-3B y d1-omni-600M. A diferencia de los sistemas de chat típicos que escriben oraciones largas palabra por palabra, estos modelos proporcionan respuestas en un solo paso llamado paso hacia adelante. El equipo probó los modelos en siete temas públicos, como comprensión de lectura y preguntas médicas, y comprobó su velocidad en varios dispositivos de hardware.

Puntos clave

  • Las puntuaciones más altas en su categoría de tamaño El modelo d1-3B obtuvo 48.57 en el Decision Index 0.2.1, superando a varios modelos más grandes.
  • Manejo de diferentes tipos de medios Mientras que el d1-3B acepta texto e imágenes, el modelo d1-omni-600M puede manejar texto combinado con imágenes o audio.
  • Respuestas de alta velocidad En el hardware probado, el d1-3B responde a una pregunta en menos de 50 milisegundos en todos los dispositivos periféricos medidos.
  • Etapa de investigación temprana El modelo d1-omni-600M es actualmente un lanzamiento de investigación temprano en desarrollo posterior.

Términos explicados

  • Modelos de Decisión — Herramientas informáticas diseñadas para elegir una respuesta o tomar una decisión en lugar de escribir párrafos largos. Ejemplo: Un programa que observa la queja de un cliente y la clasifica en la categoría de soporte correcta.
  • Multimodal — La capacidad de un sistema para entender más de un tipo de entrada, como imágenes y palabras. Ejemplo: Una aplicación que puede leer un subtítulo de texto y mirar una fotografía al mismo tiempo.
  • Parámetros — Los ajustes internos de un modelo de computadora que le ayudan a aprender patrones y tomar decisiones. Ejemplo: Los diales ajustables en una mesa de mezclas de sonido que moldean el audio final.

Por qué importa

Estos modelos pueden ayudar a los desarrolladores a construir herramientas que clasifiquen información, verifiquen imágenes o analicen texto muy rápidamente en dispositivos de hardware locales.

Lo que aún no sabemos

El modelo d1-omni-600M es un lanzamiento temprano, y las evaluaciones comparativas de decisiones de audio siguen siendo un problema abierto sin puntuaciones oficiales informadas en la fuente.


Basado en información de Hugging Face Blog. Este es un texto explicativo independiente, escrito con palabras propias y ayuda de IA; Hugging Face Blog no lo ha revisado ni respaldado. Lee el original para ver todos los detalles.