


Qwen3.5 Small es una nueva serie de modelos de Qwen que incorpora capacidades multimodales nativas en arquitecturas compactas. Lanzada en cuatro tamaños — 0.8B, 2B, 4B y 9B — esta familia se basa en una arquitectura mejorada con aprendizaje por refuerzo a escala. Cada variante está diseñada para rendir por encima de su categoría: los modelos más pequeños están optimizados para dispositivos periféricos, la variante de 4B sirve como base ligera para agentes, y el modelo de 9B ya reduce la brecha con alternativas mucho más grandes. También están disponibles versiones base para desarrolladores que prefieran ajustar el modelo desde cero.
La serie abarca desde 0.8B hasta 9B de parámetros, ofreciendo una ruta de actualización clara. Los modelos de 0.8B y 2B son pequeños y rápidos, ideales para inferencia en tiempo real en dispositivos periféricos. El modelo de 4B equilibra velocidad y capacidad, mientras que la variante de 9B ofrece calidad cercana a modelos grandes en una fracción del tamaño.
A diferencia de modelos que añaden visión posteriormente, Qwen3.5 Small es . Procesa imágenes y texto juntos desde el principio, lo que garantiza una mejor alineación y menos sorpresas al cambiar entre modalidades.
Alternativas
Logro
La serie se beneficia de un entrenamiento con RL a escala, que mejora el razonamiento, el seguimiento de instrucciones y la robustez. No es solo una versión más pequeña de un modelo grande, sino un modelo pequeño diseñado específicamente y entrenado con técnicas modernas.
Cada tamaño incluye una variante Base (sin ajuste conversacional) para desarrolladores que deseen control total sobre el ajuste fino. Esto hace que la serie sea adecuada para la adaptación a dominios específicos sin tener que lidiar con el formato de chat integrado.
"El modelo de 9B reduce la brecha con modelos mucho más grandes, mientras que el de 0.8B funciona en un teléfono."
Esa es la verdadera novedad: Qwen3.5 Small no te obliga a hacer concesiones. La variante de 9B ofrece un rendimiento que rivaliza con modelos varias veces más grandes, mientras que las variantes de 0.8B y 2B son lo suficientemente pequeñas para el despliegue en dispositivos periféricos. No tienes que elegir entre calidad y eficiencia, sino el tamaño adecuado para tu hardware. El modelo de 4B, por su parte, ocupa un punto óptimo para cargas de trabajo ligeras de agentes donde se necesita razonamiento sin la sobrecarga de un modelo de 7B+.
Estás implementando IA en hardware con recursos limitados, construyendo agentes autónomos que necesitan funcionar de forma económica, o simplemente buscas un modelo multimodal pequeño que no se sienta pequeño. Qwen3.5 Small es especialmente relevante si has estado esperando un modelo que equilibre preparación para dispositivos periféricos con capacidad real — sin concesiones, solo el tamaño adecuado para el trabajo.
Otras herramientas que podrías considerar
Mistral 3 incluye tres modelos pequeños y densos de última generación (14B, 8B y 3B) y Mistral Large 3, nuestro modelo más potente hasta la fecha: un modelo disperso de mezcla de expertos entrenado con 41B de parámetros activos y 675B de parámetros totales. Todos los modelos se publican bajo la licencia Apache 2.0. Los modelos Ministral representan la mejor relación rendimiento-costo en su categoría. Al mismo tiempo, Mistral Large 3 se une a las filas de los modelos de código abierto de vanguardia ajustados por instrucciones.
Okara te permite usar más de 30 potentes modelos de IA de código abierto sin tener que lidiar con la configuración de infraestructura. Los mejores modelos como Kimi y DeepSeek son demasiado grandes para ejecutarlos en tu portátil, nosotros nos encargamos de eso por ti. Cambia entre modelos, busca en Google, Reddit, X, YouTube desde tus chats, analiza archivos, genera imágenes y trabaja con tu equipo. Todo está cifrado y nunca entrenamos con tus datos.
TranslateGemma es una nueva suite de modelos de traducción de IA abiertos basados en Gemma 3 de Google. Permite una comunicación de alta calidad en 55 idiomas, combinando una gran precisión con una eficiencia excepcional. Diseñada para funcionar en dispositivos móviles, locales y entornos en la nube sin comprometer el rendimiento.
We introduce PersonaPlex, a full-duplex conversational AI model that enables natural conversations with customizable voices and roles. PersonaPlex handles interruptions and backchannels while maintaining any chosen persona, outperforming existing systems on conversational dynamics and task adherence.
Loading comments…
Creador
moonbyte
Información del proyecto
Palabras clave del producto