Qwen3.7-Plus de Alibaba: evaluando el potencial de los agentes de IA multimodales
Un análisis del Qwen3.7-Plus de Alibaba, que examina sus capacidades agénticas, los requisitos de hardware para su despliegue local y las implicaciones de su licencia.
Modelos
Pesos, lanzamientos y la carrera por escalar
50 artículos en esta sección.
Un análisis del Qwen3.7-Plus de Alibaba, que examina sus capacidades agénticas, los requisitos de hardware para su despliegue local y las implicaciones de su licencia.
El Nemotron 3 Ultra de NVIDIA combina arquitecturas Mamba y Transformer para habilitar ventanas de contexto de 1M de tokens de forma eficiente para agentes empresariales de ejecución prolongada.
Un análisis de la arquitectura de 8B parámetros de MisoTTS, su implementación de RVQ y las implicaciones de su lanzamiento de pesos abiertos para el TTS local.
El nuevo modelo de 12B de Google apunta al hueco entre los modelos de 8B y 70B, ofreciendo altas capacidades de razonamiento para dispositivos con 16 GB de RAM.
Un análisis de las capacidades multimodales de Qwen3.7-Plus, las exigencias de VRAM de su motor de razonamiento y las implicaciones de su licencia para los desarrolladores.
Un análisis de las limitaciones de hardware y los desafíos de calidad de recuperación que enfrenta la ventana de contexto de un millón de tokens de MiniMax M3 para su despliegue local.
El nuevo modelo MoE de Liquid AI equilibra 8.3B de parámetros totales con 1.5B activos para optimizar la velocidad de inferencia local y el razonamiento.
Un análisis de la actualización de Claude Opus 4.8, que sostiene que los pequeños refinamientos en la controlabilidad y el precio no sustituyen a las ganancias reales de inteligencia.
Soro aprovecha Gemma 3 para ofrecer un LLM local y culturalmente matizado, especializado en tayiko, priorizando la eficiencia y la inferencia local frente a los modelos generalistas.
Un análisis de los costes de latencia y VRAM al utilizar el reranker Zerank-2 de 4B parámetros en pipelines RAG de producción.