<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>Alibaba on SoloSoft</title><link>https://www.solosoft.dev/es/tags/alibaba/</link><description>Recent content in Alibaba on SoloSoft</description><generator>Hugo</generator><language>es-es</language><atom:link href="https://www.solosoft.dev/es/tags/alibaba/index.xml" rel="self" type="application/rss+xml"/><item><title>AgentScope: El Framework Multi-Agente Open-Source de Alibaba para Agentes de IA Transparentes</title><link>https://www.solosoft.dev/es/post/agentscope-framework-2026/</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://www.solosoft.dev/es/post/agentscope-framework-2026/</guid><description>&lt;p&gt;Construir sistemas multi-agente de grado de produccion es notoriamente complejo. Coordinar la comunicacion entre agentes, gestionar despliegues distribuidos, integrarse con herramientas externas y garantizar la observabilidad son desafios que la mayoria de los frameworks abordan solo parcialmente. &lt;strong&gt;AgentScope&lt;/strong&gt;, desarrollado por el Tongyi Lab de Alibaba, aborda estos desafios con un framework integral disenado para aplicaciones multi-agente del mundo real y escalables.&lt;/p&gt;
&lt;p&gt;AgentScope se distingue por su enfoque en la transparencia y controlabilidad. Cada proceso de toma de decisiones del agente es observable, cada mensaje puede ser inspeccionado y todo el sistema puede configurarse mediante especificaciones declarativas. Esto lo hace adecuado para aplicaciones empresariales donde la auditabilidad y la fiabilidad son primordiales.&lt;/p&gt;</description></item><item><title>Animate Anyone: Animación de Personajes Impulsada por IA desde Imágenes Únicas</title><link>https://www.solosoft.dev/es/post/animate-anyone-character-2026/</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://www.solosoft.dev/es/post/animate-anyone-character-2026/</guid><description>&lt;p&gt;&lt;strong&gt;Animate Anyone&lt;/strong&gt; es un proyecto de investigación del grupo HumanAIGC de Alibaba que convierte una sola foto en un video completamente animado de una persona caminando, bailando o realizando cualquier secuencia de poses, preservando la identidad, vestimenta y apariencia del personaje con una fidelidad notable. Representa una de las aplicaciones más impresionantes de &lt;strong&gt;síntesis de imagen a video&lt;/strong&gt; utilizando modelos de difusión.&lt;/p&gt;
&lt;p&gt;El desafío técnico central que resuelve es la &lt;strong&gt;consistencia temporal con preservación de identidad&lt;/strong&gt;. Los enfoques anteriores sufrían de parpadeo, deriva de apariencia y pérdida de detalles finos. La innovación de Animate Anyone es una arquitectura de difusión guiada por referencia que inyecta características de apariencia de la imagen de entrada en cada fotograma del video generado en múltiples escalas.&lt;/p&gt;</description></item><item><title>CosyVoice: Modelo de Generacion de Voz Multilingue Open-Source de Alibaba con 20K Estrellas</title><link>https://www.solosoft.dev/es/post/cosyvoice-tts-2026/</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://www.solosoft.dev/es/post/cosyvoice-tts-2026/</guid><description>&lt;p&gt;La tecnologia de generacion de voz ha visto un progreso notable, pero la mayoria de los modelos open-source de texto a voz (TTS) aun luchan con una compensacion fundamental: calidad versus cobertura de idiomas. &lt;strong&gt;CosyVoice&lt;/strong&gt;, desarrollado por el equipo &lt;a href="https://github.com/FunAudioLLM/CosyVoice"&gt;FunAudioLLM&lt;/a&gt; de Alibaba, rompe esta barrera ofreciendo generacion de voz de calidad de produccion en 9 idiomas y mas de 18 dialectos chinos.&lt;/p&gt;
&lt;p&gt;Con mas de 20,000 estrellas en GitHub, CosyVoice se ha convertido en una solucion de referencia para desarrolladores e investigadores que necesitan sintesis de voz multilingue con capacidades avanzadas como clonacion de voz zero-shot, control de emociones y generacion guiada por instrucciones. A diferencia de las APIs comerciales de TTS que cobran por caracter y limitan la personalizacion, CosyVoice es completamente open-source y auto-alojable.&lt;/p&gt;</description></item><item><title>Higress: El Gateway de IA Cloud-Native de Alibaba Construido sobre Istio y Envoy</title><link>https://www.solosoft.dev/es/post/higress-ai-gateway-2026/</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://www.solosoft.dev/es/post/higress-ai-gateway-2026/</guid><description>&lt;p&gt;A medida que las aplicaciones de IA pasan de prototipos a produccion, la capa de infraestructura para gestionar el trafico de API LLM se ha vuelto critica. Las organizaciones necesitan enrutar solicitudes al modelo correcto, controlar costos con limitacion de tasa a nivel de token, cachear respuestas inteligentemente y monitorear el uso entre equipos y aplicaciones. &lt;strong&gt;Higress&lt;/strong&gt; aborda todas estas necesidades como un gateway de IA cloud-native construido sobre Istio y Envoy.&lt;/p&gt;
&lt;p&gt;Desarrollado por Alibaba, Higress extiende el concepto tradicional de API gateway con capacidades nativas de IA. Comprende la semantica de las solicitudes LLM &amp;ndash; tokens, modelos, respuestas en streaming y estructuras de prompts.&lt;/p&gt;</description></item><item><title>Marco-o1: Modelo de Razonamiento Grande de Codigo Abierto de Alibaba para Soluciones del Mundo Real</title><link>https://www.solosoft.dev/es/post/marco-o1-reasoning-model-2026/</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://www.solosoft.dev/es/post/marco-o1-reasoning-model-2026/</guid><description>&lt;p&gt;La carrera por construir maquinas que puedan razonar &amp;ndash; no solo hacer coincidencia de patrones &amp;ndash; ha definido la vanguardia de la inteligencia artificial desde la aparicion de los grandes modelos de lenguaje. Mientras que los sistemas propietarios como la serie o1 de OpenAI han demostrado cadenas de razonamiento impresionantes, la comunidad de codigo abierto ha esperado durante mucho tiempo una alternativa comparable. Presentamos &lt;strong&gt;Marco-o1&lt;/strong&gt;: un modelo de razonamiento grande de codigo abierto del equipo MarcoPolo de AIDC-AI de Alibaba que ofrece razonamiento estructurado de multiples pasos tanto para problemas cerrados como abiertos.&lt;/p&gt;
&lt;p&gt;Construido sobre la base de Qwen2-7B-Instruct, Marco-o1 representa una desviacion deliberada de los modelos optimizados unicamente para puntos de referencia estandarizados. El equipo de AIDC-AI lo diseno para abordar los problemas desordenados y ambiguos que caracterizan la implementacion en el mundo real &amp;ndash; desde la optimizacion logıstica hasta la planificacion creativa &amp;ndash; mientras mantiene el modelo completamente abierto y accesible para la comunidad de investigacion global.&lt;/p&gt;</description></item><item><title>MNN: El Motor de Inferencia Ligero Ultrarrrapido de Alibaba para IA Movil y de Borde</title><link>https://www.solosoft.dev/es/post/mnn-mobile-inference-2026/</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://www.solosoft.dev/es/post/mnn-mobile-inference-2026/</guid><description>&lt;p&gt;Ejecutar modelos de deep learning en dispositivos moviles y de borde presenta desafios unicos: potencia de computo limitada, memoria restringida, sensibilidad de bateria y diversas arquitecturas de hardware. &lt;strong&gt;MNN&lt;/strong&gt; (Mobile Neural Network) es la respuesta de Alibaba a estos desafios, un motor de inferencia ligero que lleva IA al borde con minima sobrecarga y maximo rendimiento.&lt;/p&gt;
&lt;p&gt;MNN impulsa mas de 30 aplicaciones de Alibaba, incluyendo Taobao (e-commerce), Youku (streaming de video) y varias herramientas empresariales. Ha sido probado en batalla a escala de miles de millones de usuarios, manejando desde vision artificial en tiempo real hasta LLMs en el dispositivo.&lt;/p&gt;</description></item><item><title>Pixelle-MCP: Solucion AIGC Multimodal Open-Source que Une ComfyUI y LLMs via MCP</title><link>https://www.solosoft.dev/es/post/pixelle-mcp-multimodal-2026/</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://www.solosoft.dev/es/post/pixelle-mcp-multimodal-2026/</guid><description>&lt;p&gt;El Protocolo de Contexto de Modelo (MCP) esta remodelando como se comunican las aplicaciones de IA, pero la mayoria de las herramientas MCP permanecen estrechamente enfocadas en consultas de texto y datos. &lt;strong&gt;Pixelle-MCP&lt;/strong&gt; rompe esa limitacion al convertir ComfyUI &amp;ndash; el motor de flujo de trabajo visual mas popular para contenido generado por IA &amp;ndash; en un servidor MCP multimodal completo. Desarrollado por el equipo AIDC-AI de Alibaba, esta solucion de codigo abierto permite que cualquier cliente compatible con MCP invoque tuberıas AIGC complejas para imagenes, sonido, video y texto usando lenguaje natural.&lt;/p&gt;
&lt;p&gt;La idea central detras de Pixelle-MCP es elegante: en lugar de construir capacidades de generacion multimodal desde cero, reutiliza el vasto ecosistema de flujos de trabajo construidos por la comunidad de ComfyUI como herramientas invocables por MCP. Cualquier persona que haya disenado una tuberıa de ComfyUI para stable diffusion, generacion de audio o sıntesis de video ahora puede exponer ese flujo de trabajo a cualquier cliente LLM como una API simple, con cero codigo adicional.&lt;/p&gt;</description></item><item><title>Qwen Code: El Agente de IA de Codigo Abierto de Alibaba para la Terminal</title><link>https://www.solosoft.dev/es/post/qwen-code-cli-2026/</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://www.solosoft.dev/es/post/qwen-code-cli-2026/</guid><description>&lt;p&gt;Qwen Code es un agente de terminal de IA de codigo abierto desarrollado por el equipo &lt;a href="https://github.com/QwenLM/qwen-code"&gt;QwenLM&lt;/a&gt; de Alibaba Cloud. Construido desde cero para el entorno de terminal, Qwen Code proporciona una experiencia de codificacion interactiva al estilo Claude Code optimizada para la familia de modelos Qwen de Alibaba, mientras mantiene compatibilidad con modelos de OpenAI, Anthropic, Google y otros a traves de un sistema multiprotocolo de proveedores.&lt;/p&gt;
&lt;p&gt;El agente esta disenado para sentirse como una extension natural del flujo de trabajo de terminal del desarrollador. Opera en el mismo entorno shell, tiene acceso al sistema de archivos, puede ejecutar comandos, editar archivos, crear proyectos y gestionar flujos de trabajo git &amp;ndash; todo a traves de interaccion en lenguaje natural. Con soporte para flujos de trabajo agenciales que descomponen tareas complejas, subagentes para ejecucion paralela e integracion con IDE via VS Code y JetBrains, Qwen Code se posiciona como una alternativa versatil de codigo abierto a los asistentes de codificacion propietarios.&lt;/p&gt;</description></item><item><title>Qwen2.5-Omni: El Modelo de IA Multimodal de Extremo a Extremo de Alibaba</title><link>https://www.solosoft.dev/es/post/qwen25-omni-multimodal-2026/</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://www.solosoft.dev/es/post/qwen25-omni-multimodal-2026/</guid><description>&lt;p&gt;Qwen2.5-Omni es el modelo de IA multimodal de codigo abierto insignia de Alibaba, desarrollado por el equipo &lt;a href="https://github.com/QwenLM/Qwen2.5-Omni"&gt;QwenLM&lt;/a&gt; de Alibaba Cloud. Como un unico modelo de extremo a extremo, Qwen2.5-Omni puede percibir y comprender entradas de texto, imagenes, audio y video simultaneamente, mientras genera tanto texto en transmision como voz natural &amp;ndash; todo dentro de una arquitectura unificada.&lt;/p&gt;
&lt;p&gt;El modelo introduce varias innovaciones arquitectonicas, siendo la mas notable la arquitectura Thinker-Talker, que separa el razonamiento de la generacion de voz mientras mantiene un acoplamiento estrecho entre ambos. Con la introduccion de TMRoPE (Incrustacion Posicional Rotatoria Multimodal Sincronizada en el Tiempo), Qwen2.5-Omni logra una alineacion temporal precisa entre modalidades, permitiendo tareas como descripcion de video en tiempo real, respuesta audiovisual a preguntas e interpretacion simultanea.&lt;/p&gt;</description></item><item><title>VACE: El Modelo Todo-en-Uno de Creacion y Edicion de Video de Alibaba (ICCV 2025)</title><link>https://www.solosoft.dev/es/post/vace-video-creation-2026/</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://www.solosoft.dev/es/post/vace-video-creation-2026/</guid><description>&lt;p&gt;La generacion y edicion de video han sido manejadas tradicionalmente por modelos separados &amp;ndash; un modelo para texto-a-video, otro para estilizacion de video, otro para inpainting. Esta fragmentacion dificulta la construccion de pipelines integrales de produccion de video. &lt;strong&gt;VACE&lt;/strong&gt; (Video All-to-All Creation and Editing) elimina este problema unificando todas las tareas de creacion y edicion de video en un unico modelo de transformador de difusion.&lt;/p&gt;
&lt;p&gt;Aceptado en ICCV 2025, VACE es obra del Tongyi Lab de Alibaba. La idea clave detras de VACE es que las tareas de creacion y edicion de video comparten una estructura subyacente comun: todas implican generar o modificar contenido de video basado en alguna combinacion de fotogramas de referencia, descripciones de texto e informacion de mascara.&lt;/p&gt;</description></item></channel></rss>