A Xiaomi lançou MiMo-V2.6 Pro e Flash com foco em raciocínio, coding e agentes multimodais, além de publicar detalhes do treinamento por reinforcement learning.
A entrada da Xiaomi amplia a competição entre fornecedores de modelos multimodais e cria mais uma opção para times que avaliam custo, capacidade agentiva e implantação.
A Xiaomi apresentou a família MiMo-V2.6 com variantes Pro e Flash voltadas a tarefas de raciocínio, programação e uso agentivo. A documentação destaca treinamento em larga escala por reinforcement learning e suporte multimodal, com modelos posicionados para workloads que combinam texto, visão e ferramentas.
O release é relevante por ampliar a presença de um novo fornecedor em modelos de alta capacidade e por expor mais detalhes do pipeline de treinamento do que simples benchmarks de lançamento. Como os números de desempenho vêm principalmente do próprio fornecedor, eles devem ser tratados como referência inicial até haver avaliações independentes e comparações consistentes de custo por tarefa.
Acompanhar benchmarks independentes, disponibilidade por API e pesos, preços reais de inferência e diferenças práticas entre Pro, Flash e variantes futuras.
Outros posts sobre assuntos próximos ao que você acabou de ler.