Lar
A Xiaomi torna público o processo completo pós-treinamento para um modelo VLA de alta precisão
A Xiaomi revelou o processo completo pós-treinamento de seu grande modelo de linguagem visual e ação (VLA), o Xiaomi-Robotics-0, tornando-o de código aberto para aplicações no mundo real. Essa iniciativa representa um avanço significativo nos esforços da Xiaomi em inteligência incorporada, projetada para ajudar os robôs a aprender habilidades operacionais complexas de forma eficiente com o mínimo de dados.
Dominando a tarefa “Agulha no Palha” em 20 horas
Com base em um treinamento prévio, a equipe de pesquisa utilizou apenas 20 horas de dados específicos da tarefa para o pós-treinamento do robô real. Isso permitiu que o robô executasse a manobra desafiadora de inserir fones de ouvido com precisão em um estojo. A tarefa exige excepcional precisão de percepção espacial e deve compensar o deslocamento causado por superfícies com atrito extremamente baixo.
O modelo alcança alinhamento com tolerâncias submilimétricas e pode corrigir desvios de ação em tempo real. Essa execução suave e contínua destaca o forte potencial do Xiaomi-Robotics-0 para operações de montagem de alta precisão.

Ecossistema de código aberto acelera a produtividade
Para transformar este modelo em uma ferramenta prática e pronta para uso, a Xiaomi disponibilizou em código aberto não apenas os pesos do modelo, mas também o relatório técnico e o código-fonte completo. Este lançamento abrangente e de ponta a ponta reduz significativamente a barreira de entrada para desenvolvedores que exploram a inteligência incorporada.
O modelo já demonstrou forte desempenho nos principais benchmarks internacionais, figurando entre os mais baixados globalmente. Ao abrir o processo pós-treinamento, a Xiaomi permite que desenvolvedores em todo o mundo refinem colaborativamente a percepção robótica e a lógica de execução, acelerando a integração de robôs com IA na produção do mundo real e na vida cotidiana.
Site do projeto: https://robotics.xiaomi.com/xiaomi-robotics-0.html
Código-fonte aberto: https://github.com/XiaomiRobotics/Xiaomi-Robotics-0
Artigo relacionado
CEO da DeepMind, Hassabis: Durmo seis horas por dia, geralmente me sinto energético por volta da 1h
O Fortune recentemente publicou uma entrevista com Demis Hassabis, CEO da Google DeepMind, revelando sua abordagem incomum para descanso e produtividade. Hassabis revelou que dorme muito pouco, estruturando suas horas acordadas em dois blocos de trab
OpenAI e Anthropic disputam participação no mercado, apesar da queda na receita
Apesar de relatos recentes sugerirem que a OpenAI não atingiu suas metas de receita, o que gerou pressão sobre as ações do setor de tecnologia nesta terça-feira, os investidores privados em laboratóri
Conformidade com a regulamentação de veículos autônomos na Califórnia: uma nova era de multas, geocercas e 1 milhão de milhas
A Guident opera um veículo de transporte da AuveTech no sul da Flórida, administrando uma rota de quatro milhas em West Palm Beach e uma rota de uma milha em Boca Raton por meio de sua tecnologia de m
Recomendações de tópicos especiais relacionados
Comentários (0)
A Xiaomi revelou o processo completo pós-treinamento de seu grande modelo de linguagem visual e ação (VLA), o Xiaomi-Robotics-0, tornando-o de código aberto para aplicações no mundo real. Essa iniciativa representa um avanço significativo nos esforços da Xiaomi em inteligência incorporada, projetada para ajudar os robôs a aprender habilidades operacionais complexas de forma eficiente com o mínimo de dados.
Dominando a tarefa “Agulha no Palha” em 20 horas
Com base em um treinamento prévio, a equipe de pesquisa utilizou apenas 20 horas de dados específicos da tarefa para o pós-treinamento do robô real. Isso permitiu que o robô executasse a manobra desafiadora de inserir fones de ouvido com precisão em um estojo. A tarefa exige excepcional precisão de percepção espacial e deve compensar o deslocamento causado por superfícies com atrito extremamente baixo.
O modelo alcança alinhamento com tolerâncias submilimétricas e pode corrigir desvios de ação em tempo real. Essa execução suave e contínua destaca o forte potencial do Xiaomi-Robotics-0 para operações de montagem de alta precisão.

Ecossistema de código aberto acelera a produtividade
Para transformar este modelo em uma ferramenta prática e pronta para uso, a Xiaomi disponibilizou em código aberto não apenas os pesos do modelo, mas também o relatório técnico e o código-fonte completo. Este lançamento abrangente e de ponta a ponta reduz significativamente a barreira de entrada para desenvolvedores que exploram a inteligência incorporada.
O modelo já demonstrou forte desempenho nos principais benchmarks internacionais, figurando entre os mais baixados globalmente. Ao abrir o processo pós-treinamento, a Xiaomi permite que desenvolvedores em todo o mundo refinem colaborativamente a percepção robótica e a lógica de execução, acelerando a integração de robôs com IA na produção do mundo real e na vida cotidiana.
Site do projeto: https://robotics.xiaomi.com/xiaomi-robotics-0.html
Código-fonte aberto: https://github.com/XiaomiRobotics/Xiaomi-Robotics-0
CEO da DeepMind, Hassabis: Durmo seis horas por dia, geralmente me sinto energético por volta da 1h
O Fortune recentemente publicou uma entrevista com Demis Hassabis, CEO da Google DeepMind, revelando sua abordagem incomum para descanso e produtividade. Hassabis revelou que dorme muito pouco, estruturando suas horas acordadas em dois blocos de trab
OpenAI e Anthropic disputam participação no mercado, apesar da queda na receita
Apesar de relatos recentes sugerirem que a OpenAI não atingiu suas metas de receita, o que gerou pressão sobre as ações do setor de tecnologia nesta terça-feira, os investidores privados em laboratóri











