Bem-vindo cliente!
mechb2bNotícias da indústriaRobôs VTLA lança primeiro modelo tátil corporal e primeiros conjuntos de dados multimodais visuais
  Crie um ecossistema de inteligência táctil completo, desde a percepção táctil, a coleta de dados até a inteligência física
O robô X-TouchMind lançou oficialmente o X-TouchMind V1, o primeiro modelo VTLA de toque físico, e o TacVerse 1k, o primeiro conjunto de dados multimodais de toque físico para interações físicas reais.
Este lançamento marca a conclusão do sistema de hardware táctil, o sistema de coleta de dados e a construção de um ecossistema tecnológico completo de ativos de dados e modelos pessoais, impulsionando ainda mais a evolução da inteligência táctil da capacidade de percepção para a capacidade de inteligência do robô.
  01 Próximo nível de inteligência corporal: da complementaridade modal ao toque nativo
À medida que os robôs se movem para aplicações do mundo real, é difícil confiar apenas na tecnologia visual para atender às necessidades de tarefas complexas. Mas a informação táctil complementar, que muitas vezes passa por caminhos de junta para se integrar ao modelo físico existente, limita o limite superior da capacidade de interação física.
Diante deste ponto do cartão da indústria, Qishu acredita que o toque é o modelo chave para os robôs realmente entrar no mundo físico e deve ser construído em toda a pilha em torno de cenários reais de contato forte com base na ecologia nativa.
Isso permite que os robôs não apenas percebam o mundo, mas também compreendam e executem tarefas físicas complexas de forma estável.
  02 X-TouchMind V1: o primeiro modelo VTLA com toque corporal
O X-TouchMind V1 é um modelo táctil corporal VTLA baseado em treinamento multimodal de dados visuais e táctiis.
O X-TouchMind V1 concentra-se mais no estado físico após o contato, unificando a visão, a linguagem, o tacto, o movimento e o estado do corpo do robô, permitindo modelagem colaborativa desde a compreensão da tarefa, a geração de movimentos até o controle do feedback do contato.
O modelo usa uma arquitetura hierárquica que corresponde a diferentes níveis de operação de robôs reais:
Sistema 2: A camada de compreensão e raciocínio semântico da tarefa é responsável pela compreensão do ambiente, dos objetivos da tarefa e das instruções linguísticas para responder o que fazer.
Sistema 1: geração de movimentos e camada de planejamento de trajetória, gerando caminhos de movimentos com base na visão, na semântica da tarefa e no estado do robô, respondendo "como fazer".
Sistema 0: camada de controle de interação táctil-ontológica, usando o feedback táctil e ontológico para correção de alta frequência em contato real, respondendo "Como manter a estabilidade e a precisão após o contato"
Através dessa arquitetura, o X-TouchMind V1 não só gera sequências de movimentos, mas também compreende deslizamento, força, deformação, textura e estabilidade de contato em operações reais e corrige movimentos dinamicamente, aumentando a estabilidade do robô em tarefas como manipulação fina, manipulação flexível de materiais e inspeção inteligente.
Para tarefas ricas em contato, como discar, puxar, compactar, inserir, colocar, recuperar, etc., o objetivo do X-TouchMind V1 não é permitir que o robô faça uma demonstração de movimento, mas que o robô "faça o seu trabalho" de forma estável, confiável e sem danos em interações físicas complexas.
  03TacVerse 1k: o primeiro conjunto de dados multimodal visual táctil de alta qualidade de 1.000 horas
Lançado em simultâneo com o X-TouchMind V1, o TacVerse 1k é o primeiro conjunto de dados multimodal visual táctil de alta qualidade de 1.000 horas para interações físicas reais.
No lado da aquisição de dados, o TacVerse 1k baseia-se no sistema de hardware de aquisição auto-desenvolvido para desacoplar a produção de dados do corpo do robô, permitindo desacoplamento de capacidade, desacoplamento de cena e reutilização do corpo. Com base neste sistema, os custos de coleta de dados podem ser reduzidos em mais de 80% e a eficiência aumenta de 3 a 5 vezes, proporcionando a base para a precipitação de dados em interações reais em grande escala.
No lado da qualidade dos dados, o XTacFlow é responsável pela unificação dos links de aquisição agendados, suportando acesso unificado a vários dispositivos, alinhamento de tempo intermodal em milissegundos e automatizando mais de 90% do retorno e pós-processamento de dados, transformando dados multimodais originais em amostras de dados e ativos de treinamento treináveis, rastreáveis e reutilizáveis.
A estrutura de dados TacVerse 1k é nativamente compatível com os principais formatos de dados robóticos, como LeRobot, MCAP, HDF5 e ROS2, e padroniza campos de expansão de modo táctil para que os dados não sejam apenas disponíveis internamente, mas também sejam baseados em compartilhamento, reutilização e alinhamento da indústria.
De acordo com o lançamento planejado, o primeiro conjunto de dados de 100 horas do TacVerse 1k estará disponível em 30 de julho, cobrindo mais de 40 cenas reais; A partir de agosto, os pedidos de dados de 1.000 horas serão abertos em lotes e a colaboração aberta será promovida através de plataformas como Arizona Tower e Hugging Face.
  Orientado para missões reais da indústria, impulsionando a escala da inteligência física
O lançamento simultâneo do X-TouchMind V1 com o TacVerse 1k marca o início oficial de uma nova fase na indústria.
Em seguida, a Qinxu se concentrará na montagem de precisão industrial, montagem de eletrônicos de consumo, logística flexível, inspeção de qualidade inteligente, autenticação de bens de consumo e construção de centros de dados, etc.
“Esperamos que o lançamento do X-TouchMind V1 e do TacVerse 1k continuem a fornecer valor à indústria, abrindo uma nova fase de “natividade táctil”. ”
No futuro, a empresa continuará a impulsionar a iteração tecnológica e a exploração teórica em torno de “nativos ao toque” e “cenários reais” para avançar com a indústria.
  O robô X-TouchMind V1 lança o primeiro modelo VTLA com toque corporal e o primeiro conjunto de dados multimodal TacVerse 1k
Últimas Notícias