Reka Rho-1: IA unifica texto, vídeo e robôs em uma única rede

Alex da Cruz
Alex da Cruz é desenvolvedor full-stack em São Paulo. Trabalha com React, TypeScript e automação, e usa inteligência artificial no dia a dia para resolver problemas reais de código e de operação — não como demonstração. Já tocou uma operação de e-commerce de ponta a ponta e hoje constrói e mantém o pipeline de automação por trás deste blog. Escreve aqui sobre o que testa de fato.
Segundo o The Decoder, a Reka AI disponibilizou uma versão de pesquisa do Rho-1, um modelo com 19 bilhões de parâmetros focado em processar diferentes formatos de dados de forma nativa. Em vez de direcionar tarefas para modelos secundários especializados, o sistema executa texto, imagens, vídeo e ações robóticas como tokens compartilhados em uma única janela de contexto.
Como o Rho-1 controla robôs sem dados escassos de treinamento?
O treinamento de sistemas físicos costuma esbarrar na escassez de bases de dados específicas de movimento. Para resolver isso, a Reka AI aplicou um modelo de dinâmica inversa capaz de extrair sinais de controle diretamente de vídeos comuns da internet, usando os mesmos pesos que preveem pixels de câmera para guiar os robôs.
O que muda na prática para fluxos de automação?
Processar todas as modalidades na mesma rede neural elimina o tempo de espera gerado por chamadas de ferramentas e alternância entre APIs externas. Para quem desenvolve automações, isso significa gerar vídeo em tempo real e reagir a comandos dinâmicos sem precisar reiniciar o sistema ou orquestrar arquiteturas complexas.
A infraestrutura de treino exigiu 320 GPUs H100 operando por cerca de três meses, o que demonstra um consumo computacional consideravelmente menor do que o padrão exigido por grandes laboratórios para sistemas multimodais equivalentes.
Fontes
Perguntas frequentes
- O que é o Reka Rho-1?
- É um modelo ondimodal de 19 bilhões de parâmetros criado pela Reka AI para processar texto, imagens, vídeo e controle robótico em uma única rede neural.
- Quanto tempo levou o treinamento do Rho-1?
- Segundo o The Decoder, o modelo foi treinado em 320 GPUs H100 durante um período de aproximadamente três meses.
Comentários
0 comentário
Seja o primeiro a comentar.
Continue Lendo

Big techs assinam acordo voluntário de supervisão de IA nos EUA
Grandes empresas de tecnologia assinaram um código voluntário de supervisão de IA nos EUA, focado em segurança e infraestrutura.

Investigação da FTC: o que muda para quem usa IA
A investigação da FTC sobre grandes laboratórios de IA eleva os riscos regulatórios e exige maior controle sobre o uso de agentes autônomos nas empresas.

Meta Muse: o conflito de privacidade no Mac
A Meta contesta relato de que o agente Muse leu mensagens sem permissão, apontando camadas de segurança do macOS.