Pular para o conteúdo
Zenteck
Últimas
Análise

Reka Rho-1: IA unifica texto, vídeo e robôs em uma única rede

Por Alex da Cruz2 min de leitura0 comentário
reka-rho-1-ia-unifica-texto-video-e-robos-em-uma-unica-rede
A

Alex da Cruz

Alex da Cruz é desenvolvedor full-stack em São Paulo. Trabalha com React, TypeScript e automação, e usa inteligência artificial no dia a dia para resolver problemas reais de código e de operação — não como demonstração. Já tocou uma operação de e-commerce de ponta a ponta e hoje constrói e mantém o pipeline de automação por trás deste blog. Escreve aqui sobre o que testa de fato.

Ver perfil →

Segundo o The Decoder, a Reka AI disponibilizou uma versão de pesquisa do Rho-1, um modelo com 19 bilhões de parâmetros focado em processar diferentes formatos de dados de forma nativa. Em vez de direcionar tarefas para modelos secundários especializados, o sistema executa texto, imagens, vídeo e ações robóticas como tokens compartilhados em uma única janela de contexto.

Como o Rho-1 controla robôs sem dados escassos de treinamento?

O treinamento de sistemas físicos costuma esbarrar na escassez de bases de dados específicas de movimento. Para resolver isso, a Reka AI aplicou um modelo de dinâmica inversa capaz de extrair sinais de controle diretamente de vídeos comuns da internet, usando os mesmos pesos que preveem pixels de câmera para guiar os robôs.

O que muda na prática para fluxos de automação?

Processar todas as modalidades na mesma rede neural elimina o tempo de espera gerado por chamadas de ferramentas e alternância entre APIs externas. Para quem desenvolve automações, isso significa gerar vídeo em tempo real e reagir a comandos dinâmicos sem precisar reiniciar o sistema ou orquestrar arquiteturas complexas.

A infraestrutura de treino exigiu 320 GPUs H100 operando por cerca de três meses, o que demonstra um consumo computacional consideravelmente menor do que o padrão exigido por grandes laboratórios para sistemas multimodais equivalentes.

Fontes

  1. Reka AI's omni-model Rho-1 handles text, images, video, and robot control in a single model — the-decoder.com

Perguntas frequentes

O que é o Reka Rho-1?
É um modelo ondimodal de 19 bilhões de parâmetros criado pela Reka AI para processar texto, imagens, vídeo e controle robótico em uma única rede neural.
Quanto tempo levou o treinamento do Rho-1?
Segundo o The Decoder, o modelo foi treinado em 320 GPUs H100 durante um período de aproximadamente três meses.