Dernières actualités
Guide Houdini Solaris et USD : organisez vos scènes d’architecture en couchesCréer une vidéo d’architecture avec Gemini Omni Flash : guide pas à pasUn bâtiment de 19 étages dévoilé pour le siège d’Itaú CulturalGuide pour créer une animation de présentation architecturale avec les scènes SketchUpGuide du MCP Connector pour 3ds Max : workflows de scène avec un agent IAOpenAI va filigraner certains textes ChatGPT et Codex dans l’UEReka AI présente Rho-1 : texte, image, vidéo et contrôle robotique réunisCréer des visuels d’architecture avec Nano Banana 2 : guide de rédaction de promptsURP 2026 Design + AI Hackathon : concevoir du mobilier transformableRBF Nodes pour Blender : des contrôles de rig complexes avec des drivers
Modèles d’IAReka AIRho-1

Reka AI présente Rho-1 : texte, image, vidéo et contrôle robotique réunis

Reka AI a publié l’aperçu de recherche de Rho-1, un modèle qui réunit le texte, les images, la vidéo et le contrôle robotique au sein d’un seul réseau neuronal. Doté de 19 milliards de paramètres, il peut générer des vidéos en temps réel et répondre à de nouvelles instructions pendant leur diffusion.

Dans un studio d’architecture, une idée d’IA multimodale associant flux visuel et matériel robotiqueImage IA
Image d’illustration générée par IA.Image : 3dsınıfı / FCA AI

En bref

  1. Rho-1 traite le texte, les images, la vidéo et les actions de contrôle robotique au sein d’un même modèle.
  2. Le modèle ne fait pas appel à des modèles externes ni à des appels d’outils pour les différentes tâches ; il traite toutes les modalités dans une fenêtre de contexte commune.
  3. Reka AI a entraîné Rho-1 pendant environ trois mois sur 320 GPU H100.
  4. Face au manque de données d’entraînement en robotique, l’entreprise a développé un modèle de dynamique inverse qui extrait des signaux de contrôle de vidéos disponibles sur Internet.

Reka AI a publié le 5 octobre 2026 l’aperçu de recherche de son modèle multimodal Rho-1. Ce nouveau modèle de l’entreprise peut traiter et générer du texte, des images, de la vidéo et des actions de contrôle robotique au sein d’un seul réseau neuronal de 19 milliards de paramètres. Selon The Decoder, au lieu de répartir les tâches entre différents modèles spécialisés, Rho-1 traite toutes les modalités dans une fenêtre de contexte commune.

Qu’est-ce qui distingue Rho-1 ?

Alors que de nombreux systèmes multimodaux font appel à des modèles distincts ou à des appels d’outils pour des tâches spécifiques, Rho-1 représente toutes les modalités au sein d’un même modèle. Selon l’article de The Decoder, le système ne fait pas appel à des modèles externes et n’utilise pas d’appels d’outils pour accomplir les tâches. Le texte, les images, la vidéo et les mouvements robotiques relèvent ainsi tous d’un seul modèle.

Reka AI indique que le modèle peut générer des vidéos sans interruption et fonctionner en temps réel. Sa capacité à répondre aux nouvelles instructions pendant la diffusion figure également parmi les fonctionnalités annoncées. Il est possible de l’orienter vers une nouvelle demande sans devoir relancer la génération vidéo depuis le début. L’article source ne précise pas dans quels scénarios d’utilisation ni selon quelles limites de performance ces fonctionnalités sont disponibles.

Comment Rho-1 apprend-il les mouvements robotiques ?

Les mêmes poids de Rho-1 servent à prédire des images de caméra et à piloter des mouvements robotiques. En raison du manque de données d’entraînement pour le contrôle robotique, Reka AI a créé un modèle de dynamique inverse qui extrait des signaux de contrôle de vidéos ordinaires disponibles sur Internet.

L’entreprise a entraîné Rho-1 pendant environ trois mois à l’aide de 320 GPU H100. Cette information donne une idée de l’ampleur du développement du modèle, mais ne précise ni le matériel nécessaire pour utiliser l’aperçu ni les configurations sur lesquelles le modèle pourra fonctionner. L’article ne donne pas non plus de détails sur les conditions d’accès, les tarifs ou le calendrier de mise à disposition générale.

Ce que cela signifie pour les flux de travail en architecture et en visualisation

En architecture, en design d’intérieur et en archviz, la réunion des capacités de traitement du texte, des images et de la vidéo dans un même modèle pourrait renforcer l’intérêt pour les outils capables de traiter différents types de contenus. La génération vidéo en temps réel et la possibilité de répondre à de nouvelles instructions pendant la diffusion ouvrent des perspectives de travail interactif sur des contenus visuels animés. Toutefois, la conception architecturale et la visualisation ne figurent pas parmi les usages cités spécifiquement par Reka AI ; les informations disponibles ne suffisent donc pas à conclure que le modèle contribue directement aux flux de travail actuels.

Pour les bureaux et les équipes de visualisation, les points à suivre seront la disponibilité du modèle, les conditions de licence et d’utilisation, les exigences matérielles et la possibilité d’exploiter les résultats avec les outils existants. L’article source ne fournit aucun détail sur ces sujets. Pour l’instant, Rho-1 doit donc être considéré non comme un outil de production dont l’efficacité en architecture a été vérifiée, mais comme un aperçu de recherche portant sur une approche qui réunit texte, image, vidéo et contrôle robotique dans un même système.

Sources

1 source
TD
The Decoderthe-decoder.com/reka-ais-omni-model-rho-1-handles-text-images-video-and-robot-control-in-a-single-model
Résumé

Les textes sources ne sont pas republiés ; les courtes citations sont signalées, le reste est notre propre résumé et commentaire.

L’avis de 3dsınıfı
3dL’analyse de la rédaction

Le point marquant de Rho-1 est qu’il associe, dans un même modèle, la génération de texte et d’images à la vidéo en temps réel et au contrôle robotique. Cette approche pourrait ouvrir la voie à des outils où la génération de contenus visuels et l’interaction sont moins dissociées, mais aucun exemple d’utilisation directe en architecture ou en archviz n’a encore été présenté.

Pour les bureaux en Turquie, les informations sur l’accès, les licences, les tarifs et le matériel, nécessaires pour prendre une décision aujourd’hui, n’ont pas été communiquées. Il est donc plus judicieux de suivre la portée de l’aperçu et les annonces concernant ces conditions que d’intégrer dès maintenant le modèle à un flux de production existant. Il faudra notamment voir comment les capacités annoncées de génération vidéo et de réponse instantanée aux instructions se comportent dans de véritables tâches de conception.

Questions fréquentes

Quels types de données Reka AI Rho-1 traite-t-il ?

Le modèle peut traiter et générer du texte, des images, de la vidéo et des actions de contrôle robotique au sein d’un même réseau neuronal.

Quand Rho-1 a-t-il été publié ?

Reka AI a publié l’aperçu de recherche de Rho-1 le 5 octobre 2026.

Le prix et les exigences matérielles de Rho-1 ont-ils été annoncés ?

L’article source ne précise ni le prix, ni les conditions d’accès, ni les exigences matérielles côté utilisateur.

Les commentaires et le forum sont en turc.Rejoindre la discussion
+

À lire aussi