カテゴリーの定義
視覚・言語・行動(VLA)モデルは視覚情報と言語指示からロボットの動作を生成します。
RoboAtlas
視覚・言語・行動モデルの公開バージョン、チェックポイント、ロボット互換性、ライセンスと評価根拠を比較できます。
視覚・言語・行動(VLA)モデルは視覚情報と言語指示からロボットの動作を生成します。
公開バージョンが VLA に分類されているモデルファミリーを収録します。他の Embodied AI 分類は別に掲載します。
詳細ページでバージョン、行動空間、チェックポイント、ライセンス、互換性と評価根拠を比較できます。
VLA 分類は汎用能力の証明ではありません。学習データ、必要ハードウェアや評価条件が非公開の場合があります。
13 件の公開 VLA モデルファミリー
カタログ最終更新: 2026年9月28日
VLA カタログで公開バージョンを選び、文書化された能力と情報源を比較してください。
VLA モデルを見る