#world-model

フィジカルAI(身体を持つAI/ロボティクス)の「world-model」に関する収集記録。記事7件・コミュニティ投稿0件。論文・企業発表・コミュニティの議論の要約を、出典リンクを添えて収集日順に並べています。

8/26水 · 昨日 · 4件
GigaAI、3.7万時間の身体データで学習した3システム構成の基盤モデルGigaBrain-0.7を公開

GigaAI、3.7万時間の身体データで学習した3システム構成の基盤モデルGigaBrain-0.7を公開

理解・予測・行動を3つのシステムで統合。Hugging Face Papersで64票と、ロボ系論文として目立つ支持を集めた。

arxiv.org
論文『WorldEcho / WorldSync』、ロボット世界モデルが「行動に従っていない」ことを診断し補正

論文『WorldEcho / WorldSync』、ロボット世界モデルが「行動に従っていない」ことを診断し補正

既存の行動条件付き世界モデルは専門家軌道は再現できるが、非専門家の行動では指令を無視するか破綻することを実測で示した。

arxiv.org
論文『GaussianWAM』、3Dガウス場を教師にWorld Action Modelへ幾何と意味を蒸留 LIBERO-Plusで52%→71%

論文『GaussianWAM』、3Dガウス場を教師にWorld Action Modelへ幾何と意味を蒸留 LIBERO-Plusで52%→71%

学習時だけ多視点から深度・カメラ・意味特徴をガウス場に束ね、WAMの表現に蒸留。推論時の構成は変えない。

arxiv.org
論文『LAWA』、World Action Modelの未来予測を潜在行動で代替し推論遅延を42.9%削減

論文『LAWA』、World Action Modelの未来予測を潜在行動で代替し推論遅延を42.9%削減

動画フレームを生成せず、圧縮した潜在行動を「未来の意図」として扱う。RoboCasa few-shotで65.6%とFast-WAM比+9.6pt。

arxiv.org
8/25火 · 3件
NVIDIA、「VLAを超えて」World Action Modelへの転換を提唱 Cosmos 3ベースの新方策を公開

NVIDIA、「VLAを超えて」World Action Modelへの転換を提唱 Cosmos 3ベースの新方策を公開

NVIDIAが動画世界モデル由来のWorld Action ModelをVLAの後継として提唱。RoboLabで28.1%→36.8%に改善。

developer.nvidia.com
NVIDIA、Jetson Thor向け4BパラメータのCosmos 3 Edgeを公開 オンデバイスでロボット制御

NVIDIA、Jetson Thor向け4BパラメータのCosmos 3 Edgeを公開 オンデバイスでロボット制御

Jetson Thor搭載ロボット向けに4BのCosmos 3 Edgeを公開。RoboLab120タスクで成功率22.9%。

developer.nvidia.com
論文『RISE』、World Action Modelの想像計算量を場面ごとに動的配分する手法を提案

論文『RISE』、World Action Modelの想像計算量を場面ごとに動的配分する手法を提案

World Action Modelの未来シミュレーション量を場面ごとに動的調整するRISEをNAVSIM/nuScenesで検証。

arxiv.org