An Thai Le
収録論文 9本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- CompliantWBC: 力潜在推定と残差インピーダンス目標による重量ヒューマノイドの全身コンプライアンス制御ヒューマノイド/全身制御2026/9/27
重量ヒューマノイドが任意部位への外力に柔軟に応じるため、全身インピーダンス参照と力推定・残差補正を組み合わせた強化学習制御手法を提案し、実機で荷物運搬や拭き掃除などを実現した。
- FOCA: 未来指向型条件付けによるデータ効率的な視覚言語行動適応VLA2026/6/18
視覚言語行動モデルの少数ショット模倣学習における性能低下を改善するため、未来の相互作用埋め込みと目標観察を活用した未来指向型条件付けフレームワークを提案した。
- 自己改善型VLAポリシー:スプリアスロバストなアクション平滑化のための選択的拡散ノイズVLA/ロバスト性2026/6/1
拡散ベースのVLAポリシーのテスト時ロバスト性を高めるため、拡散ノイズ空間を制御可能な自由度として利用し、スプリアスな視覚相関への依存を減らしつつ滑らかなアクションを生成するノイズ選択手法SDNを提案した。
- 視覚言語行動モデルのファインチューニングには、思っているより少ない層で十分であるVLA/モデル圧縮2026/6/1
大規模な視覚言語行動(VLA)モデルには層ごとの冗長性があることを発見し、学習不要の構造圧縮パイプラインを提案。冗長な層を除去してモデルを最大50%圧縮し、ファインチューニング時間を40-50%、推論時間を最大30%削減しつつ、性能はフルモデルと同等以上を達成した。
- EquiVLA: 回転同変ビジョン・言語・行動モデルのための汎用フレームワークVLA/操作2026/6/1
凍結した視覚言語バックボーンとフローマッチング拡散トランスフォーマー行動ヘッドを組み合わせた任意のアーキテクチャに適用可能な、エンドツーエンドのSO(2)同変VLAモデルの最初の汎用フレームワークを提案。回転に対する幾何学的帰納バイアスを導入し、データ効率と汎化性能を大幅に向上させた。
- RoboGaze:構造化視覚言語分析によるロボット世界モデルの評価評価2026/6/1
ロボット操作動画の生成品質を、マルチエージェントVLMを用いて構造化・解釈可能に評価するフレームワークを提案した論文。
- 接触リッチ操作のための超並列サンプリングベースMPCの実機展開マニピュレーション2026/6/1
JAXとMuJoCo MJXを用いたサンプリングベースMPCを実機Frankaに展開し、Push-Tタスクでモード切替を要する場合に既存手法より優れることを示した。また、オンラインのドメインランダム化の効果を評価した。
- 正しく始めて正しく着地:初期ノイズ選択による非同期実行ロボットポリシー/アクション・チャンキング2026/6/1
アクション・チャンキングの非同期実行時に生じるチャンク境界の不整合を、生成前の初期ノイズを適切に選ぶことで解決する学習不要の手法PAINTを提案。逆オイラー反転と再描画ルールで整合性を保ち、シミュレーションと実機で性能を向上させた。
- 制約付きガウス過程運動計画のためのStein変分ニュートン推論運動計画2025/4/1
硬い非線形制約を厳密に扱いつつベイズ事後分布を効率的に推論する、Stein変分法に基づく新しいガウス過程運動計画フレームワークを提案し、350タスクで98.57%の成功率を達成した。