Ian Chuang
収録論文 7本 ・ フィジカルAI/ロボット学習
視覚RLVLAマニピュレーションナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 報酬で視線を導く:リターン誘導コントラスト学習による視覚的注意の形成視覚RL2025/10/1
人間の中心窩視に着想を得て、リターンの差を自己教師信号として視覚RLエージェントに学習可能な注意機構を組み込み、サンプル効率を最大2.52倍改善した研究。
- 視覚言語行動モデルを内部表現から解釈・制御する機構的解釈可能性フレームワークVLA2025/9/1
VLAモデルの内部活性をトークン埋め込み基底に射影し、速度や方向などの意味的方向を同定して、微調整なしにリアルタイムで行動を制御する手法を提案した。
- VITA: 視覚から行動へのフローマッチングポリシーVLA2025/7/1
視覚表現から直接潜在行動へ流すノイズ・条件付け不要のフローマッチング方策を提案し、行動オートエンコーダとフロー潜在デコーディングで学習を安定化、従来比1.5〜2倍高速な推論を実現した。
- 見て、集中して、行動する:人間の視線と周辺視型Vision Transformerによる効率的で頑健なロボット学習VLA2025/7/1
人間の視線運動を模した能動的視覚システムGIAVAを開発し、注視点に基づく周辺視パッチトークン化をViTに組み込むことで、計算量を大幅に削減しつつ背景の妨害に対する頑健性と高精度タスクの成功率を向上させた。
- InterACT: 双腕マニピュレーションのための階層的注意トランスフォーマによる相互依存性を考慮した行動チャンキングマニピュレーション2024/9/1
双腕ロボットの協調動作のため、腕同士の相互依存性を階層的注意機構で捉え、両腕の行動を並列生成する模倣学習フレームワークを提案した論文。
- 少数ショットウェイポイント検出による階層的エンドツーエンド自律ナビゲーションナビゲーション2024/9/1
人間のようにランドマークと行動を結びつけ、未知環境でも少数のランドマーク画像と高レベル行動指示だけで移動ロボットをナビゲートする階層的メタ学習手法を提案した。
- 能動視覚こそが全てかもしれない:双腕ロボットマニピュレーションにおける能動視覚の探求マニピュレーション2024/9/1
模倣学習に能動視覚を導入し、ロボットが人間の実演からカメラ視点を動的に変える方策を学習する双腕テレオペレーションシステムAV-ALOHAを提案し、実世界とシミュレーションで有効性を検証した。