Yingcong Chen
収録論文 5本 ・ フィジカルAI/ロボット学習
VLAVLA/操作アフォーダンス接地自動運転/LLM
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- AffordanceWAM: アフォーダンス認識型の世界行動統合モデリングによるロボットマニピュレーションVLA2026/9/16
人間とロボットの動画から物体中心のアフォーダンスを予測し、将来の映像とロボット行動を統合的に生成するモデルを提案。人間動画を活用してロボット操作の汎化性能を向上させた。
- AffordanceVLA:アフォーダンス認識による行動生成を強化する視覚言語行動モデルVLA/操作2026/6/4
視覚言語モデルとロボット制御の構造的ミスマッチを解消するため、アフォーダンス予測を中間表現として導入し、物体の接地・2D位置特定・3D幾何推論を段階的に行う統一フレームワークを提案した。
- アフォーダンスエージェントハーネス:検証ゲートによるスキルオーケストレーションアフォーダンス接地2026/5/1
オープンワールドでのアフォーダンス接地を改善するため、検証ゲート付きのクローズドループランタイムを提案し、適応的なスキル選択とエビデンス蓄積により精度とコストのトレードオフを向上させた。
- DualCoT-VLA: 視覚と言語の連鎖的推論を並列化した視覚言語行動モデルVLA2026/3/1
複雑なタスクで苦戦するVLAモデルに対し、視覚的CoTと言語的CoTを並列に統合し、推論遅延を減らして高性能を実現した。
- Occ-LLM:占有表現を活用した自動運転向け大規模言語モデル自動運転/LLM2025/2/1
占有グリッド表現を大規模言語モデルに統合し、動的物体と静的シーンを分離するMS-VAEで効率的に符号化することで、4D占有予測や自己計画、シーン質問応答の性能を向上させた研究。