Yi-Ting Chen
収録論文 22本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- PhysCaP: 物理情報に基づく探索によるコード駆動ポリシーエージェントの接地操作/能動的知覚2026/8/21
ロボット操作における能動的知覚のため、物理特性を推定し探索行動を計画するコード駆動ポリシーエージェントを提案。
- 接地された3D点のアクションヘッド直接注入による空間・タスク汎化の実現VLA/操作2026/6/1
VLAモデルの空間・タスク汎化を改善するため、3D点ベースの接地信号をアクションヘッドに直接注入する軽量モジュールを提案し、LIBERO-PROで成功率を大幅に向上させた。
- ADAPT: 不特定のアフォーダンス制約下での常識的計画のベンチマーク計画/アフォーダンス2026/4/1
動的環境で物体のアフォーダンスが変化し指示に明示されない状況を評価するベンチマークDynAffordを導入し、既存プランナーにアフォーダンス推論を追加するモジュールADAPTを提案した。
- HetroD: 異種交通環境における自動運転のための高忠実度ドローンデータセットとベンチマーク自動運転データセット2026/2/1
歩行者・自転車・二輪車などが混在する異種交通環境を対象に、ドローンで収集した大規模データセットと、予測・計画・シミュレーションの標準ベンチマークを構築した。
- アフォーダンス誘導による粗から細への探索:オープンボキャブラリ移動マニピュレーションのためのベース配置移動マニピュレーション2025/11/1
視覚言語モデルの意味理解と幾何学的制約を組み合わせ、タスクに適したアフォーダンスを考慮してロボットのベース配置をゼロショットで探索する手法を提案し、5つのタスクで85%の成功率を達成した。
- 衝突パターン予測による制御可能な衝突シナリオ生成自動運転シミュレーション2025/10/1
ユーザー指定の衝突タイプと事故までの時間(TTA)を満たす軌道を生成する新タスクを提案し、大規模データセットCOLLIDEと衝突パターン予測フレームワークで高精度・高制御性を実現した。
- GRITS: こぼれを考慮した誘導拡散ポリシーによるロボットの食品すくいタスクマニピュレーション2025/10/1
食品すくい時のこぼれを予測するモデルを拡散ポリシーの誘導信号として使い、こぼれを抑えつつ成功率を高める手法を提案し、実機で有効性を示した。
- 文脈とタスクを考慮した拡散モデルによるタスク指向の人間把持生成マニピュレーション2025/7/1
シーンとタスク情報を考慮した接触マップを構築し、拡散モデルでタスクに適した人間の把持姿勢を生成する手法を提案。新データセットと評価指標も導入した。
- アフォーダンス誘導と自己整合性MLLMによる指示追従マニピュレーションのタスク計画:クロスモーダルな注意散漫の緩和と幾何学的実現可能性の確保マニピュレーション2025/3/1
指示追従マニピュレーションのタスク計画において、MLLMのクロスモーダルな注意散漫と幾何学的非実現可能性を、自己整合性Chain-of-Thoughtとアフォーダンス予測器で解決し、新ベンチマークQuARCで76.7%の成功率を達成した。
- ArticuBot: 大規模シミュレーションによる汎用関節物体操作ポリシーの学習sim2real2025/3/1
物理シミュレーションで大量のデモを生成し、点群ベースの階層的模倣学習ポリシーを訓練することで、未知の関節物体を実機でゼロショット操作できるようにした研究。
- VICtoR: 長期的操作タスクのための階層的視覚指示相関報酬の学習マニピュレーション2024/5/1
動作なし動画と言語指示から長期的操作タスクの報酬を学習する階層的モデルVICtoRを提案し、段階検出と動作進捗評価で成功率を43%向上させた。
- 適応的エラー検出:少数ショット模倣ポリシーのための新しいタスクとベンチマーク模倣学習2024/2/1
少数ショット模倣ポリシーの行動エラーを新規環境で検出するタスクを提案し、クロスドメインベンチマークとパターン抽出に基づく手法PrObeを開発した。
- RiskBench: A Scenario-based Benchmark for Risk Identification2023/12/1
- SKT-Hang: Hanging Everyday Objects via Object-Agnostic Semantic Keypoint Trajectory Generation2023/12/1
- Learning Road Scene-level Representations via Semantic Region Prediction2023/1/1
- Orbeez-SLAM: A Real-time Monocular Visual SLAM with ORB Features and NeRF-realized Mapping2022/9/1
- Stage Conscious Attention Network (SCAN) : A Demonstration-Conditioned Policy for Few-Shot Imitation2021/12/1
- DROID: Driver-centric Risk Object Identification2021/6/1
- Uncertainty-aware Self-supervised 3D Data Association2020/8/1
- Who Make Drivers Stop? Towards Driver-centric Risk Assessment: Risk Object Identification via Causal Inference2020/3/1
- Learning 3D-aware Egocentric Spatial-Temporal Interaction via Graph Convolutional Networks2019/9/1
- The H3D Dataset for Full-Surround 3D Multi-Object Detection and Tracking in Crowded Urban Scenes2019/3/1