Yifan Yang
Swancor Advanced Materials Co., Ltd.
収録論文 25本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 関節条件付きステレオ表面推論によるインタラクションフィールド推定インタラクションフィールド推定2026/9/7
手と物体のインタラクションフィールド推定を、各関節の最近傍表面点を推定する問題として捉え、時間ステレオネットワークと関節条件付き候補探索を用いた手法JSSRを提案した。
- 1500時間のデモからオン方針修正までの両腕家庭操作のスケーリング両腕操作/VLA/データセット2026/9/3
家庭内両腕操作タスクの1500時間のデモデータセットを公開し、VLAモデルXR-2を訓練。データ量とDAgger修正データの増加に伴い成功率が向上するスケーリング傾向を実証した。
- OmniCAD: ロボット組立における3D空間推論のための大規模ベンチマーク空間推論/ベンチマーク2026/8/23
産業用機械組立品の3D空間推論を評価する大規模ベンチマークを構築し、現在の視覚言語モデルが複雑な組立推論に苦戦することを示した。
- VidForensics-M1: 検証可能な時間的接地を用いたメタ検出強化学習によるAI生成ビデオ鑑識ビデオ鑑識2026/8/11
AI生成ビデオ検出のための新しいメタ検出強化学習フレームワークを提案し、時間的接地を証拠として利用することで、ラベル予測と証拠の統合を強化し、未見の生成モデルへの一般化を向上させた。
- DynamicWAM: 動的操作におけるワールドアクションモデルのためのデュアルパス動作条件付け操作2026/8/1
動的な物体操作のためのコンパクトなワールドアクションモデルを提案し、履歴フロー条件付けと運動学的記述子の注入により動作認識と応答性を向上させた。
- 協調が脅威となるとき:LLM制御マルチロボットシステムにおける通信攻撃群制御2026/8/1
LLMをプランナーに用いるマルチロボットシステムの通信攻撃を新たに定義し、異なるアーキテクチャでの影響を評価。さらに、通信内容の検証による防御手法CPVゲートを提案した。
- HCPG-Flow:フローポリシーによるロボット操作のための階層的接触進行ガイダンスマニピュレーション2026/7/1
フローポリシーによるロボット操作において、接触前後で階層的な物体中心の進行指標を用いて候補動作を選択する手法を提案し、シミュレーションと実機で成功率を向上させた。
- Open-AoE: 身体化学習のためのオープンな自己中心視操作データセットとツールチェーンデータセット2026/7/1
スマートフォンで撮影した自己中心視の操作動画約2000時間と、それをロボット学習用に加工するツールチェーンを公開した論文。
- トークン予測は計画ではない:物理に基づく因果推論エージェントの構築VLA/計画2026/6/1
身体性を持つ視覚言語計画の評価では、言語的な次トークン予測が重視されがちですが、本研究では物理的な因果推論を促すベンチマークと大規模データセットを構築し、因果推論を学習したモデルが計画性能を向上させることを示しました。
- SOAR: ロボット移動フルフィルメントシステムにおける注文割り当てとロボットスケジューリングのリアルタイム統合最適化群制御2026/5/1
注文割り当てとロボットスケジューリングを統合的に扱う深層強化学習フレームワークSOARを提案し、実時間性と大域最適性の両立を図った。
- MemCompiler: コンパイルする、注入しない -- 身体化エージェントのための状態条件付きメモリ身体化エージェント/メモリ管理2026/5/1
エージェントの現在の状態に応じて関連メモリのみを動的に選択・コンパイルするメモリシステムを提案し、静的メモリ注入を上回る性能と低遅延を実現した。
- CREST: マルチロボット倉庫棚再配置のための制約解放実行群制御2026/3/1
倉庫内の棚再配置問題に対し、実行中に軌道制約を積極的に解放する新しい実行フレームワークCRESTを提案し、移動距離・メイクスパン・棚切替を最大40%以上削減した。
- AoE: 身体性AIのための常時オンの一人称視点人間動画収集システムデータ収集2026/2/1
スマホと首掛けホルダーを使い、誰でもどこでも一人称視点の実世界インタラクション動画を低コストで収集し、身体性基盤モデルの学習データ不足を解消するシステムを提案。
- ScaleADFG: スケーラブルなデータセットによるアフォーダンスベースの巧みな機能把持マニピュレーション2025/11/1
ロボットの大きな手でも日常物体を機能的に把持できるよう、アフォーダンスに基づく自動データセット構築と軽量な把持生成ネットワークを提案した研究。
- AdaNav: 不確実性に基づく適応的推論による視覚言語ナビゲーションVLA2025/9/1
視覚言語ナビゲーションにおいて、不確実性に応じて推論を動的に発動する軽量プラグインを提案し、少ない学習データで大幅な性能向上を実現した。
- FPC-VLA:失敗予測と修正のためのスーパーバイザを備えた視覚-言語-行動フレームワークVLA2025/9/1
VLAモデルに失敗予測と修正を行うスーパーバイザを組み合わせ、シミュレーションと実機で成功率を向上させたデュアルモデルフレームワーク。
- MK-Pose: マルチモーダル・キーポイント学習によるカテゴリレベル物体姿勢推定姿勢推定2025/7/1
RGB画像・点群・カテゴリのテキスト記述を統合し、自己教師ありキーポイント検出とグラフ強化特徴融合でカテゴリレベル物体姿勢を高精度に推定する手法を提案。
- Astra:階層型マルチモーダル学習による汎用移動ロボットの実現移動ロボットナビゲーション2025/6/1
マルチモーダルLLMとマルチタスクネットワークを組み合わせた二重モデルアーキテクチャにより、多様な屋内環境で移動ロボットのナビゲーションを実現した。
- 階層型探索に基づく協調動作計画群制御2024/10/1
非ホロノミックなアッカーマンモデルの無人地面車両群に対し、二値衝突探索木を用いた階層型のリーダーレス協調動作計画法を提案し、複数グループや障害物環境での有効性を実機検証した。
- 主軸アンカー型単眼点・線SLAMSLAM2024/10/1
類似方向の線を主軸にアンカーしてn本の線をn+2パラメータで最適化する点・線SLAMを提案し、屋内・屋外データセットで有効性を示した。
- 最大航続距離制約下でのマルチロボットタスク割り当てと経路計画群制御2024/9/1
ロボットの最大航続距離を考慮し、経路計画とオークションを統合したタスク割り当て手法を提案。障害物回避距離を反映し、遅延オークションで高速化を図り、実機実験で有効性を検証した。
- あなたのHDマップ構築はセンサー劣化に耐えられるか?自動運転/HDマップ/ロバスト性2024/6/1
カメラやLiDARの29種類のセンサー劣化に対するHDマップ構築手法の頑健性を評価する初のベンチマークMapBenchを提案し、31手法を評価して性能低下を明らかにした。
- 命令的学習:ロボット自律性のための自己教師ありニューロシンボリック学習フレームワークニューロシンボリック2024/6/1
ニューラルモジュール・推論エンジン・記憶システムを二段階最適化で相互学習させる自己教師ありニューロシンボリック手法を提案し、経路計画や最適制御など5タスクで有効性を検証した。
- RoboDriveチャレンジ:あらゆる条件でいつでもどこでも走行する自動運転知覚2024/5/1
悪天候やセンサ故障など想定外の状況でも頑健に知覚できる自動運転技術を競う2024年RoboDriveチャレンジの報告で、BEV検出や地図セグメンテーションなど4タスクで140チームが参加した。
- PS6D: ビンピッキングのための点群ベース対称性考慮6D物体姿勢推定6D姿勢推定2024/5/1
錆や反射、テクスチャ欠如に対応するため、点群から注意機構と対称性を考慮した損失で6D姿勢を推定するPS6Dを提案し、ビンピッキングで91.7%の成功率を達成した。