Wei Song
Griffith University
収録論文 11本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- パッチ除去後も持続する視覚言語行動ポリシーへの敵対的影響VLA2026/9/17
VLAポリシーへの敵対的パッチが除去後も持続する状態効果を引き起こすことを示し、状態復元プロトコルで即時影響と持続影響を分離して評価した。
- ロボットによる電池リサイクルにおける二端子危険に対する実行時安全フィルタリング安全フィルタリング2026/9/17
電池リサイクルで導電性ペイロードが充電セルの両端子に同時に近づく危険を対象に、学習済み操作ポリシーへの実行時安全フィルタの設計(述語構造・マージン・フォールバック)を比較し、フォールバック戦略が安全性とタスク成功率のトレードオフに最も大きく影響することを示した。
- StrucPhysVideo: 構造化キャプションとロボット行動から物理ダイナミクスを学習する動画世界モデル動画世界モデル2026/9/16
物体の動きや相互作用を記述した構造化キャプションとロボットの行動を条件として、物理的に妥当な動画を生成・予測する動画世界モデルを提案し、Physics-IQで最高性能を達成した。
- VLMエージェントによる文脈内ロボット学習VLA2026/9/16
商用VLMを活用し、デモやフィードバックから勾配更新なしでロボット行動を生成するGPT-Policyを提案。実機実験で人間のビデオデモがタスク完了率を向上させることを示した。
- HALO: 重負荷人型アジャイル動作スキルのための微分可能シミュレーションによるSim-to-Realギャップ解消sim2real2026/3/1
未知のペイロードを運ぶ人型ロボットのシミュレーションから実機への転移を改善するため、微分可能シミュレータを用いた2段階のシステム同定フレームワークを提案し、ゼロショット転移を実現した。
- FCRF: 大規模言語モデルによる長期的ロボットタスク計画のための柔軟な構成主義的自己反省タスク計画2025/7/1
家庭内ロボットの長期的タスク計画において、タスク難易度に応じて柔軟に自己反省し、過去の成功・失敗経験を統合するMentor-Actor型フレームワークFCRFを提案し、シミュレーションと実機で性能向上を示した。
- 3次元倉庫におけるアリコロニー最適化と先進ニューラルネットワークを用いた多次元AGV経路計画経路計画2025/4/1
3D倉庫環境でのAGV経路計画において、アリコロニー最適化と深層学習を組み合わせたNAHACOを提案し、混雑を考慮した損失関数と注意機構により動的な経路計画を実現した。
- ロボット犬によるゴミのセグメンテーションと属性分析ロボット犬/視覚知覚2024/4/1
四足歩行ロボット犬に視覚知覚システムを搭載し、屋内・屋外環境でゴミを探索・セグメンテーション・属性分析して回収を支援する手法GSA2Segを提案し、評価用データセットGSA2Dも公開した。
- MLDT: オープンソース大規模言語モデルによる複雑な長期ロボットタスク計画のための多段階分解タスク計画2024/3/1
目標・タスク・行動の3段階に分解し、目標に敏感なコーパス生成と指示チューニングでオープンソースLLMの長期ロボットタスク計画能力を高める手法を提案。
- 視覚知覚と知識グラフを整合させた物体目標ナビゲーションナビゲーション2024/2/1
物体目標ナビゲーションにおいて、シーン構造を連続的にモデル化し、視覚言語事前学習で言語記述と視覚知覚を整合させることで、ゼロショットナビゲーションを可能にした手法を提案。
- TGRMPT: A Head-Shoulder Aided Multi-Person Tracker and a New Large-Scale Dataset for Tour-Guide Robot2022/7/1