Wenhao Wang
収録論文 11本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SafeGuard: 社会的リスクを伴うAI生成動画検出のためのマルチエージェント認識・推論フレームワーク動画検出2026/7/3
AI生成動画の検出において、知覚的証拠と意味的推論を協調させるマルチエージェントフレームワークを提案し、物理法則や社会的論理の違反を検出する新しいベンチマークも導入した。
- Ro-SLM: ロボットのタスク計画と動作コード生成のためのオンボード小型言語モデルVLA/タスク計画2026/4/1
クラウドや高性能計算機に依存せず、UAVなどの小型ロボットに搭載可能な小型言語モデル(SLM)を、LLMの知識蒸留と報酬関数によるファインチューニングで実用レベルに引き上げるフレームワークRo-SLMを提案した。
- RoboClaw: 長期的ロボットタスクのためのスケーラブルなエージェント型フレームワークVLA/長期的タスク2026/3/1
RoboClawは、データ収集・ポリシー学習・タスク実行を単一のVLM駆動コントローラで統合し、自己リセット機構により人間の介入を最小限に抑えつつ長期的タスクを自律的に実行するロボットフレームワークを提案する。
- LLMによる静的テキストシミュレーションを用いた修正型ロボット操作コード生成VLA2025/12/1
LLMを静的シミュレータとして活用し、ロボット操作コードの実行をテキスト上で検証・修正するフレームワークを提案。物理実験や専用シミュレータ不要で高精度なコード生成を実現した。
- FieldGen: 遠隔操作の前操作軌道からフィールド誘導データ生成へデータ生成2025/10/1
操作を前操作段階と精密操作段階に分け、人間の実演から引力場を構築して多様な軌道を自動生成することで、少ない人手で高品質な実世界データを収集する枠組みを提案。
- 一般化ロボット-世界・ハンドアイキャリブレーションのための証明可能に正しいアルゴリズムキャリブレーション2025/7/1
複数のセンサとターゲットの姿勢を同時推定でき、単眼カメラも扱える一般化RWHEC問題に対し、大域的最適性を保証する高速アルゴリズムを提案し、識別可能性条件と誤差有界時の最適性保証を与えた。
- 大規模言語モデルによる意味的観測を用いた閉ループUAV運用VLA2025/7/1
UAVの数値的な状態観測を意味的な軌道記述に変換し、コード生成LLMと評価LLMのフィードバックループで信頼性の高いUAV運用コードを生成するフレームワークを提案。
- Genie Centurion:人間による巻き戻し・修正ガイダンスで実世界ロボット訓練を加速VLA2025/5/1
失敗時に状態を巻き戻して人間が修正デモを行い、1人の操作者が複数ロボットを監督できるデータ収集手法を提案し、従来法より成功率を最大40%向上させた。
- AgiBot World Colosseo:スケーラブルで知能的な身体性システムのための大規模マニピュレーションプラットフォームマニピュレーション2025/3/1
100万以上の軌道と217タスクを含む大規模ロボット操作データセットと、潜在行動表現を活用した汎用方策GO-1を提案し、データ規模の拡大に伴う性能向上と実世界での巧みな長期的タスクの成功率向上を示した。
- GSCE: 信頼性の高いLLM駆動ドローン制御のための推論強化プロンプトフレームワークVLA2025/2/1
LLMによるドローン制御の信頼性を高めるため、ガイドライン・スキルAPI・制約・例から成るプロンプトフレームワークGSCEを提案し、複雑なタスクでの成功率と完全性を改善した。
- 3D拡散ポリシーによる汎化可能なヒューマノイドマニピュレーションマニピュレーション2024/10/1
上半身テレオペで収集した単一場面のデータと機載計算のみで、25自由度ヒューマノイドが多様な実環境で自律マニピュレーションを実現するシステムを構築した。