Yang Wang
収録論文 30本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- MicroHookACT: 単眼顕微鏡視覚による柔軟マイクロ電極フッキングのための視覚運動ポリシーマニピュレーション2026/9/18
単眼顕微鏡下での柔軟マイクロ電極の自動フッキングを実現する模倣学習ベースの視覚運動ポリシーを提案し、人間の実演60回から学習して96.7%の成功率を達成した。
- GigaBrain-WBC-0.5:環境との相互作用に頑健な全身制御のための行動世界モデル全身制御2026/8/18
ヒューマノイドの全身運動追跡制御において、環境との接触を考慮した行動世界モデルを提案し、不適切なコマンドや外乱に対して頑健な制御を実現した。
- GigaBrain-0.7:三系統アーキテクチャによる創発的能力へのスケーリングVLA2026/8/16
視覚言語行動モデルのスケーリングとアーキテクチャ改善により、多様なロボットへの汎化を大幅に向上させた基盤モデルを提案。
- 未知の乱流背景流におけるロボット魚の自己中心的な定点保持水中ロボット2026/7/1
乱流環境でロボット魚が目標位置に留まるための強化学習フレームワークSWiFTを提案し、シミュレーションと実機実験で有効性を実証した。
- GigaWorld-1: ロボットポリシー評価のためのワールドモデル構築ロードマップワールドモデル2026/7/1
ロボットポリシーの評価を効率化するため、ワールドモデルの信頼性を体系的に研究し、ベンチマークWMBenchを構築して、7つのビデオワールドモデルと4つの行動表現を比較した。
- GigaWorld-Policy-0.5: AutoResearchによる高速・高精度なWAMの実現VLA2026/7/1
将来の視覚予測を訓練時のみに用い、推論時は行動生成のみで高速化した行動中心のWorld Action Modelを提案し、AutoResearchで最適設定を探索して性能を向上させた。
- ProcVLM: 手順に基づく進捗報酬を学習するロボット操作モデルマニピュレーション2026/5/1
長期的なロボット操作タスクにおいて、手順の構造と視覚変化に基づいて進捗を推定し、密な報酬信号を生成する視覚言語モデルProcVLMを提案した。
- VAG: 身体化データ合成のためのデュアルストリーム動画-行動生成VLA2026/4/1
ロボットの基盤モデル学習用に、動画と行動を同時生成する統一フレームワークVAGを提案。動画と行動の整合性を高め、合成データでポリシーの汎化性能を向上させる。
- ViVa: ロボット強化学習のためのビデオ生成価値モデル強化学習2026/4/1
事前学習済みのビデオ生成モデルを価値関数として再利用し、将来の身体状態とスカラー価値を同時に予測することで、ロボット操作タスクにおける価値推定を改善する手法を提案した。
- 双腕無人航空マニピュレータシステムのためのニューラルネットワークベース適応イベントトリガ制御制御2026/4/1
双腕とマルチロータ間の強い結合や外乱に対処するため、ニューラルネットワークで近似しつつイベントトリガで通信負荷を減らす適応制御を提案し、実機実験で精度を確認した。
- SwiftVLA:軽量VLAモデルのための時空間ダイナミクスを最小オーバーヘッドで解き放つVLA2025/12/1
軽量な視覚言語モデルに4D特徴を融合トークンとマスク再構成で組み込み、推論時には4D入力を不要にして高速・省メモリで高性能なVLAモデルを実現した。
- GigaWorld-0:世界モデルをデータエンジンとして具現化AIを強化VLA2025/11/1
視覚・言語・行動(VLA)学習のためのデータ生成エンジンとして、動画生成と3D生成を統合した世界モデルフレームワークを提案し、実世界データなしでロボットの汎化性能とタスク成功率を向上させた。
- GigaBrain-0: ワールドモデルを活用した視覚-言語-行動モデルVLA2025/10/1
ワールドモデルで生成した多様なデータを活用し、実機データへの依存を抑えつつ汎化性能を高めたVLA基盤モデルを提案。RGBD入力と身体性Chain-of-Thoughtで長期的・移動を伴う器用な操作タスクの実世界性能を向上させた。
- EMMA: 生成的視覚転送による実世界ロボットマニピュレーションの汎化VLA2025/9/1
拡散Transformerでロボット操作動画を生成し、実データと混合してVLAポリシーを訓練することで、未知の視覚環境へのゼロショット汎化を実現した。
- 不確実性下での協調自動運転車両のロバストリアルタイム調整:分散最適化フレームワーク群制御2025/8/1
不確実性を考慮した安全制約とADMMベースの分散軌道交渉、対話的注意機構を組み合わせ、協調自動運転車両のリアルタイムかつ安全な調整を実現するフレームワークを提案した。
- EmbodieDreamer: 身体性ワールドモデリングによるReal2Sim2Real転送の促進sim2real2025/7/1
物理パラメータ最適化と動画拡散モデルでシミュレーションと実世界のギャップを埋め、ロボット政策学習を高精度化するフレームワークを提案。
- ヒューマノイド占有:汎用マルチモーダル占有知覚システムの実現占有知覚2025/7/1
ヒューマノイドロボット向けに、マルチモーダル融合と時系列統合を用いた占有グリッド知覚システムを構築し、専用のパノラマ占有データセットを整備した。
- 深層ニューラルネットワークを用いた双腕飛行マニピュレータの適応RISE制御飛行マニピュレーション2025/4/1
双腕ドローンの運動学・動力学モデルを構築し、DNNフィードフォワード項を組み込んだ適応RISE制御器を提案。Lyapunov解析で追従誤差の漸近収束を保証し、実機実験で有効性を検証した。
- 複数制約下でのアリコロニーアルゴリズムを用いた物流ロボットの経路計画最適化経路計画2025/4/1
時間窓やタスク順序、動作の滑らかさといった複数の制約を考慮し、アリコロニー最適化アルゴリズムで物流車両の経路計画を最適化する手法を提案した。
- DART: 未知環境の効率的な探索のための二段階自律ロボットトポロジー自律探索2025/3/1
未知環境を探索するロボット向けに、低レベルと高レベルのトポロジカルグラフを組み合わせて凸領域の探索漏れを防ぎ、局所人工ポテンシャル場で制御する手法を提案した論文。
- CPGを使わないEnd-to-End強化学習による敏捷な遊泳制御sim2real2024/9/1
中央パターン生成器(CPG)に頼らず、深層強化学習でロボット魚の低レベルアクチュエータ指令を直接生成し、CFDシミュレータとsim-to-realキャリブレーションにより実機へ転移可能な敏捷・省エネ遊泳を実現した。
- 生体内実験で検証した脳深部超音波焼灼の熱線量モデリング医療ロボティクス2024/9/1
脳腫瘍治療用の針型超音波焼灼において、有限要素法による熱損傷評価を強化したシミュレーションを構築し、MR温度画像で生体内検証した。
- 中空円筒型超音波モータの特性評価と設計アクチュエータ2024/9/1
MRI対応ロボット向けに、中空円筒型超音波モータの試作機を開発し、直接駆動で毎分383回転・57.4mNmのトルクを達成した。
- 回転型超音波モータにおける表面進行波摩擦駆動の有限要素モデリングアクチュエータ/超音波モータ2024/9/1
圧電超音波モータの固定子と回転子の連成ダイナミクスを接触理論に基づく有限要素モデルで再現し、起動から定常運転までの挙動と反力を解析した。
- MRI対応前立腺ロボットシステムのための差動駆動追加システムの予備的検討医療ロボティクス2024/9/1
MRIガイド下前立腺生検の針制御精度向上のため、MRI干渉を抑える2自由度差動駆動の針駆動機構を試作し、その速度と精度を検証した。
- 術前外科計画のための先進的FEMシミュレーション技術の開発手術計画/シミュレーション2024/9/1
脳腫瘍の温熱アブレーション治療(NBTU)の術前計画を最適化するため、様々な腫瘍条件での熱損傷を評価するFEMシミュレーションモデルとデータベースを構築し、治療効率を最大化するプローブ選択法を提案した。
- TripleMixer: 悪天候下のLiDAR点群ノイズ除去モデル点群ノイズ除去2024/8/1
雪・霧・雨などの悪天候で乱れたLiDAR点群を、空間・周波数・チャネル方向の3種のミキサーで高精度にノイズ除去するネットワークを提案し、大規模シミュレーションデータセットと4つのベンチマークで有効性を示した。
- Event-Enhanced Multi-Modal Spiking Neural Network for Dynamic Obstacle Avoidance2023/10/1
- Test-Time Adaptation for Point Cloud Upsampling Using Meta-Learning2023/8/1
- iCOIL: Scenario Aware Autonomous Parking Via Integrated Constrained Optimization and Imitation Learning2023/5/1