Zihao Wang
収録論文 14本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Uni-VLaT:ヒューマノイドの移動操作のためのVLAポリシーへの全身触覚適応VLA2026/9/28
全身触覚を視覚言語行動ポリシーに統合し、未来の触覚・固有感覚・視覚表現を予測する補助タスクで学習することで、接触を伴う移動操作タスクの成功率を大幅に向上させた。
- Dex-X: シミュレーションによるインタラクションを用いた人間のビデオからの視覚-触覚器用操作学習マニピュレーション2026/9/7
人間のビデオデモから、シミュレーションで触覚情報を補完し、視覚と触覚を統合した器用な操作ポリシーを学習するフレームワークを提案。実機へのゼロショット転送を達成した。
- ナノフォトニクスにおける大規模言語モデルの包括的レビュー:サロゲートモデリングから自律設計へLLM/設計自動化2026/8/18
メタサーフェス設計における大規模言語モデル(LLM)の応用を、サロゲートモデルとエージェントシステムの2つの動作モードに分類してレビューし、将来のマルチモーダル基盤モデルへの展望を示した論文。
- WorldSimProbe: 身体的操作のための行動条件付きワールドモデルにおけるシミュレータ忠実度の診断シミュレーション評価2026/8/1
行動条件付きワールドモデル(ACWM)が物理シミュレータとして忠実に機能するかを検証するための評価手法「WorldSimProbe」を提案し、複数のベンチマークで既存モデルの欠陥を明らかにした。
- 海上試験データに基づくAUV操縦モデリングのための微分可能な複合近似フレームワークAUV操縦モデリング2026/6/1
AUVの操縦モデルを、多項式基底とニューラル残差を微分可能に結合して共同調整し、海流補正を加えた海上試験データで精度を向上させる手法を提案した。
- IRFベースの枠組みを用いた短波頂不規則波中のUSV運動の効率的時間領域シミュレーション船舶運動シミュレーション2026/6/1
インパルス応答関数に基づく時間領域シミュレーション手法を提案し、短波頂不規則波中の無人水上艇の運動を効率的に予測する。モデル試験と実海域データで検証し、精度を確認した。
- マルチエージェント強化学習による協調的な長縄跳びマルチエージェント強化学習2026/6/1
複数の人型ロボットが協力して長縄跳びを行うためのマルチエージェント強化学習フレームワークを提案し、シミュレーションと実機でその有効性を実証した。
- ビデオ複雑度の属性ベース尺度ビデオ理解2026/5/30
ビデオと質問のペアに対するビデオLLMの失敗確率として複雑度を定義し、参照データセットと属性語彙を用いて非パラメトリックに推定する新しい尺度VideoABCを提案した。
- LIR-LIVO: 照明に頑健な深層特徴を用いた軽量でロバストなLiDAR・視覚・慣性オドメトリVLA2025/2/1
照明が厳しい環境でも安定して動くよう、深層学習ベースの照明耐性特徴とLiDAR点群による深度統合、SuperPoint/LightGlueによる適応的マッチングを組み合わせた軽量なLiDAR-慣性-視覚オドメトリを提案し、複数データセットで高精度・低計算コストを実証した。
- GROOT-2: 弱教師ありマルチモーダル指示追従エージェントVLA2024/12/1
ラベルなしデモで多様な行動を学びつつ、少数のラベル付きデモで人間の意図に合わせる半教師あり学習手法を提案し、マルチモーダル指示追従性能を向上させた。
- 環境外乱下における海洋車両の操縦運動に対する物理-MLハイブリッドモデリングsim2real2024/11/1
不完全な物理モデルと特徴抽出付き残差ネットワークを組み合わせ、海流や波の周期的影響を考慮して船舶の操縦運動を高精度に長期予測する手法を提案した。
- マルチコプタの画像ベースビジュアルサーボによる高精度迎撃飛行ビジュアルサーボ2024/9/1
画像ベースビジュアルサーボと比例航法を組み合わせ、遅延カルマンフィルタで目標位置を推定することで、マルチコプタによる高精度な迎撃を実現した。
- OmniJARVIS:統合視覚言語行動トークン化によるオープンワールド指示追従エージェントVLA2024/6/27
Minecraftのオープンワールドで、行動軌跡を自己教師あり学習で離散トークン化し、推論・計画・行動を単一のVLAモデルで統合的に実行できるようにした研究。
- Upper Limb Movement Recognition utilising EEG and EMG Signals for Rehabilitative Robotics2022/7/1