Weiming Zhi
The University of Sydney
収録論文 48本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SAKI: 人間の動画からのスキル組み立てと運動学的模倣による長期的モバイルマニピュレーションモバイルマニピュレーション2026/9/28
人間の動画から物体中心の再利用可能なスキルを獲得し、それらを組み合わせてロボットの全身運動として実行することで、長期的なモバイルマニピュレーションを実現するフレームワークSAKIを提案。
- 地図認識型視覚運動ポリシーによる移動マニピュレーション移動マニピュレーション2026/9/22
テレオペ実演から地図を構築し、ベース姿勢を明示的に予測・追従させることで移動マニピュレーションの成功率を高める枠組みMAVPを提案。
- StereoPatch: ロボットマニピュレーションの空間知覚のためのパッチ整合RGB-深度融合マニピュレーション2026/9/14
RGBパッチと深度情報をパッチ単位で非対称クロスアテンションにより融合し、幾何学的な曖昧さを解消する視覚運動ポリシー向け表現を提案。実機6タスクで外観のみ・幾何のみ・生RGB-D・後段融合のベースラインを上回る成功率を達成。
- 手先内での物体の6D姿勢到達を学習するマニピュレーション2026/9/12
把持した物体を指の協調動作で手のひら基準の目標6D姿勢へ移動させる強化学習フレームワークPOISEを提案し、シミュレーションと実機で有効性を示した。
- 接触前実行監視:行動条件付き潜在世界モデルによるコンタクトガード操作/監視2026/8/1
ロボットの接触を伴う操作において、接触前に失敗を予測して動作を中断する監視システムを提案。未ラベルの軌跡から潜在世界モデルを学習し、計画された行動の結果を予測して失敗を検出する。
- AutoIntervene: アクションチャンキング模倣学習ポリシーのための較正された介入模倣学習/介入2026/8/1
アクションチャンキング型の視覚運動ポリシーに対し、実行中にオペレータへの介入を選択的に行うオンラインフレームワークを提案。視覚・動作のサポートメモリと較正された閾値で介入タイミングを制御し、実機の双腕操作タスクで成功率向上と介入時間削減を実証した。
- NestDex: コパイロット支援遠隔操作による入れ子型ポリシー学習を用いた器用な操作マニピュレーション2026/8/1
器用な操作のデモ収集を容易にするため、学習済みの手先スキルを遠隔操作に組み込んだ入れ子型ポリシー学習フレームワークを提案し、実機実験でその有効性を示した。
- 三腕ビジュオモーター模倣学習によるロボットポリシーの獲得模倣学習2026/7/1
三腕ロボットの模倣学習において、人間の操作者が同時に制御できるのは2腕までという制約を克服するため、デモンストレーションのタイミングを再調整する手法DATSを提案し、実世界の6タスクで有効性を示した。
- SemAnCorr: 意味的アンカー対応によるゼロショット操作スキル転移マニピュレーション2026/7/1
機能は同じだが形状が異なる物体間での操作スキル転移を、意味的に一貫したアンカー領域の対応付けと関数マップによる伝播で実現する訓練不要のフレームワークを提案。
- PATCH: アクションチャンク条件付き潜在パッチ革新監視によるロボット操作操作2026/6/15
ロボット操作中に予期しない局所的な環境変化を検出し、介入と復帰を行うための監視手法を提案。
- TRACE: 遅延証拠を用いた視覚運動模倣のための軌跡ルーティング因果記憶模倣学習2026/6/1
ロボットが自律動作中に、過去に見たが現在は見えない情報(遅延証拠)に基づいて判断する必要があるタスクを扱い、軌跡の特徴を用いて視覚情報を記憶・検索するフレームワークTRACEを提案した。
- 協調するロボット:結合ロボットポリシー学習のための逐次非対称模倣群制御2026/6/1
2台の双腕移動ロボットが剛体・変形体を介して物理的に結合する協調作業を、単一オペレータの模倣カリキュラムで学習させる手法を提案。ロボットAを人間パートナーとの片側デモで訓練し、ロボットBをAのポリシーに対抗させて訓練、その後Aを介入で微調整する。
- BayesFP: フローベース方策のためのFeynman-Kacサンプリングによる事後推定軌道生成/拡散モデル/フローマッチング2026/6/1
事前学習済みの拡散・フローマッチング方策を事前分布とし、推論時に与えられるコストを尤度として事後サンプリングすることで、安全制約やタスク目的を満たす軌道生成を行う再学習不要の推論時サンプラーを提案した。
- Rewind-IL: 模倣学習のためのオンライン故障検出と状態リスポーン模倣学習2026/4/1
模倣学習ポリシーの実行中に発生する故障を検出し、安全な中間状態に巻き戻して回復させる、トレーニング不要のオンライン安全フレームワークを提案した。
- SOFTMAP: トポロジカルメッシュ整列と物理事前知識によるソフトロボットのSim2Real順モデリングソフトロボティクス/sim2real2026/3/1
腱駆動ソフトフィンガーの3次元順モデルを、シミュレーションと実データを組み合わせて高精度に学習するフレームワークを提案。
- ContraMap: ロボット環境表現のための対比的不確実性マッピング環境表現2026/3/1
観測が疎な領域を不確実性クラスとして扱う対比的連続マッピング手法を提案し、ベイズ推論なしで環境予測と空間的不確実性推定をリアルタイムに行う。
- 制約を考慮したストリーミングフローによるロボット軌道分布の適応マニピュレーション2026/2/1
学習済みストリーミングフローポリシーの速度場を制約に応じてリアルタイムに変形し、衝突回避や関節限界を守りつつ滑らかな軌道を生成する手法を提案。
- TriPilot-FF: 力覚フィードバックを備えた協調型全身遠隔操作システム遠隔操作2026/2/1
移動マニピュレータの全身遠隔操作のため、足踏みペダルとLiDARによるペダル力覚提示、両腕リーダーフォロワ、腕の力覚反射を統合したシステムを開発し、長期的な操作や精密な移動を支援することを示した。
- 意味的アンカー付き関数写像による物体間のアフォーダンス転移アフォーダンス転移2026/2/1
単一の視覚デモから、形状が異なるが機能が類似する物体間でアフォーダンスを転移するSemFMを提案し、合成物体と実機マニピュレーションで有効性を示した。
- クロスモーダル指示によるロボット動作生成VLA2025/9/1
自由記述テキストなどの粗い注釈を指示として使い、視覚言語モデルと微調整モデルを組み合わせて3D動作軌道を生成するCrossInstructを提案し、強化学習と組み合わせて実機・シミュレーションで検証した。
- 動画デモからの実行可能なロボット動作生成のための関節フロー軌道最適化模倣学習2025/9/1
人間の動画デモを物体中心のガイドとして扱い、把持姿勢選択・物体軌道生成・衝突回避を統合した微分可能な最適化により、ロボットの関節制約を満たす動作を生成するフレームワークを提案。
- 単一画像から陰的表面モデルを効率的に構築するFINSsim2real2025/9/1
単一または少数のRGB画像から高精度な陰的表面とSDF場を数秒で再構築する軽量フレームワークFINSを提案し、ロボットの表面追従タスクへの応用を示した。
- ConEQsA: 並行・非同期な身体性質問のスケジューリングと応答VLA2025/9/1
複数の質問が非同期に届く実環境向けに、緊急度を考慮して並行処理する身体性質問応答フレームワークとベンチマークを提案した。
- 単一画像から動画生成環境表現を介した運動方策へナビゲーション2025/5/1
1枚のRGB画像から動画生成モデルで多視点映像を作り、3D基盤モデルで点群を再構成して衝突回避運動を生成する枠組みVGERを提案。
- 双腕ロボットのカメラキャリブレーションとシーン表現の同時推定キャリブレーション2025/5/1
複数のロボットアームに搭載されたカメラの外部キャリブレーションと腕間の相対姿勢、共有作業空間の3D表現を、マーカーなしで同時に推定するフレームワークを提案。
- GraphSeg: グラフの辺追加と縮約によるセグメント化された3D表現3Dセグメンテーション2025/4/1
深度情報なしの少数の2D画像から、2Dの類似度と推定3D構造の二重対応グラフを構築し、辺の追加とグラフ縮約で一貫した3D物体セグメンテーションを生成する手法。
- 海の果てまで無限に続くリーグ:潜在フラクタル拡散モデルによるフォトリアルな3D海底地形生成3D生成/拡散モデル2025/3/1
海底探査ロボットの実画像から3D形状と意味情報を抽出し、フラクタル潜在表現で条件付けした拡散モデルでRGBD海底画像を生成、3DGSで統合することでフォトリアルな大規模海底シーンを生成する手法DreamSeaを提案。
- ロバストベイズシーン再構成:検索拡張事前分布による精密把持と計画シーン再構成2024/11/1
単一RGBD画像から多物体シーンを再構成するため、既存メッシュデータベースから検索した事前分布をベイズ推論に組み込むBRRPを提案し、遮蔽部分の形状推定と不確かさの定量化を実現した。
- PhotoReg: 3Dガウシアンスプラッティングモデルのフォトメトリック位置合わせ3DGS2024/10/1
複数の3Dガウシアンスプラッティングモデルを、3D基盤モデルとフォトメトリック損失を用いてスケールを揃えながら統合するフレームワークを提案。
- SplaTraj: セマンティックGaussian Splattingによるカメラ軌道生成シーン表現/軌道生成2024/10/1
言語指示に基づき、Gaussian Splattingで再構成した環境内を映える形で巡るカメラ軌道を連続時間最適化で生成するフレームワーク。
- ModCube:モジュール式自己組み立て立方体型水中ロボット群制御2024/9/1
8つのスラスタで6自由度移動し、電磁石で他のロボットと剛結合できる低コストなモジュール型水中ロボットを開発し、その動特性の評価手法と4つのベンチマークを提案した。
- 非構造環境における周囲の認識・動作予測・適切な行動決定の学習VLA2024/7/1
動的で非構造な実世界環境でロボットが周囲を理解し、他者の動きを予測して適切に行動するための学習ベース手法をまとめた論文。
- 3D基盤モデルによる把持物体の形状と姿勢の同時推定マニピュレーション2024/7/1
3D基盤モデルを活用し、外部カメラのキャリブレーションなしで、ロボットが把持した物体の形状と姿勢をRGB画像から同時に推定する手法を提案した。
- 3D基盤モデルによるシーン表現とハンドアイキャリブレーションの統合キャリブレーション2024/4/1
マニピュレータ搭載RGBカメラの画像から、キャリブレーションマーカーなしで環境表現の構築とカメラ-エンドエフェクタ間のキャリブレーションを同時に行うJCR手法を提案。
- V-PRISM: 未知の卓上シーンの確率的マッピングシーン認識2024/3/1
セグメント済みRGB-D画像から卓上シーンの3D表現を確率的に構築する手法を提案し、占有・セグメンテーション・不確かさを同時に推定する。
- DarkGS: 暗闇でのロボット探査のためのニューラル照明学習と3Dガウシアン再照明3D再構成/再照明2024/3/1
移動する光源下の暗い環境で、カメラと光源の系をニューラルにモデル化し、再照明可能な3Dガウシアンシーンを構築して実時間で写実的な新視点画像を生成する手法を提案した。
- 人間のスケッチでロボットの行動場所と動作を教える:空間図式指示マニピュレーション2024/3/1
人間がカメラ画像上にスケッチした領域を3D空間に投影し、連続的な空間指示マップを学習してロボットの最適化問題に組み込む手法を提案。移動マニピュレータのベース配置問題に適用し、高品質な解と高速な実行を実現した。
- Learning Orbitally Stable Systems for Diagrammatically Teaching2023/9/1
- Pedestrian Trajectory Prediction Using Dynamics-based Deep Learning2023/9/1
- Instructing Robots by Sketching: Learning from Demonstration via Probabilistic Diagrammatic Teaching2023/9/1
- Multi-query Robotic Manipulator Task Sequencing with Gromov-Hausdorff Approximations2022/9/1
- L4KDE: Learning for KinoDynamic Tree Expansion2022/3/1
- Parallelised Diffeomorphic Sampling-based Motion Planning2021/8/1
- Probabilistic Trajectory Prediction with Structural Constraints2021/7/1
- Anticipatory Navigation in Crowds by Probabilistic Prediction of Pedestrian Future Movements2020/11/1
- OCTNet: Trajectory Generation in New Environments from Past Experiences2019/9/1
- Occ-Traj120: Occupancy Maps with Associated Trajectories2019/9/1
- Kernel Trajectory Maps for Multi-Modal Probabilistic Motion Prediction2019/7/1