Hang Yu
Tongji University
収録論文 31本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- PHIRL: 逆強化学習のための学習報酬とタスク進捗の整合逆強化学習2026/9/25
人間のデモンストレーションと進捗フィードバックを組み合わせ、逆強化学習でロバストな報酬関数を学習するデータ効率の良いフレームワークPHIRLを提案。実機・シミュレーションでベースラインを上回る性能を示した。
- NumerosityVLM: 視覚言語モデルにおける数量表現の解釈のための認知に着想を得たベンチマークVLA/ベンチマーク2026/8/15
視覚言語モデルの数量知覚能力を評価するため、物体の大きさや配置などの視覚的要因を独立に操作した合成画像ベンチマークを構築し、モデル性能の要因分析と層別プロービングを行った。
- ループに留まる必要はない:ロボットポリシー改善のためのエージェント型ロボティクスループロボットポリシー改善2026/8/1
LLMコントローラが耐久性のあるトレーニング・評価・改善トランザクションを通じて使い捨てワーカーを駆動する、ロボットポリシー改善のための制御プレーンを提案。ツールの品質を測定・記録し、アーティファクト変更時に失効させることで、人間の介入なしに堅牢な改善を実現する。
- DH-VLM: 自動運転のためのデュアルホライズン協調潜在推論自動運転2026/8/1
インフラと車両の非対称な協調により、車両のセンシング範囲を超えた長期的な文脈理解を実現し、計画性能を向上させるフレームワークを提案した。
- GWM-VLA:視覚言語行動学習のための幾何認識潜在世界モデリングVLA2026/8/1
視覚言語行動モデルの堅牢性を向上させるため、幾何情報を考慮した多視点状態符号化と潜在世界モデルを導入し、手首視点の予測と共有潜在行動表現によりロボット操作性能を高めた。
- TS-Mask VLA: 視覚言語行動モデルのための2次元時空間マスキングと効果的なブリッジングVLA2026/7/1
本論文は、ロボット操作のための視覚言語行動(VLA)モデルを提案し、離散拡散アクションエキスパートと時空間2Dマスキング戦略を導入して、長期的で複雑なタスクにおける行動生成の精度と安定性を向上させる。
- シフト&ドリフト:汎用性と堅牢性を備えた自動運転モーションプランニングのためのゼロショットベンチマーク自動運転/モーションプランニング/ベンチマーク2026/7/1
自動運転のモーションプランナーが、未見の都市環境や実行時の摂動に対してどの程度汎化・堅牢かを評価するための新しいベンチマーク「Shift & Drift」を提案した論文。
- G2DP: 時空間グリッドガイダンスを用いた拡散プランニング自動運転/プランニング2026/6/1
自動運転向けの拡散ベースのプランナーに、推論時に時空間コストボリュームから密度の高い勾配を注入する新しいガイダンス手法を提案し、nuPlanなどのベンチマークで最先端の性能を達成した。
- 適応チャンクサイズのアクタークリティックと因果トランスフォーマーQネットワーク強化学習2026/5/1
強化学習における長期的・疎報酬タスク向けに、チャンクサイズを状態に応じて適応的に選択するアクタークリティック法を提案し、オフラインおよびオフラインからオンラインへの設定で最先端性能を達成した。
- 特徴が乏しい環境における知覚を考慮した自律探索自律探索2026/3/1
視覚慣性オドメトリの性能を考慮し、特徴が乏しい領域を避けつつ探索効率を高めるUAVの階層的探索フレームワークを提案した。
- LTL制約をPPOに統合した安全な強化学習安全強化学習2026/3/1
線形時相論理(LTL)で記述された安全制約をPPOに統合し、制約違反を監視してペナルティ信号に変換することで、安全な強化学習を実現するフレームワークを提案した。
- アクションチャンキングフローポリシーのためのネイティブ継続学習VLA2026/2/1
フローベースVLAポリシーのアクションチャンク境界の不連続を訓練時に滑らかにするLegatoを提案し、実機マニピュレーションでRTCを上回る性能を示した。
- 視点汎化可能なロボットマニピュレーションのための幾何学的3D視覚表現学習マニピュレーション2026/1/1
単視点の3D事前学習とマルチステップ蒸留により、多様なカメラ視点に汎化するマニピュレーション方策を学習するフレームワークを提案。
- 指し示す場所を意図せよ:視覚的根拠に基づく指示ポリシーVLA2025/12/1
言語指示にバウンディングボックスなどの視覚的手がかりを追加することで、混雑環境や未知物体でも対象を正確に特定できるVLAポリシー「Point-VLA」を提案し、自動データ注釈パイプラインで効率的に学習した。
- HYPE: 自車提案条件付き予測を用いたハイブリッド計画計画2025/10/1
学習した提案モデルからのマルチモーダル軌道提案をMCTSのヒューリスティック事前分布として統合し、自車条件付き占有予測で双方向相互作用をモデル化する都市環境向け計画手法を提案。
- WeatherPrompt: 全天候ドローン視覚的自己位置推定のためのマルチモーダル表現学習VLA2025/8/1
大規模マルチモーダルモデルで天候をテキスト化し、画像特徴と融合することで天候に不変なドローン位置推定を実現した研究。
- CHARM: 人間の特性を考慮した強化学習モデリング強化学習2025/6/1
人間のフィードバックパターンが、タスク統計だけでなく、ロボット経験や教育背景などの人間の特性と相関することを46人の参加者による実験で示し、人間の特性を用いることでフィードバック価値をより正確に予測できることを実証した。
- DexH2R: 人からロボットへの受け渡しにおける動的な巧みな把持のベンチマークマニピュレーション2025/6/1
巧みなロボットハンドへの人間からの受け渡しを対象に、多様な物体・動き・視覚データと詳細注釈を備えた実世界データセットDexH2Rを構築し、DynamicGrasp手法を提案して既存手法を比較評価した。
- 実演の寄り道:人間の実演における系統的な非最適行動の分類模倣学習2025/6/1
40人の非専門家によるロボット実演を分析し、非最適行動がランダムノイズではなく「寄り道」として系統的に現れることを示して4種類に分類した研究。
- ロボットディスプレイ設計における表現力と明瞭性:動的・静的表示が協調作業に与える影響HRI2025/6/1
ロボットの目とアイコンのアニメーション表示が、協調ナビゲーション課題での信頼・満足度・解釈しやすさ・成功率にどう影響するかを公共空間で37名を対象に調査した。
- 深度転移:実世界ドローン航法のためのシミュレータのように見る学習sim2real2025/5/1
シミュレータの深度画像をVAEで潜在空間に符号化し、実世界のステレオ深度をその空間に適応させることで、ドローンの障害物回避ポリシーを実環境へ転移する手法を提案。
- 非構造環境における自動駐車のための分割軌道最適化軌道最適化2025/4/1
初期軌道をSQPベースの反復手法で動的に実行可能かつ衝突のない軌道に洗練する分割軌道最適化(STO)を提案し、垂直・斜め駐車のシミュレーションで効率と安全性を検証した。
- 多様な運転状況における人間の交通・安全ルール遵守の分析自動運転データセット分析2024/11/1
複数の軌道予測データセット(Argoverse 2、nuPlan、Lyft、DeepUrban)を用いて、人間の交通・安全ルール遵守状況を比較評価し、データのノイズや望ましくない運転行動を明らかにした。
- 重要なものに集中:視覚ベース強化学習の汎化のための分離モデル強化学習/汎化2024/10/1
画像再構成を活用しつつ、タスク関連・無関連の表現を分離する2分岐モデルと一貫性損失で、未知環境への汎化性能を高める手法SMGを提案。
- SDP: 学習可能なチャネル別膜閾値を持つスパイキング拡散ポリシーによるロボットマニピュレーションマニピュレーション2024/9/1
拡散ポリシーにスパイキングニューラルネットワークと学習可能なチャネル別膜閾値を組み込み、省エネルギーかつ高性能なロボットマニピュレーション手法を実現した。
- どこまで進んだ?ロボット教育のための未探索の人間フィードバック信号人間-ロボットインタラクション2024/7/1
タスクの完了度合いを示す「進捗」信号を人間の教示に用いる手法を提案し、オンラインと公共空間の実験で有効性を検証した。
- MAVRL: Learn to Fly in Cluttered Environments with Varying Speed2024/2/1
- From "Thumbs Up" to "10 out of 10": Reconsidering Scalar Feedback in Interactive Reinforcement Learning2023/11/1
- 6-DoF Robotic Grasping with Transformer2023/1/1
- AvoidBench: A high-fidelity vision-based obstacle avoidance benchmarking suite for multi-rotors2023/1/1
- Context Model for Pedestrian Intention Prediction using Factored Latent-Dynamic Conditional Random Fields2019/7/1