Dezhen Song
収録論文 28本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ロボットデータファクトリー:物理AIのための経験生成基盤データ基盤2026/9/15
ロボットの生データではなく物理的経験を継続的に生成・検証・再利用する基盤「Robot Data Factory」を提案し、その階層構造とスケーリング則を定式化した。
- フィードフォワード3Dモデルを用いた単眼視覚慣性システムの効率的な特徴点フリー初期化視覚慣性初期化2026/5/1
単眼VINSの初期化を、視覚特徴追跡を使わずにフィードフォワード3Dモデルが予測する点群を利用して行う手法を提案し、成功率90%以上・データ所要時間1.2秒未満を達成した。
- 観察対象の選択:視覚運動ポリシーのためのタスク認識型意味幾何表現視覚運動ポリシー2026/3/1
RGB画像とタスク関連エンティティの指定から、対象物とロボットをセグメント化し、意味色と深度情報を統合した標準的な3チャンネル画像表現を構築する観察インターフェースを提案。外観変化に対するロバスト性を向上させる。
- 不確実性を考慮した葉に隠れたイチゴの把持マニピュレーション2026/1/1
葉による遮蔽で生じる形状の不確実性をモンテカルロドロップアウトで複数仮説としてモデル化し、力閉包指標に基づく保守的な把持可否判断を行う手法を提案。
- 腱駆動連続ロボットの知覚指向モデリングのための統合マルチダイナミクスフレームワーク連続ロボット/知覚2025/11/1
腱駆動連続ロボットにおいて、モータの電気・機械ダイナミクスとロボット本体のダイナミクスを統合したモデルを構築し、外部センサなしで接触検知や物体サイズ推定などの知覚を実現するフレームワークを提案した。
- LAVQA: 自動運転車の共有自律のための遅延認識型視覚質問応答フレームワークVLA2025/11/1
無線遅延と人間の応答時間を考慮した衝突リスクマップを視覚質問応答に組み込み、遠隔操作者が安全に自動運転車を支援できる枠組みを提案し、CARLAシミュレーションで衝突率を8倍以上削減した。
- 複数の局所制約を同時に取り込むための姿勢学習と適応マニピュレーション2025/10/1
回転群SO(3)上の姿勢学習において、角度-軸表現と重み付き平均機構を提案し、複数の局所制約を同時に取り込むことで滑らかな軌道生成を実現した。
- 推論時の想像:ロバストな視覚運動ポリシー推論のためのハンド内視点の合成VLA2025/9/1
ロボットにハンド内カメラがない場合でも、拡散モデルを用いてエージェント視点からハンド内視点を想像することで、視覚運動ポリシーの性能低下を回復させる手法を提案。
- 疲労認識機能を備えたハイブリッドヒンジ・ビーム連続体ロボットと受動的安全キャッピング連続体ロボット2025/9/1
トーションビームとベンドビームを分離したハイブリッド構造と受動ストッパにより、追加センサなしでモータトルクから疲労をリアルタイム推定できる連続体ロボットを提案し、従来比約49%の疲労低減を実現した。
- GeoAware-VLA: 幾何学認識を組み込んだ視覚-言語-行動モデルVLA2025/9/1
凍結した幾何学視覚モデルを特徴抽出器として使い、軽量な投影層でポリシーに適応させることで、未見のカメラ視点への汎化性能を大幅に向上させたVLAモデル。
- ポテンシャル場誘導フローマッチングによる安全な模倣学習模倣学習2025/8/1
成功デモからタスク方策と障害物情報(ポテンシャル場)を同時に学習し、推論時にフローマッチングのベクトル場をポテンシャル場で変調することで、タスク成功率を保ちながら衝突を大幅に削減する手法PF2MPを提案した。
- ロボット知覚のためのスーパーLiDAR強度LiDAR知覚2025/8/1
低コストLiDARの疎なスキャンデータから、非反復走査LiDARの特性を活かして高密度な強度画像を生成するフレームワークを提案し、ループ閉じ込めや車線検出などへの応用を示した。
- 部分遮蔽物体の把持のための点群補完手法とロボットイチゴ収穫への応用マニピュレーション2025/6/1
イチゴ収穫を例に、部分遮蔽された物体の点群を補完して把持計画を行うエンドツーエンドフレームワークを提案し、把持成功率と安全性を向上させた。
- SmallPlan: 小型言語モデルを活用したシミュレーション駆動・LLM誘導蒸留による逐次経路計画経路計画2025/5/1
LLMを教師として小型言語モデルを訓練し、シミュレーションと強化学習を組み合わせて、エッジデバイスでも動作する効率的な経路計画を実現した。
- 精密農業における反復的な異種タスクのためのエネルギー効率の良い計画モバイルマニピュレーション2025/4/1
精密農業でのロボット除草を対象に、観察してから操作する順序制約とタスクの共同配置による省エネを考慮した反復異種タスク計画を、確率的再生過程と混合整数非線形計画として定式化し、分枝限定法で解く手法を提案した。
- 地中レーダ支援によるマルチモーダルロボットオドメトリ:地下特徴行列の活用マルチモーダルオドメトリ2025/3/1
地中レーダ(GPR)・IMU・車輪エンコーダを統合し、地下の特徴を周波数領域で表現するSFMと特徴マッチングにより、天候や表面変化に頑健なロボット自己位置推定を実現した。
- OSM誘導自律ナビゲーションのための方位場学習自律ナビゲーション2025/3/1
LiDARスキャンとOSM経路を統合し、ノイズや遮蔽に頑健な方位場(OrField)を学習して、OSM誘導の軌道計画を高精度化する二段階フレームワークを提案した。
- 移動マニピュレータと火炎放射器による精密なロボット除草焼却マニピュレーション2024/7/1
移動マニピュレータに火炎放射器を搭載し、赤外線カメラとノズル姿勢から火炎の動的な広がりをリアルタイムにモデル化して、精密な除草焼却を可能にするシステムを開発した。
- A Fingertip Sensor and Algorithms for Pre-touch Distance Ranging and Material Detection in Robotic Grasping2023/11/1
- Calibration System and Algorithm Design for a Soft Hinged Micro Scanning Mirror with a Triaxial Hall Effect Sensor2023/11/1
- Road Boundary Estimation Using Sparse Automotive Radar Inputs2023/9/1
- Coupled Active Perception and Manipulation Planning for a Mobile Manipulator in Precision Agriculture Applications2023/9/1
- DIME-Net: Neural Network-Based Dynamic Intrinsic Parameter Rectification for Cameras with Optical Image Stabilization System2023/3/1
- STA-VPR: Spatio-temporal Alignment for Visual Place Recognition2021/3/1
- Gaussian Processes Model-based Control of Underactuated Balance Robots2020/10/1
- Graph-based Proprioceptive Localization Using a Discrete Heading-Length Feature Sequence Matching Approach2020/5/1
- Model Quality Aware RANSAC: A Robust Camera Motion Estimator2019/11/1
- Semi-Semantic Line-Cluster Assisted Monocular SLAM for Indoor Environments2018/11/1