Gang Chen
Zyllion Data Technology (Shanghai) Co.,Ltd.
収録論文 28本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- AIによる宇宙ロボット運用:技術・課題・展望宇宙ロボティクス2026/9/15
宇宙ロボットの自律性と適応性を高めるAI技術を、能力構築の観点から3層フレームワークで整理し、今後の研究方向を提示したレビュー論文。
- フィジカルAIの能力形成における7つの源泉フィジカルAI2026/9/9
フィジカルAIの能力がどのように形成されるかを整理し、記録経験・予測モデリング・評価的相互作用・代理環境・機構基盤・身体結合・進化駆動という7つの非排他的な源泉を提唱した論文。
- ランダム有限集合上のリスク認識信念制御バリア関数安全制御2026/7/1
未知・動的な環境で移動物体の数が変動する中、ノイズを含む不完全な観測から安全性を保証する制御手法を提案。粒子フィルタで信念を表現し、リスクを考慮したバリア関数で安全集合の不変性を確保する。
- 検証ゲート型エージェントによる産業用マルチロボットシステムのミッション状態ガバナンス群制御2026/6/1
産業用マルチロボットシステムにおいて、エージェントが提案する行動を検証ゲートで制御し、タスク依存関係や安全性を保証するフレームワークを提案・評価した論文。
- セット教師付き拡散ポリシー:修正を通じたアクションチャンク拡散の学習模倣学習/拡散ポリシー2026/6/1
ロボットの望ましくない動作と人間の修正動作のペアを利用し、拡散ポリシーを望ましいアクションチャンクのセットに整列させる新しい学習フレームワークを提案。
- OpenSGA: オープンワールドにおける効率的な3Dシーングラフアライメント3Dシーングラフ2026/5/1
3Dシーングラフ間のオブジェクト対応を推定する統一フレームワークを提案し、視覚言語・テキスト・幾何特徴を融合して大規模座標ずれでも高精度なアライメントを実現。大規模データセットScanNet-SGも導入。
- VitaTouch: 製造業におけるロボット品質検査のための特性認識型視覚-触覚-言語モデル触覚/品質検査2026/4/1
視覚情報だけでは困難な材料特性の推定と自然言語による属性記述を実現するため、視覚・触覚・言語を統合したモデルVitaTouchを提案し、データセットVitaSetを構築して性能を評価した。
- ゼロショットなオープンワールド物体操作のための明示的世界モデル構築マニピュレーション2026/3/1
ロボットのオープンワールド物体操作を、環境のデジタルツインを構築し物理シミュレータで操作戦略を探索・評価することで、行動デモなしにゼロショットで実現するフレームワークを提案した。
- BEACON: 遮蔽下での言語条件付きナビゲーション可能性予測ナビゲーション2026/3/1
ロボットの周囲の遮蔽領域を含む鳥瞰図上で、言語指示に基づく移動可能な目標位置を予測する手法を提案。視覚言語モデルと深度情報を融合し、従来の画像空間予測より高い精度を達成した。
- VLM-DEWM: 製造業における検証可能で堅牢な視覚言語プランニングのための動的外部世界モデルVLA2026/2/1
VLMの推論と世界状態管理を分離し、永続的で照会可能な外部世界モデルで検証・回復を行う認知アーキテクチャを提案し、状態追跡精度と回復成功率を大幅に改善した。
- MobileOcc: 移動ロボットのための人間認識型セマンティック占有データセットデータセット/セマンティック占有2025/11/1
歩行者が多い環境で動作する移動ロボット向けに、静的物体と変形する人間の形状をLiDARで最適化して注釈付けした3Dセマンティック占有データセットを構築し、占有予測と歩行者速度予測のベンチマークを提供した。
- SatAOI: スイングアーム式左官ロボットのための関心領域設定アルゴリズム建設ロボット/経路計画2025/5/1
建設現場のコンクリート左官作業を行うスイングアーム式ロボットについて、障害物マップと衝突判定に基づき作業対象領域(AOI)を自動で区切るアルゴリズムを提案した。
- 知覚・推論・適応:VLM誘導による精密ロボットマニピュレーションのための二層フレームワークVLA2025/3/1
VLMによる高レベル計画を細かい動作列に分解し、タスクメモリ・2Dトポロジグラフ・3D空間ネットワークを併用して、高速かつ高精度で誤り訂正可能な精密マニピュレーションを実現する手法を提案した。
- 障害物の可動性を考慮した散らかった環境の押し退けナビゲーションナビゲーション2025/2/1
障害物の可動性を連続値として扱い、Semantic Visibility GraphとMPPIを組み合わせて、接触力を抑えつつ障害物を押し退けて目的地へ到達する計画手法を提案した論文。
- 3D空間接地型視覚言語フレームワークによるロボットタスク計画:プロンプト自動合成と教師あり推論VLA2025/2/1
2D画像を点群にマッピングしてVLMに3D空間情報を自動抽出させ、小型言語モデルで出力を監督することで、幻覚を抑え高信頼なロボット制御コードを生成するフレームワークを提案。再学習不要で96%のタスク成功率を達成した。
- テキストと視覚を繋ぐ:クロスモーダル場所認識のためのマルチビューテキスト・視覚位置合わせ手法VLA2025/2/1
テキスト記述のみで画像データベースを照合する初の場所認識手法Text4VPRを提案し、360度マルチビュー画像との位置合わせを実現した。
- 自己運動補償によるイベントカメラからの単眼深度学習単眼深度推定2024/12/1
イベントカメラのデータに物理的な運動補償の原理を組み込み、焦点の合い具合を手がかりに解釈可能な単眼深度推定を行うフレームワークを提案した。
- 動的環境における粒子ベースのインスタンス認識型セマンティック占有マッピングセマンティックマッピング2024/9/1
粒子フィルタを用いて動的環境の物体をインスタンス・セマンティクス・占有状態を同時に推定する地図構築手法を提案し、ノイズ下でも高精度を実現した。
- 認知マニピュレーション:半構造環境での組立のための半教師あり視覚表現と教室から実機への強化学習マニピュレーション2024/6/1
スキルグラフで物体検出と微細操作を統合し、半教師あり学習と教室から実機への強化学習により、半構造環境でのギア組立を高精度に実現した。
- 動的環境における障害物回避の難易度評価ベンチマーク障害物回避2024/4/1
動的障害物回避の性能評価のため、障害物の数・大きさ・速度などを考慮した4つの難易度指標を提案し、150万回以上のシミュレーション実験で既存指標と比較検証した。
- 時空間占有グリッドマップを用いた動的環境における分散型マルチエージェント軌道計画群制御2024/4/1
時空間占有グリッドマップで近未来の占有状態を予測し、動的障害物を含む環境で複数の小型飛行ロボットが衝突回避しながら分散的に軌道計画する手法を提案した。
- Continuous Occupancy Mapping in Dynamic Environments Using Particles2022/2/1
- Obstacle Avoidance of Resilient UAV Swarm Formation with Active Sensing System in the Dense Environment2022/2/1
- Risk-aware Trajectory Sampling for Quadrotor Obstacle Avoidance in Dynamic Environments2022/1/1
- Agile Formation Control of Drone Flocking Enhanced with Active Vision-based Relative Localization2021/8/1
- An Active Sense and Avoid System for Flying Robots in Dynamic Environments2020/10/1
- Learning to Navigate from Simulation via Spatial and Semantic Information Synthesis with Noise Model Embedding2019/10/1
- Correct-by-Construction Approach for Self-Evolvable Robots2017/2/1