Wei Chen
National University of Defense Technology
収録論文 37本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 会話は不要、視覚に再注力:マルチモーダル大規模言語モデルにおける推論セグメンテーションのための潜在推論VLA2026/9/25
明示的なChain-of-Thoughtの代わりに学習可能な潜在トークンを用いて推論セグメンテーションを行うLIRSegを提案し、セグメンテーション精度と推論効率を向上させた。
- 連続体マニピュレータ向け支援強化型粒状ジャミンググリッパと強化学習による把持把持/ジャミンググリッパ2026/9/24
連続体マニピュレータ先端に装着する軽量な支援構造付き粒状ジャミンググリッパを設計し、膜材料や粒子・充填率・内部支持構造を最適化して把持境界を明らかにするとともに、強化学習による到達制御を実機に展開して把持・解放タスクを実現した。
- 想像して検証:散らかった環境でのタスク指向把持のためのアフォーダンス標的型能動知覚マニピュレーション2026/9/20
物体の機能部位(例:注ぐための取っ手)が隠れた環境で、生成形状事前分布で隠れた形状を想像し、アフォーダンスの不確実性を考慮した視点計画で効率的に検証して把持する枠組みを提案。
- HitMem: 動的環境のための階層的時間的3Dメモリとマルチモーダル文脈認識検索3Dメモリ/動的環境/ナビゲーション2026/9/1
動的環境で物体が移動した際のメモリと観測の矛盾を解決するため、階層的時間的3DメモリフレームワークHitMemを提案し、物体の再発見精度とタスク実行性能を向上させた。
- VBVR-Pro: ネイティブ視覚推論のためのスケーラブルで検証可能なスイート視覚推論2026/8/26
視覚生成を推論の媒体として扱うネイティブ視覚推論の研究を進めるため、300の手続き生成タスクからなる閉ループテストベッドVBVR-Proを導入し、検証可能な報酬スコアラと制御されたモダリティ比較を提供する。
- EPS3D: エンドツーエンドのフィードフォワード型3Dパノプティックセグメンテーション3Dセグメンテーション2026/6/8
多視点画像から3Dセマンティック特徴とインスタンス特徴を直接予測するエンドツーエンドのフレームワークを提案し、相互強化モジュールでセマンティクスとインスタンスの一貫性を高めた。
- InvariantCloud: ロバストな6自由度触覚ポーズ追跡のための大域不変・一意インデックス点群フレームワーク触覚2026/5/1
視覚ベース触覚センサの表面マーカー配置の大域不変性を利用し、累積ドリフトを抑えつつヨー回転推定を高精度化する6自由度ポーズ推定フレームワークを提案した。
- MindVLA-U1: 統合ストリーミングアーキテクチャによる自動運転向けVLAがVAを凌駕自動運転/VLA2026/5/1
自動運転向けに、言語トークンと連続アクション軌道を単一の共有表現で生成する初の統合ストリーミングVLAアーキテクチャを提案し、従来のVAモデルを上回る性能を実現した。
- マルチトークン予測と潜在意味拡張による一貫した世界モデルの構築世界モデル2026/4/7
LLMの内部世界モデルの一貫性を高めるため、マルチトークン予測(MTP)の理論的利点を分析し、構造的幻覚を防ぐ潜在意味拡張MTP(LSE-MTP)を提案した。実験で表現の整合性向上と幻覚低減を確認した。
- QuietWalk: 接地反力を考慮した多様な履物条件下での人型ロボット歩行のための物理情報強化学習歩行2026/4/1
物理情報強化学習を用いて、接地反力を推定し、歩行時の衝撃力を抑えることで、様々な履物条件下で静かで安定した人型ロボットの歩行を実現した。
- 自動運転のための言語-行動の理解と生成の統合自動運転/VLA2026/3/1
自動運転向けのVLAモデルにおいて、言語と行動のトークンを共有コードブックで統合し、補助的な行動理解目標と粗密生成法を導入することで、指示追従精度と推論効率を向上させた。
- 単一ロボットアームによる視覚ベース触覚センシングを用いた両手布操作の学習布操作/触覚2026/3/1
布操作の課題に対し、単一アームで両手操作を実現する触覚グリッパと認識・制御フレームワークを提案し、布の分類とエッジ位置推定を高精度で行う。
- オンデバイスLLMのためのハードウェア協調設計スケーリング則:ルーフライン・モデリングによるアプローチVLA2026/2/10
オンデバイスLLMのアーキテクチャ選択を高速化するため、訓練損失のスケーリング則と推論レイテンシのルーフラインモデルを組み合わせ、精度とレイテンシのパレートフロンティアを導出するハードウェア協調設計手法を提案した。
- 生体力学比較が明らかにする人間とヒューマノイドの歩容の相違歩行2026/2/1
人間と二足歩行ロボットの歩行を28速度で生体力学的に比較する枠組みGDAFを提案し、データセットとツールを公開した。見た目が人間らしくても歩容対称性・エネルギー配分・関節協調に大きな差異が残ることを示した。
- デジタルツインと深層強化学習による車両アクティブサスペンションの制御協調設計制御協調設計2025/12/1
デジタルツインと深層強化学習を組み合わせ、車両アクティブサスペンションの物理設計と制御則を運転行動や環境の不確実性下で同時最適化する枠組みを提案した。
- EmbodiedBrain: 具現化知能のためのタスクプランニング性能の限界を拡張するVLA2025/10/1
7Bと32Bの視覚言語基盤モデルEmbodiedBrainを提案し、SFTとStep-GRPOを組み合わせた学習法と新しい評価環境で具現化タスクの計画性能を向上させた。
- 腱駆動の機械的ロック機構で剛性を切り替えるモジュラーロボット用プログラマブルロッキングセル可変剛性/モジュラーロボット2025/9/1
ケーブル張力で関節を機械的に噛み合わせ、柔軟状態と高剛性状態を切り替えられるモジュール式ユニットを開発し、把持と管内移動ロボットで有効性を示した。
- ARK: ロボット学習のためのオープンソースPythonベースフレームワークロボット学習フレームワーク2025/6/1
Python中心のロボット学習フレームワークARKを提案し、Gym風環境でシミュレーションと実機を切り替えながら模倣学習アルゴリズムを簡単に使えるようにした。
- 膝なし二足歩行ロボットSLIDERのための拡張ハイブリッドゼロダイナミクス歩行2025/4/1
膝なし二足歩行ロボットSLIDERのハードウェアを改良し、拡張ハイブリッドゼロダイナミクスと深層強化学習を組み合わせて、MPCベースの手法より150%高速な歩行制御を実現した。
- GraphGarment: 両手布操作のための衣服ダイナミクス学習マニピュレーション2025/3/1
グラフニューラルネットワークで衣服の動きをモデル化し、残差モデルでsim-to-realギャップを補正することで、ロボットが両手で衣服を吊るすタスクを実現した研究。
- Haptic-ACT: 没入型VRによる人間の直感と柔軟なロボットマニピュレーションの橋渡しマニピュレーション2024/9/1
没入型VRテレオペレーションで実演データを収集し、触覚フィードバックを活用した模倣学習フレームワークHaptic-ACTを提案。柔軟なマニピュレーションを実現する。
- 長期的ロボットタスク理解のためのバックボーン模倣学習2024/8/1
動作要素(サーブリッグ)単位でタスクを分解し、一回の実演から新規シナリオへ軌道を転移できるロボット学習フレームワークを提案。
- 疎なFBG計測による高柔軟手術マニピュレータの形状と力の同時推定触覚2024/4/1
単一コアFBGファイバの疎なひずみ計測から、深層学習を用いて高柔軟な手術ロボットの形状と接触力を同時に推定する手法を提案した。
- G.O.G: A Versatile Gripper-On-Gripper Design for Bimanual Cloth Manipulation with a Single Robotic Arm2024/1/1
- Synthetic data enables faster annotation and robust segmentation for multi-object grasping in clutter2024/1/1
- TraKDis: A Transformer-based Knowledge Distillation Approach for Visual Reinforcement Learning with Application to Cloth Manipulation2024/1/1
- Soft Decomposed Policy-Critic: Bridging the Gap for Effective Continuous Control with Discrete RL2023/8/20
- Physics-aware differentiable design of magnetically actuated kirigami for shape morphing2023/8/1
- Learning to Grasp Clothing Structural Regions for Garment Manipulation Tasks2023/6/1
- Autonomous Intelligent Navigation for Flexible Endoscopy Using Monocular Depth Guidance and 3-D Shape Planning2023/2/1
- FBG-Based Variable-Length Estimation for Shape Sensing of Extensible Soft Robotic Manipulators2022/12/1
- Path Planning Considering Time-Varying and Uncertain Movement Speed in Multi-Robot Automatic Warehouses: Problem Formulation and Algorithm2022/12/1
- FBG-Based Online Learning and 3-D Shape Control of Unmodeled Continuum and Soft Robots in Unstructured Environments2022/9/1
- Model-Free 3D Shape Control of Deformable Objects Using Novel Features Based on Modal Analysis2022/7/1
- Tele-Operated Oropharyngeal Swab (TOOS) RobotEnabled by TSS Soft Hand for Safe and EffectiveCOVID-19 OP Sampling2021/9/1
- A Learning-Driven Framework with Spatial Optimization For Surgical Suture Thread Reconstruction and Autonomous Grasping Under Multiple Topologies and Environmental Noises2020/7/1
- A real-time multi-constraints obstacle avoidance method using LiDAR2020/6/1