Xiao Ma
ByteDance Seed
収録論文 30本 ・ フィジカルAI/ロボット学習
VLA/操作データマイニング/器用操作/VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- BridgeVLA++: データ効率的で汎化性が高く、メモリ拡張された3D操作のための視覚-言語-行動フレームワークVLA/操作2026/8/5
事前学習済み視覚言語モデルを活用した3Dロボット操作フレームワークBridgeVLAを拡張し、空間的・時間的メモリを統合することで、データ効率と汎化性を保ちつつ、記憶依存の操作タスクで最先端の性能を達成した。
- SiMDex: 類似する自己中心視点動画のマイニングによるクロス身体性器用操作データマイニング/器用操作/VLA2026/8/4
ロボットの器用操作のためのVLAモデル訓練に有効な人間の自己中心視点動画を、類似性に基づくデータマイニングで選別するフレームワークを提案。約3200万サンプルから1.49M件を選び、成功率を47.7%から61.1%に向上させた。
- BridgeVLA++: A Data-Efficient, Generalizable, and Memory-Augmented Vision-Language-Action Framework for 3D Manipulation2026/8/1
- SiMDex: Mining Similar Egocentric Videos for Cross-Embodiment Dexterous Manipulation2026/8/1
- TTT-VLA: Test-Time Latent Prompt Optimization for Vision-Language-Action Models2026/6/1
- World Value Models for Robotic Manipulation2026/6/1
- Hand-in-the-Loop: Improving VLA Policies for Dexterous Manipulation via Seamless Hand-Arm Intervention2026/5/1
- GR-Dexter Technical Report2025/12/1
- GR-RL: Going Dexterous and Precise for Long-Horizon Robotic Manipulation2025/12/1
- WMPO: World Model-based Policy Optimization for Vision-Language-Action Models2025/11/1
- ByteWrist: A Parallel Robotic Wrist Enabling Flexible and Anthropomorphic Motion for Confined Spaces2025/9/1
- GR-3 Technical Report2025/7/1
- Human-assisted Robotic Policy Refinement via Action Preference Optimization2025/6/1
- Chain-of-Action: Trajectory Autoregressive Modeling for Robotic Manipulation2025/6/1
- BridgeVLA: Input-Output Alignment for Efficient 3D Manipulation Learning with Vision-Language Models2025/6/1
- Environment-Driven Online LiDAR-Camera Extrinsic Calibration2025/2/1
- What Matters in Building Vision-Language-Action Models for Generalist Robots2024/12/1
- Effective Tuning Strategies for Generalist Robot Manipulation Policies2024/10/1
- Green Screen Augmentation Enables Scene Generalisation in Robotic Manipulation2024/7/1
- BiGym: A Demo-Driven Mobile Bi-Manual Manipulation Benchmark2024/7/1
- Redundancy-aware Action Spaces for Robot Learning2024/6/1
- Hierarchical Diffusion Policy for Kinematics-Aware Multi-Task Robotic Manipulation2024/3/1
- InsActor: Instruction-driven Physics-based Characters2023/12/1
- DaXBench: Benchmarking Deformable Object Manipulation with Differentiable Physics2022/10/1
- Imitation Learning via Differentiable Physics2022/6/1
- Hierarchical Reinforcement Learning under Mixed Observability2022/4/1
- Ab Initio Particle-based Object Manipulation2021/7/1
- Learning Latent Graph Dynamics for Visual Manipulation of Deformable Objects2021/4/1
- Spatio-Temporal Graph Transformer Networks for Pedestrian Trajectory Prediction2020/5/1
- Differentiable Algorithm Networks for Composable Robot Learning2019/5/1