Aniket Bera
University of Maryland
収録論文 66本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 創発か帯域か:物理的結合と学習型マルチエージェント通信の限界マルチエージェント通信2026/9/28
レート制限付きマルチエージェント系で最適なメッセージ設計を理論的に解明し、MuJoCo環境で物理的結合の度合いが学習通信の有効性を左右することを示した。
- リーマン平均流による行動多様体上の高速視覚運動方策学習VLA2026/9/24
ロボットの行動系列が滑らかな多様体上に定義されることに着目し、リーマン条件付きフローマッチングを基盤としたフローマップ整合性目的で、1回のネットワーク評価で多様体上の行動生成を可能にするRMFPを提案した。
- Noctif3R: 組み込みハードウェア上での光子制限シーン向けフィードフォワード単眼リアルタイムSLAMSLAM2026/9/17
極暗環境で単眼カメラからリアルタイムに自己位置推定するSLAMを提案。低光量フィードフォワード点マップとマッチゲートで、既存手法が失敗する暗所でも追跡可能にし、Jetson AGX Orin上で動作。
- HEROIC: 異種ロボットの証拠推論によるオープンボキャブラリ同定と協調群制御2026/9/17
空中・地上ロボットが自然言語のみで通信し、センサ特性とスケール則に基づいて役割を動的に再割り当てしながらオープンボキャブラリ探索を行う分散協調フレームワークを提案。
- M³P-R1: 大規模言語モデルによるマルチモーダル動作計画のための強化学習とMIPコード生成動作計画2026/9/16
大規模言語モデルを強化学習で微調整し、マルチモーダル動作計画問題を混合整数計画(MIP)のコードとして生成・求解する手法を提案。
- 潜在エネルギー行動計画とワールドモデル計画/ワールドモデル2026/9/3
潜在ワールドモデルを用いたモデル予測制御において、行動系列全体を最適化変数として扱い、終端状態のエネルギー最小化と目標記述子の一致を組み合わせる新しい計画手法LEAPを提案。4つの制御ドメインで成功率を77.5%から94.8%に向上させた。
- リー群制約付きMeanFlowによる高速生成的把持マニピュレーション2026/8/26
リー群上のMeanFlowを用いて、少数のネットワーク評価で高品質な把持を生成する手法を提案し、ACRONYMデータセットで既存手法と同等の性能を達成しつつ最大39倍の高速化を実現した。
- MIME: マルチモーダル対話型モーションエンコーダモーション表現学習2026/7/18
二人の対話的な動きを言語と関連付けるための、専用のマルチモーダルエンコーダを提案した。
- COLMAR: マルチエージェント能動的3次元再構成のための協調視点ポリシー学習群制御2026/7/1
複数のエージェントが限られたセンシング予算で効率的に視点を選び、冗長観測や空間的偏りを減らして高品質な3次元再構成を行う協調視点ポリシー学習フレームワークを提案した。
- LatentMimic: 潜在空間模倣による地形適応型歩容生成歩行2026/4/1
模倣学習と地形適応のトレードオフを解消するため、潜在空間での分布乖離最小化により歩容スタイルを保ちつつ、地形に応じた脚先適応を可能にする四足歩行制御フレームワークを提案した。
- CoReLIN: 制約ベース推論によるゼロショット生涯対話型ナビゲーションナビゲーション2026/2/1
LLMとシーングラフを用いて、移動ロボットが障害物を移動させ経路を切り開きながら連続的な物体配置タスクをこなす生涯対話型ナビゲーション手法を提案。
- 空間平滑化による価値学習強化学習2026/2/1
オフライン目標条件付き強化学習において、距離的制約を局所空間測度の期待値として再解釈し、微分演算子を必要とせずに構造化された価値表現を学習する手法を提案。
- HAVEN: 階層型敵対者認識可視性ナビゲーションとカバー活用のための深層トランスフォーマーQネットワークナビゲーション2025/12/1
部分的に観測可能な環境での自律ナビゲーションのため、深層トランスフォーマーQネットワークでサブゴールを選択し、可視性を考慮した候補生成と低レベル制御を組み合わせる階層型フレームワークを提案。2Dシミュレーションと3D Unity-ROS環境で有効性を検証。
- VLAD-Grasp: 視覚言語モデルによるゼロショット把持検出マニピュレーション2025/11/1
視覚言語モデルを活用し、学習なしで物体の把持姿勢を検出するゼロショット手法を提案。仮想円筒プロキシを生成して3D点群を整合させ、実機ロボットで汎化性能を示した。
- 論理誘導型ソーシャル対応ロボットナビゲーション世界モデルナビゲーション2025/10/1
LLMの推論に時空間世界モデルと一階述語論理による思考連鎖を組み合わせ、社会的規範を守りつつ安全に人混みをナビゲートする手法NaviWMを提案した。
- SE(3)上の把持拡散のための変分形状推論マニピュレーション2025/8/1
形状の変分推論と拡散モデルを組み合わせ、SE(3)多様体上で多様な安定把持を生成する手法を提案。ノイズや点群の疎さに頑健で、実世界の家庭用品操作にもゼロショット転移できる。
- テキスト指示に基づく効率的な個別検査計画の生成VLA2025/6/1
VLMを活用し、テキスト記述から関心点を抽出して巡回順序を最適化し、航空・水中ビークルのための効率的な検査軌道を生成する手法を提案。
- HessianForge: 物理情報ニューラル表現と平滑化エネルギー制約によるスケーラブルなLiDAR再構成3D再構成/sim2real2025/3/1
LiDAR点群から表面の滑らかさを物理情報損失で制約し、大規模屋外環境のSDFを学習して高品質なメッシュを再構成する手法を提案。
- Signal Temporal Logic仕様のためのスケーラブルな安全マルチエージェント制御群制御2025/1/1
グラフニューラルネットワークと衝突回避制御を組み合わせ、STL仕様を満たす安全なマルチエージェント計画を分散的に生成する手法を提案し、既存のMILPベース手法よりスケーラブルで高性能であることを示した。
- EfficientEQA:オープン語彙な身体性質問応答への効率的アプローチVLA2024/10/1
ロボットが効率的に探索しながら自由形式で質問に答えるためのフレームワークを提案し、意味重視の探索と適応的停止、RAGによる回答生成で精度向上と探索ステップ削減を実現した。
- ゾーン分割強化学習とRRTを統合した衝突確率・接続性考慮の経路計画経路計画2024/10/1
kd-treeで地図をゾーン分割し、Q学習でゾーン間の接続を考慮しながらRRTと組み合わせることで、高次元環境でも高速かつ高成功率な経路計画を実現した。
- 深層強化学習によるスケーラブルなマルチロボット情報経路計画群制御2024/9/1
未知の3D環境で静止ターゲットを効率的に発見するため、集中訓練・分散実行と協調グラフを用いた深層強化学習手法を提案し、最大64台のロボットで従来手法を上回る性能を実現した。
- 不確実性に基づく適応的計画による動的障害物回避と拡散モデル拡散モデル計画2024/9/1
拡散モデルを用いた計画において、行動予測の不確実性に応じて再計画の頻度を適応的に調整し、計算コストを抑えつつ動的障害物回避の性能を向上させる手法を提案した。
- ハイパーグラフによるマルチロボットの協調タスク割り当てと社会的配慮ナビゲーション群制御2024/9/1
ハイパーグラフとマルチエージェント強化学習を用いて、人混みの中でのロボット群のタスク割り当てと社会的に配慮したナビゲーションを同時に実現する手法を提案した。
- SELP: 大規模言語モデルを用いたロボットエージェントの安全で効率的なタスクプラン生成VLA2024/9/1
自然言語命令からLTL式を生成し、等価投票・制約付きデコーディング・ドメイン特化ファインチューニングを組み合わせて、安全で効率的なロボットのタスクプランを生成する手法SELPを提案した。
- Go-SLAM: ガウススプラッティングSLAMによる物体セグメンテーションと位置推定SLAM2024/9/1
3DガウススプラッティングSLAMを用いて動的環境を再構築し、各ガウスに物体IDを付与することで自然言語での物体検索とロボットの経路生成を可能にしたフレームワーク。
- TrustNavGPT: 不確実性をモデル化し音声誘導LLMロボットナビゲーションの信頼性を向上ナビゲーション2024/8/1
音声のトーンや抑揚といった感情的手がかりを活用し、人間の指示の信頼性を評価して安全なナビゲーション判断を行うLLMベースの音声誘導ロボットナビゲーションエージェントを提案。
- 不確実性下での生成モデルによる適応的プランニングプランニング2024/8/1
生成モデルの長期予測と逆動力学モデルのアンサンブルによる不確実性推定を組み合わせ、再プランニング頻度を約10%まで削減しつつ性能を維持する適応的プランニング手法を提案。
- 大規模言語モデルと深層強化学習を統合した人間参加型インタラクティブ社会的配慮ナビゲーションナビゲーション2024/3/1
人間の言語指示をリアルタイムに解釈し、LLMと深層強化学習を組み合わせて混雑環境での社会的に適切なロボットナビゲーションを実現するフレームワークSALMを提案した。
- テキストを超えて:音声的手がかりを活用したロボットナビゲーションタスクにおけるLLMの意思決定改善VLA2024/2/1
音声の韻律的特徴をLLMに統合し、ロボットの社会的ナビゲーションにおける意思決定精度と敵対的攻撃への堅牢性を向上させる手法を提案した。
- MTAC: Hierarchical Reinforcement Learning-based Multi-gait Terrain-adaptive Quadruped Controller2024/1/1
- MIRACLE: Inverse Reinforcement and Curriculum Learning Model for Human-inspired Mobile Robot Navigation2023/12/1
- DREAM: Decentralized Reinforcement Learning for Exploration and Efficient Energy Management in Multi-Robot Systems2023/9/1
- Optimizing Crowd-Aware Multi-Agent Path Finding through Local Communication with Graph Neural Networks2023/9/1
- ARTEMIS: AI-driven Robotic Triage Labeling and Emergency Medical Information System2023/9/1
- HEROES: Unreal Engine-based Human and Emergency Robot Operation Education System2023/9/1
- Trajectory Prediction for Robot Navigation using Flow-Guided Markov Neural Operator2023/9/1
- Graph-based Decentralized Task Allocation for Multi-Robot Target Localization2023/9/1
- Principles and Guidelines for Evaluating Social Robot Navigation Algorithms2023/6/1
- AZTR: Aerial Video Action Recognition with Auto Zoom and Temporal Reasoning2023/3/1
- SG-LSTM: Social Group LSTM for Robot Navigation Through Dense Crowds2023/3/1
- DroNeRF: Real-time Multi-agent Drone Pose Optimization for Computing Neural Radiance Fields2023/3/1
- Using Graph-Theoretic Machine Learning to Predict Human Driver Behavior2021/11/1
- Redirected Walking in Static and Dynamic Scenes Using Visibility Polygons2021/6/1
- ARC: Alignment-based Redirection Controller for Redirected Walking in Complex Environments2021/1/1
- RAIST: Learning Risk Aware Traffic Interactions via Spatio-Temporal Graph Convolutional Networks2020/11/1
- StylePredict: Machine Theory of Mind for Human Driver Behavior From Trajectories2020/11/1
- Can a Robot Trust You? A DRL-Based Approach to Trust-Driven Human-Guided Navigation2020/11/1
- EWareNet: Emotion Aware Human Intent Prediction and Adaptive Spatial Profile Fusion for Social Robot Navigation2020/11/1
- SeekNet: Improved Human Instance Segmentation and Tracking via Reinforcement Learning Based Optimized Robot Relocation2020/11/1
- CMetric: A Driving Behavior Measure Using Centrality Functions2020/3/1
- ProxEmo: Gait-based Emotion Learning and Multi-view Proxemic Fusion for Socially-Aware Robot Navigation2020/3/1
- Forecasting Trajectory and Behavior of Road-Agents Using Spectral Clustering in Graph-LSTMs2019/12/1
- STEP: Spatial Temporal Graph Convolutional Networks for Emotion Perception from Gaits2019/10/1
- GraphRQI: Classifying Driver Behaviors Using Graph Spectrums2019/10/1
- RobustTP: End-to-End Trajectory Prediction for Heterogeneous Road-Agents in Dense Traffic with Noisy Sensor Inputs2019/7/1
- DensePeds: Pedestrian Tracking in Dense Crowds Using Front-RVO and Sparse Features2019/6/1
- RoadTrack: Realtime Tracking of Road Agents in Dense and Heterogeneous Environments2019/6/1
- Identifying Emotions from Walking using Affective and Deep Features2019/6/1
- The Emotionally Intelligent Robot: Improving Social Navigation in Crowded Environments2019/3/1
- TraPHic: Trajectory Prediction in Dense and Heterogeneous Traffic Using Weighted Interactions2018/12/1
- Pedestrian Dominance Modeling for Socially-Aware Robot Navigation2018/10/1
- PORCA: Modeling and Planning for Autonomous Driving among Many Pedestrians2018/5/1
- The Socially Invisible Robot: Navigation in the Social World using Robot Entitativity2018/5/1
- Identifying Driver Behaviors using Trajectory Features for Vehicle Navigation2018/3/1
- SocioSense: Robot Navigation Amongst Pedestrians with Social and Psychological Constraints2017/6/1