Joydeep Biswas
収録論文 85本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- STARS: 時空間ダイナミクスから人間-ロボット相互作用における社会的表現へVLA2026/9/30
社会的ロボットナビゲーションの場面理解を評価するVQAベンチマークSocialNav-SUBを提案し、最先端VLMが人間やルールベース手法に及ばないことを示した。
- PreSIST: オープンワールドシーンにおける視覚言語情報を活用した物体永続性予測長期環境認識2026/7/1
ロボットが長期間環境を監視する際に、物体が現在の位置にどれだけ留まるかを、シーン文脈と視覚言語モデルを用いて事前に予測する手法を提案した。
- 地形を横断する高速MPCのための汎用車両モデルの適応自動運転/モデル予測制御2026/7/1
汎用の前方動力学予測モデルを、限られた実データと環境固有のシステム同定による合成ロールアウトで微調整し、特定車両向けに特化させつつ地形間の汎化を保つ手法OptCarを提案。3つの地形と外れ値のカート牽引タスクでの閉ループMPC実験で、最高速度6m/sでの追従誤差を約55%削減した。
- 先読み:ナビゲーションに重要な手がかりに関する反復推論ナビゲーション2026/6/1
事前学習済み視覚言語モデルを用いて、疎な言語指示からのナビゲーションにおいて、環境の手がかりを反復的に提案・批評することで、プラン依存の手がかりを発見し、移動計画を改善するフレームワークを提案した。
- VOFA: ヒューマノイドのための力適応制御を用いた視覚目標物体押し操作ロコマニピュレーション2026/5/1
ヒューマノイドロボットが未知の物理特性を持つ物体を目標位置まで押し動かすための、視覚目標条件付きの階層的制御システムを提案した。高レベルの視覚運動ポリシーと低レベルの力適応全身制御を組み合わせ、シミュレーションと実機で高い成功率を達成した。
- GuideTWSI: 視覚障害者ナビゲーションのための合成・実世界画像からの多様な触知歩行表面標示データセットデータセット2026/3/1
視覚障害者向けナビゲーション支援のため、触知歩行表面標示(TWSI)のセグメンテーションに特化した多様なデータセットを構築し、実世界と合成画像を組み合わせて提供する。
- OVerSeeC: 衛星画像と自然言語からのオープンボキャブラリ・コストマップ生成ナビゲーション2026/2/1
衛星画像と自然言語の指示から、LLMとオープンボキャブラリ・セグメンテーションを組み合わせて、未知の地形やミッション固有の走行ルールに対応した実行可能なコストマップをゼロショットで生成するフレームワーク。
- BEV-Patch-PF: オフロード環境におけるBEV-航空画像特徴マッチングを用いたパーティクルフィルタによる自己位置推定自己位置推定/オフロード2025/12/1
オフロード環境でGPSを使わずに自己位置を推定するため、車載カメラから生成したBEV特徴マップと航空画像特徴マップをパーティクルフィルタで照合する手法を提案し、実時間で高精度な軌跡推定を実現した。
- GuideNav: 視覚障碍者向け視覚のみのロボットナビゲーション支援システムのユーザー参加型開発ナビゲーション2025/12/1
盲導犬利用者や訓練士へのインタビュー調査に基づき、LiDARを使わず視覚情報のみで教示経路を自律走行するナビ支援システムを開発し、屋外での実証と利用者評価を行った。
- ノイズを含むセンサ入力からヒューマノイドサッカーロボットの俊敏なキック技能を学習強化学習2025/12/1
ノイズの多いセンサ入力下でも、ヒューマノイドロボットが連続してボールを蹴り、多様な配置でゴールを決められる強化学習システムを開発した。
- スケール選好条件付けによる地形コストマップ生成ナビゲーション2025/11/1
合成データを活用して未知地形に汎化しつつ、テスト時にユーザー指定のスケール選好で相対コストを迅速に適応できる地形コストマップ生成手法SPACERを提案。
- 時空間を探索する:オープンワールド物体検索のための統合メモリ・行動ループ物体検索2025/11/1
ロボットが過去の状態や空間的文脈を手がかりに物体を探すため、長期記憶と行動を単一のループで統合するフレームワークSTARを提案し、新ベンチマークで有効性を示した。
- VENTURA: 画像拡散モデルを統合タスク条件付きナビゲーションに適応ナビゲーション2025/10/1
インターネット事前学習済みの画像拡散モデルを微調整し、言語指示に従って画像空間で経路マスクを生成する視覚言語ナビゲーションシステムを提案。軽量な模倣学習ポリシーで実行可能な軌道に変換し、実世界評価で成功率33%向上・衝突54%削減を達成。
- CuSfM: CUDAで高速化したStructure-from-MotionSLAM/Structure-from-Motion2025/10/1
GPU並列化により高精度な特徴抽出器を効率的に用い、オフラインで高精度かつ高速なカメラ姿勢推定とマッピングを実現するCUDAベースのSfMシステムを提案。
- ComposableNav: 合成可能な拡散モデルによる動的環境での指示追従ナビゲーションナビゲーション2025/9/1
拡散モデルで各動作プリミティブを個別に学習し、展開時に並列合成することで、訓練で見ていない指示の組み合わせにも対応できるナビゲーション手法を提案。
- SocialNav-SUB: ソーシャルロボットナビゲーションにおけるシーン理解のためのVLMベンチマークVLA2025/9/1
ソーシャルロボットナビゲーションの実世界シーン理解を評価するVQAデータセットとベンチマークを提案し、最先端VLMが人間やルールベース手法に及ばないことを示した。
- ViPE: 3D幾何知覚のための動画ポーズ推定エンジン3D知覚2025/8/1
未校正の生動画からカメラ内部パラメータ・運動・密な深度を推定する汎用エンジンViPEを提案し、大規模動画データセットに正確な3Dアノテーションを付与して公開した。
- cuVSLAM: CUDAで高速化した視覚オドメトリとマッピングSLAM2025/6/1
最大32台のRGB/深度カメラとIMUに対応し、NVIDIA Jetson上でリアルタイム動作するCUDA最適化済みの視覚SLAMシステムを提案。
- 非構造オフロード地形におけるクロスビュー映像ローカリゼーションのための時空間コントラスト学習クロスビューローカリゼーション2025/6/1
GPSのないオフロード環境で、季節変化や見た目の曖昧さに頑健な自己教師ありクロスビュー映像ローカリゼーション手法MoViXを提案し、古い衛星画像でも高精度に位置推定できることを示した。
- 盲導犬ロボットの人間中心設計:静かで安定した歩行制御歩行2025/5/1
視覚障害者向けの盲導犬ロボットにおいて、騒音とぎくしゃくした動きを抑える新しい歩行制御器を開発し、Unitree Go1で騒音を半減させ、利用者実験で高い受容性を示した。
- CREStE: インターネット規模の事前知識と反事実ガイダンスによるスケーラブルな地図なしナビゲーションナビゲーション2025/3/1
視覚基盤モデルの蒸留と反事実逆強化学習を組み合わせ、未知の都市・オフロード環境でも長距離を地図なしで走行できるナビゲーション手法を提案。
- COMPASS: 残差強化学習とスキル統合によるクロスエンボディメント移動ポリシーsim2real2025/2/1
単一のロボットの模倣学習デモのみから出発し、残差強化学習で適応させ、エンボディメント埋め込みで一般化ポリシーに蒸留することで、多様な機体にまたがる移動を実現した研究。
- ConfigBot: 動的環境におけるロボットアプリケーションのための適応的リソース割り当てシステム最適化2025/1/1
実行時プロファイリングと自動設定チューニングにより、ロボットアプリケーションの設定を動的に再構成し、性能仕様を満たしつつリソース割り当てを最適化するシステムConfigBotを提案・実機検証した論文。
- HEIGHT: 混雑・制約環境におけるロボットナビゲーションのための異種相互作用グラフトランスフォーマナビゲーション2024/11/1
人・ロボット・障害物の異種時空間グラフを構築し、注意機構と再帰ネットワークで動的な混雑環境でのナビゲーション方策を強化学習する手法を提案した。
- 意味的マスキングと視覚特徴マッチングによる堅牢な自己位置推定自己位置推定2024/11/1
長期運用される宇宙ロボット向けに、意味的マスキングで視覚特徴マッチングを効率化し、動的環境での自己位置推定精度と堅牢性を向上させる手法を提案。
- SPOT: 物体中心操作のためのSE(3)姿勢軌道拡散模倣学習2024/11/1
物体のSE(3)姿勢軌道をタスク表現として用い、拡散ポリシーを条件付ける物体中心模倣学習フレームワークを提案。iPhoneで撮影した8つの実演のみで実世界タスクを制約遵守しつつ完遂した。
- PACER: 選好条件付き全地形コストマップ生成ナビゲーション2024/10/1
鳥瞰図画像とユーザーの選好コンテキストを入力として、その選好に沿ったコストマップを生成する機械学習手法を提案し、新しい地形への適応と汎化性能を示した。
- オープンワールド領域におけるロボットプログラムの生成と修復ロボットプログラミング/LLM2024/10/1
LLMが生成したロボットプログラムの実行を追跡し、エラー発生時に現在の世界状態から最小限の再実行で復旧するプログラムを生成するRoboRepairを提案。11タスクのベンチマークで評価した。
- X-Mobility:世界モデリングによるエンドツーエンドの汎化可能なナビゲーションナビゲーション2024/10/1
潜在状態空間を持つ自己回帰的な世界モデルと多頭デコーダを組み合わせ、行動方策と分離して学習することで、未知環境でも汎化するナビゲーションモデルを実現した。
- 安全制約付き計画のための言語モデルの検証と改良の統合手法VLA2024/10/1
言語モデルが生成するロボットプログラムをオートマトン表現に変換して安全仕様を検証し、その結果を活用した微調整で安全なプログラム生成を効率化する手法を提案。
- ReMEmbR:ロボットナビゲーションのための長期時空間記憶の構築と推論ナビゲーション2024/9/1
ロボットが長期間のナビゲーション履歴を記憶し、時空間的な質問に答えるための検索拡張記憶システムReMEmbRを提案。NaVQAデータセットを構築し、低遅延で効果的な長期推論を実現した。
- KinScene: 関節物体を含むシーンのモデルベース移動マニピュレーションマニピュレーション2024/9/1
移動マニピュレータが屋内シーンを自律探索し、関節物体の運動モデルを構築して、長期的な操作タスクを計画・実行するフルスタック手法を提案。
- 人間中心の盲導犬ロボット開発から得られた教訓歩行2024/9/1
視覚障害者の移動支援に向けた四足歩行ロボットの開発で、利用者や訓練士へのインタビューと実験を通じて安全性・信頼性・使いやすさを高める設計原則を明らかにした。
- 持ち上げて、スプラットして、マッピング:ラベル不要の意味的シーン補完のための基盤マスクの持ち上げ意味的シーン補完2024/7/1
RGBD画像1枚から視覚基盤モデルのマスクをBEVに持ち上げ、人手ラベルなしで遮蔽領域や動的物体下を含む連続的なオープンセット意味・高さ表現をリアルタイムに予測する手法LSMapを提案。
- CLOVER: 文脈を考慮した長期物体視点・環境不変表現学習物体再識別2024/7/1
多様な照明や視点変化に対応する物体再識別のためのデータセットCODa Re-IDと、前景分割不要の表現学習手法CLOVER、および地図統合手法MapCLOVERを提案。
- Robo-Instruct: コードLLMの微調整のためのシミュレータ拡張命令アライメントVLA2024/5/1
ロボット制御プログラム生成用の小規模LLMを微調整するため、タスク実行中に動的にシミュレーション環境を生成して物理制約を検証し、命令とプログラムのアライメントを改善する手法を提案。
- 実世界の非構造歩行者群衆におけるマルチエージェント逆強化学習逆強化学習2024/5/1
混雑した歩行者群衆の中で複数エージェントの報酬関数を同時に学習するため、扱いやすさと合理性のトレードオフトリックを用いた新しいマルチエージェント最大エントロピー逆強化学習を提案し、複数のデータセットで有効性を示した。
- Vid2Real HRI:ビデオベースのHRI研究デザインを実世界設定に整合させる枠組みHRI2024/3/1
ロボットの一人称視点動画を用いたオンラインHRI研究を設計し、実世界での対面実験でその結果を再現することで、ビデオ研究の効率性と実世界への転移可能性を両立させるVid2Real HRIフレームワークを提案した。
- SYNAPSE: 記号的神経支援による選好合成エンジンVLA2024/3/1
視覚的なデモンストレーションからユーザー固有の選好(例:良い停車位置)を少数データで学習するため、視覚解析・大規模言語モデル・プログラム合成を組み合わせた神経記号的手法を提案。
- Towards Robotic Companions: Understanding Handler-Guide Dog Interactions for Informed Guide Dog Robot Design2024/2/1
- Deploying and Evaluating LLMs to Program Service Mobile Robots2023/11/1
- Rethinking Social Robot Navigation: Leveraging the Best of Two Worlds2023/9/1
- ObVi-SLAM: Long-Term Object-Visual SLAM2023/9/1
- STERLING: Self-Supervised Terrain Representation Learning from Unconstrained Robot Experience2023/9/1
- Towards Robust Robot 3D Perception in Urban Environments: The UT Campus Object Dataset2023/9/1
- Wait, That Feels Familiar: Learning to Extrapolate Human Preferences for Preference Aligned Path Planning2023/9/1
- Deadlock-free, Safe, and Decentralized Multi-Robot Navigation in Social Mini-Games via Discrete-Time Control Barrier Functions2023/8/1
- Decentralized Social Navigation with Non-Cooperative Robots via Bi-Level Optimization2023/6/1
- Introspective Perception for Mobile Robots2023/6/1
- Principles and Guidelines for Evaluating Social Robot Navigation Algorithms2023/6/1
- Programming-by-Demonstration for Long-Horizon Robot Tasks2023/5/1
- LLM+P: Empowering Large Language Models with Optimal Planning Proficiency2023/4/1
- SOCIALGYM 2.0: Simulator for Multi-Agent Social Robot Navigation in Shared Human Spaces2023/3/1
- Programmatic Imitation Learning from Unlabeled and Noisy Demonstrations2023/3/1
- Responsible Robotics: A Socio-Ethical Addition To Robotics Courses2023/2/1
- System Configuration and Navigation of a Guide Dog Robot: Toward Animal Guide Dog-Level Guiding Work2022/10/1
- SOCIALMAPF: Optimal and Efficient Multi-Agent Path Finding with Strategic Agents for Social Navigation2022/10/1
- Teaching Autonomous Systems Hands-On: Leveraging Modular Small-Scale Hardware in the Robotics Classroom2022/9/1
- Autonomous Ground Navigation in Highly Constrained Spaces: Lessons learned from The BARN Challenge at ICRA 20222022/8/1
- State Supervised Steering Function for Sampling-based Kinodynamic Planning2022/6/1
- Dense Crowd Flow-Informed Path Planning2022/6/1
- High-Speed Accurate Robot Control using Learned Forward Kinodynamics and Non-linear Least Squares Optimization2022/6/1
- Socially Compliant Navigation Dataset (SCAND): A Large-Scale Dataset of Demonstrations for Social Navigation2022/3/1
- STEADY: Simultaneous State Estimation and Dynamics Learning from Indirect Observations2022/3/1
- VI-IKD: High-Speed Accurate Off-Road Navigation using Learned Visual-Inertial Inverse Kinodynamics2022/3/1
- Probabilistic Object Maps for Long-Term Robot Localization2021/10/1
- Competence-Aware Path Planning via Introspective Perception2021/9/1
- Visual Representation Learning for Preference-Aware Path Planning2021/9/1
- SOCIALGYM: A Framework for Benchmarking Social Robot Navigation2021/9/1
- OneVision: Centralized to Distributed Controller Synthesis with Delay Compensation2021/4/1
- Robofleet: Open Source Communication and Management for Fleets of Autonomous Robots2021/3/1
- Iterative Program Synthesis for Adaptable Social Navigation2021/3/1
- Learning Inverse Kinodynamics for Accurate High-Speed Off-Road Navigation on Unstructured Terrain2021/2/1
- IV-SLAM: Introspective Vision for Simultaneous Localization and Mapping2020/8/1
- Robot Action Selection Learning via Layered Dimension Informed Program Synthesis2020/8/1
- Curating Long-term Vector Maps2020/7/1
- Learning to Optimize Autonomy in Competence-Aware Systems2020/3/1
- SMT-based Robot Transition Repair2020/1/1
- Automatic Failure Recovery for End-User Programs on Service Mobile Robots2019/9/1
- Making High-Performance Robots Safe and Easy to Use for an Introduction to Computing2019/9/1
- IVOA: Introspective Vision for Obstacle Avoidance2019/3/1
- Localization under Topological Uncertainty for Lane Identification of Autonomous Vehicles2018/3/1
- Interactive Robot Transition Repair With SMT2018/2/1
- Human-in-the-Loop SLAM2017/11/1
- A Real-Time Solver For Time-Optimal Control Of Omnidirectional Robots with Bounded Acceleration2017/7/1