Börje F. Karlsson
収録論文 12本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ViLoMan: ヒューマノイドロボットの視覚・固有感覚による全身移動操作スキルの学習全身移動操作2026/9/16
人間の部分的な動作デモを物理的に実行可能なロボット軌道に変換し、教師-生徒蒸留で視覚と固有感覚から全身関節動作を直接出力する統合方策を学習。扉閉めタスクでシミュレーションから実機へ転移し、多様な条件で汎化を実証した。
- WAVE-Go: 車輪脚ロボットのための適応的実行を伴う世界モデルナビゲーションナビゲーション2026/9/16
世界モデルによる行動予測と割り込み可能なコマンド実行を分離し、動的障害物や移動モード変化に対応する画像ゴールナビゲーション手法を提案。成功率向上と衝突低減を実現した。
- LectūraAgents: 適応型パーソナライズAI支援学習と身体化教育のためのマルチエージェントフレームワーク教育AI2026/6/15
教授エージェントが専門エージェントチームを率いて、学習者に合わせた講義内容を研究・計画・レビューし、身体動作を伴う教育を適応的に行うマルチエージェントフレームワークを提案した。
- X-DiffVLA: クロスエンボディ拡散行動ヘッドを備えた視覚言語行動モデルVLA2026/5/1
異なるエンドエフェクタを持つロボット間で知識を転移できる拡散ベースのVLAモデルを提案し、エンボディフォーシングと形態学的ツリー拡散により性能を向上させた。
- ExoActor: 外観視点ビデオ生成による汎用的な対話型ヒューマノイド制御ヒューマノイド制御2026/4/1
大規模ビデオ生成モデルを活用し、第三者の視点からのビデオ生成をインターフェースとして、ロボットと環境・物体の相互作用をモデル化し、ヒューマノイドの行動制御を実現するフレームワークを提案した。
- ICPRL: インタラクティブ制御から物理的直感を獲得する物理推論2026/3/1
視覚言語モデルが動的物理環境での対話的推論を強化するため、複数エピソードの相互作用履歴から方策を適応させるICRLフレームワークを導入し、世界モデルと組み合わせて物理パズルを解く。
- EgoActor: 視覚言語モデルによるヒューマノイドロボットの空間認識型一人称視点行動へのタスク計画の接地VLA2026/2/1
一人称視覚言語モデルEgoActorを提案し、高レベル指示から歩行・頭部動作・操作コマンドを直接予測してヒューマノイドの知覚と実行をリアルタイムに統合する。
- RANGER: 単眼カメラによるゼロショット意味的ナビゲーションのための視覚的文脈適応フレームワークナビゲーション2025/12/1
単眼カメラのみで動作し、短い動画から環境の文脈を学習して任意の物体を探索できるゼロショット・オープンボキャブラリなナビゲーション手法を提案。
- SWITCH: 長期的身体環境における実体インターフェースのモデリングと操作のベンチマーク身体性ベンチマーク2025/11/1
家電パネルやエレベーターなどの実体操作インターフェースを対象に、言語指示から行動・状態変化の追跡・結果検証・エラー回復までの閉ループ推論を評価するベンチマークSWITCHを提案。
- 固有感覚を考慮した双腕ヒューマノイドロボットの身体性計画に向けてVLA2025/10/1
双腕ヒューマノイド向けの新シミュレータDualTHORを構築し、固有感覚情報を組み込んだProprio-MLLMを提案。既存MLLMより計画性能が平均19.75%向上した。
- DualTHOR: 偶発的失敗を考慮した計画のための双腕ヒューマノイドシミュレーションプラットフォームsim2real2025/6/1
家庭環境で双腕ヒューマノイドロボットが協調作業するための物理シミュレータを構築し、低レベル実行時の偶発的失敗も再現することで、視覚言語モデルのロバスト性を評価できるようにした。
- Being-0: 視覚言語モデルとモジュール型スキルを統合したヒューマノイドロボットエージェントVLA2025/3/1
基盤モデルによる高レベルな指示理解・計画と、モジュール型スキルライブラリによる歩行・マニピュレーションを、軽量VLMのConnectorで橋渡しする階層型エージェントを提案し、実機ヒューマノイドで長期的タスクを実現した。