Brendan Tidd
収録論文 22本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 非IIDマルチロボットマニピュレーションのための連合部分空間誘導型視覚-言語-行動ポリシー蒸留VLA2026/9/26
複数ロボットが非IID環境で連合学習する際に、低ランク部分空間と行動分布の蒸留、および互換性に基づくクラスタリングで表現ドリフトを抑え、マニピュレーションポリシーの知識転移を改善する手法を提案。
- グラフ表現と多目的品質多様性最適化によるソフトグリッパ設計ソフトロボティクス/グリッパ設計2026/9/17
ソフトグリッパの構造をグラフで表現し、多目的かつ多様性を促す遺伝的最適化で設計する手法を提案。多様な把持シナリオで最適化すると、未知物体への汎化性能が向上することを示した。
- デモの数だけではない:反実仮想的行動感度カバレッジによるデータ効率的で堅牢なロボット模倣学習模倣学習2026/7/1
視覚運動模倣学習の堅牢性を向上させるため、クリーンなデモと妨害観測をペアにして行動ドリフトを測定し、ポリシー固有の感度信号に基づいて少数の修復データを選択するオフライン手法CFNBCを提案した。
- AnchorVLA: アンカー拡散による効率的なエンドツーエンド移動操作VLA2026/4/1
移動操作において、拡散ポリシーの多様な行動生成を保ちつつ、推論コストを削減するため、アンカー軌道周辺で局所的に拡散する手法を提案し、実行時のドリフトを軽減する自己補正機構も導入した。
- SPREAD: 生涯模倣学習のための部分空間表現蒸留生涯学習/模倣学習2026/3/1
生涯模倣学習において、特異値分解を用いてタスク間のポリシー表現を低ランク部分空間で整列させ、幾何構造を保ちながら知識転移と忘却防止を実現する手法を提案した。
- RAPT: シミュレーションから実機へのヒューマノイド展開におけるモデル予測型OOD検出と故障診断sim2real2026/2/1
シミュレーションで学習した制御方策が実機展開時に分布外状態に陥るのを防ぐため、50Hzで動作する自己教師ありの異常検知モニタを提案し、故障の時期と箇所を特定するとともにLLMによるゼロショット故障原因分類を実現した。
- 勾配衝突解消によるスケーラブルな多目的ロボット強化学習強化学習2025/9/1
多目的強化学習において、目的間の勾配衝突を優先度に基づいて解消するGCR-PPOを提案し、ロボットの操作・歩行ベンチマークで並列PPOより優れたスケーラビリティと性能を示した。
- 観測の因果混乱を解消しロボット模倣学習の汎化性能を向上模倣学習2025/7/1
模倣学習において観測と行動の因果関係を明示的に学習することで、環境変化に対する汎化性能を高める手法を提案し、ALOHAロボットアームのシミュレーションで有効性を示した。
- 脚式マニピュレータによる全身ダイナミック投擲マニピュレーション2024/10/1
脚式ロボットが全身のモータを活用して物体を投擲するタスクを深層強化学習で学習し、シミュレーションで精度・安定性・飛距離の向上を示し、実機ヒューマノイドへ転移した。
- M2Distill: 生涯模倣学習のためのマルチモーダル蒸留模倣学習2024/10/1
視覚・言語・行動の潜在空間を一貫させ、GMM方策のずれを抑えるマルチモーダル蒸留により、破滅的忘却を防ぎつつ新タスクを継続学習する手法を提案。
- 形状空間デフォーマ:変形物体のロボット操作のための視触覚統合表現マニピュレーション2024/9/1
テンプレート拡張を用いて多様な物体変形を統一的に表現し、未知の力への汎化と新規物体への迅速な適応を実現する手法を提案。
- Alternative Interfaces for Human-initiated Natural Language Communication and Robot-initiated Haptic Feedback: Towards Better Situational Awareness in Human-Robot Collaboration2024/1/1
- Robotic Vision for Human-Robot Interaction and Collaboration: A Survey and Systematic Review2023/7/1
- Learning Visuo-Motor Behaviours for Robot Locomotion Over Difficult Terrain2023/3/1
- Heterogeneous robot teams with unified perception and autonomy: How Team CSIRO Data61 tied for the top score at the DARPA Subterranean Challenge2023/2/1
- Human-Robot Team Performance Compared to Full Robot Autonomy in 16 Real-World Search and Rescue Missions: Adaptation of the DARPA Subterranean Challenge2022/12/1
- Residual Skill Policies: Learning an Adaptable Skill-based Action Space for Reinforcement Learning for Robotics2022/11/1
- Heterogeneous Ground and Air Platforms, Homogeneous Sensing: Team CSIRO Data61's Approach to the DARPA Subterranean Challenge2021/4/1
- Passing Through Narrow Gaps with Deep Reinforcement Learning2021/3/1
- Learning Setup Policies: Reliable Transition Between Locomotion Behaviours2021/1/1
- Learning When to Switch: Composing Controllers to Traverse a Sequence of Terrain Artifacts2020/11/1
- Guided Curriculum Learning for Walking Over Complex Terrain2020/10/1