Kai Tang
The University of Hong Kong
収録論文 13本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- エッジと形状を考慮した深層ネットワークによる布地デスタッキングのための最上層布地の精密セグメンテーションセグメンテーション/ロボット操作2026/8/1
布地のデスタッキングにおいて、最上層の布地を正確にセグメンテーションするための新しい学習アーキテクチャを提案。エッジ認識と形状認識の2つの分岐を導入し、CADモデルから得た参照マスクを用いて形状を整えることで、従来手法より高い精度を実現した。
- 縫製前の布地位置合わせのためのグローバル・ローカル重み付きICPを用いたロボット布地アライメントシステムマニピュレーション2026/8/1
縫製前に必要な布地の正確な位置合わせを自動化するため、新しいGLW-ICP法で上下の布地の姿勢を推定し、ロボットで精密に位置合わせするシステムを提案した。
- SafeDojo: インタラクティブワールドモデルによるVLAのための安全強化学習安全強化学習/VLA2026/6/1
視覚言語行動(VLA)ポリシー向けに、ワールドモデルベースの想像を通じて安全な行動を学習する初のモデルベース安全強化学習フレームワークを提案。
- RegimeVGGT:視覚幾何基盤Transformerの層別空間保存冗長性除去3D再構成2026/6/1
多視点画像から3次元構造を復元するVGGTの計算を、層ごとの特性に応じて圧縮し、品質を保ちながら6.7倍高速化する手法を提案した。
- 縫い目からグラフへの再構築による衣服の配置合わせマニピュレーション2026/6/1
ロボットによる衣服操作で縫い目情報を活用するため、グラフニューラルネットワークと注意機構を用いて縫い目観測を構造骨格グラフに変換し、変形を考慮した視覚サーボ制御で衣服の配置合わせを実現した。
- 位相条件付き模倣学習と自律的失敗回復による堅牢な変形物体操作模倣学習/変形物体操作2026/5/1
変形物体操作のための、位相条件付きで力覚を考慮したフレームワークを提案。閉ループ階層アーキテクチャにより、視覚的に類似した観測での状態エイリアシングを解消し、実行失敗からの自律回復を実現する。
- TC-IDM: 実行可能なゼロショットロボット動作のための動画生成の接地VLA2026/1/1
生成された動画から道具の3D軌道を抽出し、それを6自由度のエンドエフェクタ動作に変換する逆動力学モデルを提案。ゼロショットで変形物体操作を含むタスクを実現した。
- Transformer駆動ビジュアルサーボによる双腕マニピュレータでの布地テクスチャマッチングマニピュレーション2025/11/1
双腕マニピュレータとグレースケールカメラを用い、Transformerベースのビジュアルサーボとインピーダンス制御を組み合わせて、布片の姿勢を制御しながら張力をかけつつ重ね合わせ、表面テクスチャを高精度に一致させる手法を提案。合成画像のみで学習し実世界へゼロショット展開を実現。
- RTFF: 双腕マニピュレータによるランダムから目標への布平坦化ポリシーマニピュレーション2025/10/1
しわのある布を任意の目標姿勢に平坦化するタスクを定義し、メッシュ表現と模倣学習+ビジュアルサーボを組み合わせて実機双腕系で実現した。
- WoW: 身体性インタラクションを通じた世界全知モデルへの挑戦世界モデル2025/9/1
200万件のロボット操作軌道で学習した140億パラメータの生成的世界モデルを構築し、物理的因果推論を評価する新ベンチマークWoWBenchを提案した論文。
- Gaussian-LIC2: LiDAR・慣性・カメラ統合ガウシアンスプラッティングSLAMSLAM2025/7/1
LiDAR・慣性センサ・カメラを統合し、リアルタイムで高品質な3Dガウシアンマップを構築しながら自己位置推定を行うSLAMシステムを提案。LiDARが届かない領域は深度補完で補い、姿勢推定の頑健性も向上させた。
- 適応的減衰時間表面と極性認識トラッキングを用いた単眼イベント慣性オドメトリイベントカメラ/オドメトリ2024/9/1
イベントカメラの非同期イベントから適応的減衰カーネルベースの時間表面でテクスチャを抽出し、極性反転表面を併用したトラッキングで運動方向変化に頑健な単眼イベント慣性オドメトリを実現した。
- Coco-LIC: Continuous-Time Tightly-Coupled LiDAR-Inertial-Camera Odometry using Non-Uniform B-spline2023/9/1