Rui Tang
収録論文 12本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- UniPhysGen: シミュレーション対応3Dアセットのための統合物理グラウンディング3Dアセット生成2026/7/15
3Dアセットに統一された物理セマンティクス(関節構造と物理特性)を自動付与するフレームワークと大規模データセット、ベンチマーク、モデルを提案した。
- SPEAR: 写実的な具現化AI研究のためのシミュレータシミュレーション2026/7/1
Unreal EngineをPythonから制御できる高速・高機能な写実シミュレータを提案し、多様なエージェント制御やデータ生成を実現した。
- 変換ロータリー位置埋め込み拡張拡散モデルによる制御可能なテクスチャタイリング画像生成2026/6/22
拡散トランスフォーマーを用いて、ユーザー指定のテクスチャをシーン画像に繰り返し配置する際に、周波数・向き・スケールを精密に制御しつつ、参照テクスチャの構造とシーンの照明・幾何を保つ新しいフレームワークを提案した。
- GeoCFNet: ロボット支援内視鏡的粘膜下層剥離術のための幾何学認識信頼度フィールドネットワーク手術ロボティクス2026/6/11
内視鏡手術中の動的なシーンにおいて、煙やハイライト、組織変形などの課題に対処しつつ、解剖ガイドのための信頼度フィールドを幾何学的に推定するネットワークを提案した。
- Rein3D: パノラマビデオ拡散モデルによる強化学習型3D屋内シーン生成3Dシーン生成2026/4/12
3Dガウススプラッティングとビデオ拡散モデルを組み合わせ、疎な入力から360度の一貫した3D屋内シーンを復元・生成するフレームワークを提案した。
- GeoLanG: 幾何学認識と統合RGB-Dマルチモーダル学習による言語誘導把持マニピュレーション2026/2/1
CLIPを基盤に視覚と言語を統合し、深度情報を幾何学的事前知識として活用することで、雑然とした環境でも言語指示に基づく把持を実現するエンドツーエンド手法を提案。
- Arcadia: 身体性生涯学習のためのフルライフサイクルフレームワークに向けて身体性生涯学習2025/12/1
実世界でのデータ収集・生成的なシーン再構成・共有身体表現・sim-from-real評価を密結合した閉ループにより、身体性エージェントの生涯学習と汎化を実現するフレームワークを提案。
- VLNVerse:多様・身体性・リアルなシミュレーションと評価を備えた視覚言語ナビゲーションのベンチマークVLN2025/12/1
視覚言語ナビゲーション(VLN)の既存ベンチマークの限界を克服するため、多様なタスクを統合し、物理エンジンによる身体性とリアルなシミュレーションを実現した大規模ベンチマークVLNVerseを提案し、既存手法の評価と統合マルチタスクモデルを提示した。
- Geo-RepNet: 内視鏡的粘膜下層剥離術における手術フェーズ認識のための幾何情報を考慮した表現学習手術フェーズ認識2025/7/1
内視鏡手術の深度情報を活用し、RGB画像と組み合わせることで手術フェーズ認識の精度を高める幾何情報考慮型フレームワークを提案。
- スマート薬局における薬剤配送の最適化:多段階把持ネットワークと適応型ロボティクス機構を組み合わせた新規フレームワークマニピュレーション2024/10/1
乱雑に重なった多様な形状の薬剤を把持するため、超解像前処理・YOLO-EASBセグメンテーション・IAFFGA-Net把持計画・改良アリコロニー法による軌道計画を統合した適応型ロボットアームシステムを提案。
- ADU-Depth: Attention-based Distillation with Uncertainty Modeling for Depth Estimation2023/9/1
- InteriorNet: Mega-scale Multi-sensor Photo-realistic Indoor Scenes Dataset2018/9/1