Lalithkumar Seenivasan
収録論文 16本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Open-H-Embodiment:医療ロボティクスにおける基盤モデルを可能にする大規模データセット医療ロボティクス/データセット/基盤モデル2026/4/1
医療ロボットの自律化を妨げるデータ不足を解決するため、複数のロボットプラットフォームにわたる大規模な医療ロボットビデオと運動学データセットを公開し、基盤モデルの開発を実証した。
- AffordTissue: ツール動作特異的な組織インタラクションのための高密度アフォーダンス予測手術ロボティクス2026/4/1
胆嚢摘出手術中の組織表面におけるツール動作特異的なアフォーダンス領域を高密度ヒートマップとして予測するマルチモーダルフレームワークを提案した。
- SAW: 制御可能かつスケーラブルなビデオ生成による手術アクション世界モデルへの一歩手術映像生成/世界モデル2026/3/13
手術映像生成のための世界モデルを提案し、軽量な条件付け信号(言語、参照シーン、組織アフォーダンスマスク、2Dツール軌跡)を用いたビデオ拡散モデルを構築した。時間的一貫性と視覚品質を向上させ、手術AIのデータ不足やシミュレーションから実環境へのギャップ解消に貢献する。
- TwinOR: 動的手術室のフォトリアルなデジタルツインによる身体性AI研究基盤sim2real2025/11/1
手術室の静的構造と人・機器の動きを再構成し、フォトリアルで動的なデジタルツインを構築するreal-to-sim基盤を提案。合成データで知覚・自己位置推定モデルが実データ相当の性能を示した。
- DualVision ArthroNav: 外付けカメラによる画像ベース関節鏡ナビゲーションの位置推定と再構成の改善医療ロボティクス/ナビゲーション2025/11/1
関節鏡に外付けカメラを追加し、単眼内視鏡映像と組み合わせることで、スケール曖昧性やドリフトを解消し、高精度な位置推定とシーン再構成を実現するナビゲーションシステムを提案した。
- 自律型X線ガイド脊椎手術のためのロボット制御方策学習の検討医療ロボティクス2025/11/1
X線透視下での脊椎手術におけるカニューレ挿入を模倣学習で制御する方策を検討し、シミュレーション環境とデータセットを構築して、68.5%の初回成功率と実X線への部分的なsim-to-real転移を示した。
- 制約付き自然言語行動計画による堅牢な身体性システムタスクプランニング2025/10/1
LLMプランナーに記号計画の監視を組み合わせ、ハルシネーションを抑えつつオープンワールドでの汎化性能を維持する新しいロボット計画手法を提案。ALFWorldで99%の成功率、実機四足歩行ロボットで100%のタスク成功率を達成した。
- 硬直したAIを超えて:手術支援における自然な人間機械共生に向けて手術支援2025/7/1
音声とLLM・SAM・点追跡モデルを組み合わせ、術中に未知の要素も対話的にセグメンテーションできる知覚エージェントを提案した。
- StraightTrack:経皮的Kワイヤ挿入のための複合現実ナビゲーションシステム手術ナビゲーション2024/10/1
軟組織によるワイヤの曲がりを防ぐカニューレとMRヘッドセットを組み合わせ、経皮的Kワイヤ挿入の精度を向上させるシステムを開発した。
- 視覚基盤モデルによるデジタルツイン表現を用いたロバストな手術自動化に向けて手術自動化2024/9/1
視覚基盤モデルを活用したデジタルツイン表現で手術シーンを認識し、LLMエージェントによる計画と組み合わせてペグ移しやガーゼ回収タスクを自動化する手法を提案した。
- Surgical-VQLA++: ロボット手術における校正済みロバスト視覚質問局所回答のための敵対的対照学習VLA2024/8/1
手術画像に対する質問応答で、回答とともに関連領域を局所化するVQLAタスクを提案し、マルチモーダル情報を統合する校正済み共注意ゲート付き視覚言語埋め込みと敵対的対照学習で性能とロバスト性を向上させた。
- SegSTRONG-C: 非敵対的生成劣化に対する手術器具のロバストセグメンテーション — EndoVis'24チャレンジセグメンテーション2024/7/1
手術器具セグメンテーションの深層学習モデルが、出血・煙・低照度などの現実的な画像劣化に対してどれだけ頑健かを評価するEndoVis'24チャレンジを開催し、ベースラインと参加手法を比較した。
- Surgical-VQLA: Transformer with Gated Vision-Language Embedding for Visual Question Localized-Answering in Robotic Surgery2023/5/1
- Task-Aware Asynchronous Multi-Task Model with Class Incremental Contrastive Learning for Surgical Scene Understanding2022/11/1
- Surgical-VQA: Visual Question Answering in Surgical Scenes using Transformer2022/6/1
- Global-Reasoned Multi-Task Learning Model for Surgical Scene Understanding2022/1/1