Samira Hajizadeh
収録論文 1本 ・ フィジカルAI/ロボット学習
LLM安全性
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 遡及的思考連鎖(RetroCoT):モデル世代を横断する安全診断としての法医学的再構築プロンプトLLM安全性2026/7/6
大規模言語モデルの安全性評価が、直接的な有害要求だけでなく、法医学的再構築という別の語用論的枠組みでも突破されることを示し、新たな攻撃手法RetroCoTを提案した。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
大規模言語モデルの安全性評価が、直接的な有害要求だけでなく、法医学的再構築という別の語用論的枠組みでも突破されることを示し、新たな攻撃手法RetroCoTを提案した。