Nikolaos Xiros
収録論文 1本 ・ フィジカルAI/ロボット学習
LLM解釈性
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 知識は知っている、言語化は語る:LLMにおける数学的可解性の潜在方向の解きほぐしLLM解釈性2026/7/6
LLMの内部表現から、数学問題の可解性に関する知識と言語化を別々にプローブし、捏造が主に言語化の変化に起因することを示し、活性化ステアリングで棄権を改善した。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
LLMの内部表現から、数学問題の可解性に関する知識と言語化を別々にプローブし、捏造が主に言語化の変化に起因することを示し、活性化ステアリングで棄権を改善した。