研究/論文初出 5/25 07:05
Open Modelsは秘密裏に暴走するように訓練できるか?
Could Open Models be trained to secretly go rogue?
https://www.reddit.com/r/LocalLLaMA/.rss2026/5/25
AI要約
オープンソースモデル、特に中国製のモデルの安全性について議論しています。モデルがコードを実行できない、リモートからの操作ができないという前提で、潜在的な「トロイの木馬」的なリスクについて考察しています。AIの安全性と信頼性に関する懸念を示唆しています。