研究・論文 医療LLMの安全ガードを『言い換え』で回避する研究 Googleのオープンウェイト医療モデルMedGemma-4Bの安全ガードが、単純な『言い換え』だけで平均38%回避されたとする査読前研究を、業務でLLMを扱う情シス視点で読み解きます。 2026.07.15 研究・論文
研究・論文 LLMジェイルブレイクの内部メカニズムを解く研究 生成AIの「ジェイルブレイク(安全機能の回避)」が、モデル内部で具体的に何を起こしているのかを可視化した査読前研究を、情シス目線でかみ砕きます。安全機能の抑制という発見と、社内AI活用における実務的な留意点を整理します。 2026.07.11 研究・論文