1 article
AI Agent はもともと安全ではない。モデルの内側に置いた guardrail は攻撃者と同じ階層にあり、常に迂回される。真の防御はモデルの外——sandbox、最小権限、監査ログの三層でしか成立しない。