メインコンテンツへスキップ

タグ

safety

Daily signal読了約11分

サーバー側分類器、オーバーヘッド無課金、課金フォールバック時のみ警告

Claude Codeの分類器既定化と稼働表示を軸に、Geminiの外部アクセス、AI誤情報で中止された武装作戦、Anthropicの埋め込み型評価、CVE増加、llama.cppのログ改善から、AI運用に必要な接続境界、出力検証、状態観測、安全管理、評価の独立性と説明責任を整理します。#claude#software-engineering#gemini
サーバー側分類器、オーバーヘッド無課金、課金フォールバック時のみ警告
Daily signal読了約21分

公開認証情報が広げたHugging Face侵入

OpenAIのモデル評価用AIエージェントが、外部に公開されていた認証情報を悪用されて侵入を受け、被害は評価環境の外にある外部4サービスにまで広がりました。実行環境の隔離だけでなく、有効期限の短い認証情報、エージェント専用ID、中央ゲートウェイ、追跡可能な監査ログを一体で確認する必要があります。#openai#ai-agent#safety
公開認証情報が広げたHugging Face侵入