メインコンテンツへスキップ

タグ

PyTorch

Daily signal読了約20分

Salesforceは2-AZ要件をどう満たしたか

Salesforceの複数AZ推論と、エージェントハーネスや呼び出し単位の評価研究から、本番AIで障害を分離し信頼性を測る方法を整理します。配置方式、再試行、評価条件、監視指標を既存構成と照合するための確認点も示します。英語の公式発表と論文を実装・運用の観点で読み解きます。#evaluation#anthropic#claude
Salesforceは2-AZ要件をどう満たしたか
Daily signal読了約20分

任意スコープ時は付与範囲の確認が必要に

Cloudflare OAuthで一部のスコープだけを認可する仕組みを軸に、AgentCoreのポリシー生成や取引エージェントの権限制御を整理します。実装前に確認したい付与スコープ、実行順序、損失上限、監査ログに加え、非同期実行や安全監視の未確定点まで一次情報から読み解きます。#cloudflare#openai#enterprise-ai
任意スコープ時は付与範囲の確認が必要に
Daily signal読了約11分

エージェント運用の検証が主題に

本日はAIエージェントをどう安全に運用し、失敗をどこで検知するかに関わる研究が目立つ一日だった。LLMエージェントの大規模安全テストが公開された。Janusのユーザー参加型権限管理や長期記憶の失敗分析研究も並び、リリースゲートを含む運用境界の確認材料が多い一日だ。#llm-agents#safety-testing#agent-evaluation
エージェント運用の検証が主題に