AI Safety Level(ASL)とは — ASL-3で何が変わったか
ASLはモデルの能力に応じて安全対策を引き上げる仕組み。ASL-2からASL-3への移行で追加された4層防御と100超のセキュリティ統制が何を守るのかを解説します。
全239件を並べています(151〜180件目)。解説一覧のトップへ戻る
ASLはモデルの能力に応じて安全対策を引き上げる仕組み。ASL-2からASL-3への移行で追加された4層防御と100超のセキュリティ統制が何を守るのかを解説します。
Anthropicは2024年3月にAccenture・AWSと3社協業を組み、2025年12月にAccentureとの提携を単独で拡大しました。2つの発表を時系列で読み解きます。
effortはadaptive modeでの主レバーで、extended-thinking専用モデルではbudget_tokensが深さを決める。Opus 4.5だけeffortとbudgetが併用できる例外を含めて切り分ける。
thinkingモード・effort・budget_tokensはキャッシュされるプロンプトの一部。どれか一つを変えるだけでmessage/tool/system-promptの各ブレークポイントが無効化される仕組みを解説。
AnthropicのWorkload Identity Federationのトークン交換API・環境変数・CEL条件・エラーコードを一枚にまとめます。GCPのWIFとは別物です。
組織全体にAgent Skillsを展開する前に必要なリスク評価チェックリスト・評価ゲート・ライフサイクル管理・バージョニング戦略を、公式ガイドに沿って順にたどります。
Skillを見つけてもらえるかは名前と説明文で決まります。公式ベストプラクティスが定める命名規則・description設計・参照ファイルの分割方針を実例で解説します。
AnthropicとOpenAIは創業の経緯も企業統治の設計も異なります。非営利からの出発点、PBCと信託・財団の統治構造、資金調達規模の違いを一次情報で比較します。
advisorツールの料金はexecutorと別レートで、usage.iterations配列に個別記録されます。トップレベルusageに含まれない理由と、実例のJSONから費用を計算する手順をまとめます。
advisorツールの結果はモデルによって平文のadvisor_resultと暗号化されたadvisor_redacted_resultに分かれます。分岐条件とZDR対応、キャッシュ・再送時の扱いをまとめます。
プログラマティックツールコーリングは75ツール構成で入力トークンを38%削減する一方、τ²-benchでは逆に8%増加します。実測値から効くワークロードを見極めます。
Anthropic APIでツール定義をプロンプトキャッシュに乗せるcache_controlの配置ルールをまとめます。MCPツールセットやcomputer use/browser useでの特殊な挙動も扱います。
web_search_20260209以降はallowed_callersが既定でcode_execution呼び出しになり、ZDR対象から外れます。direct指定に戻すと何を失うかをまとめます。
strict: trueが保証するのはinput_schema準拠とツール名の妥当性だけです。additionalProperties:false必須化とpatternの部分対応、複雑さ上限まで仕様で確認します。
structured outputsはminimum・maximumなどのJSON Schema制約に対応しません。SDKがどの制約を取り除き、descriptionへ言い換え、レスポンスをどう検証しているかを5ステップで追います。
AnthropicのBashツール実装ガイドにあるallowlist検証コードは、演算子が単語にくっつくと素通りする。公式が結論として置く「本当の防御線は隔離」の中身を読み解く。
Files APIは1ファイル500MB・組織全体1TBの容量上限を持ちます。アップロード後は内容もファイル名も変更できず、削除と自動失効(expires_in_seconds)の2経路で消えます。上限の内訳と失効後の挙動を扱います。
Files APIのファイルは、同じワークスペースの全APIキーからfile_id経由でアクセスできます。ユーザー入力のfile_idをそのまま受け取ると他者のファイルを読ませる失敗パターンと、防ぎ方を扱います。
toolsを渡すだけで、モデルとtool_choiceの組み合わせに応じて286〜804トークンがシステムプロンプトに自動加算されます。公式の実測表と、ツールが増えたときの圧縮策をまとめます。
Voyage AIのinput_typeパラメーターは、retrievalとRAGでは省略しないよう公式ドキュメントが指示しています。内部で何が起きているかと実装例を解説します。
PDFはサーバー側で制御できない寸法にラスタライズされるため、返ってきた座標を元ページへそのまま当てはめるとズレます。ズレの起きる仕組みと、自前でラスタライズしてから送る回避策をコード付きで解説します。
CitationsとClaudeのstructured outputs(output_config.format)は併用できません。同時指定で起きる400エラーの正確な条件と理由、回避策を解説します。
Claude Sonnet 4.5とHaiku 4.5の言語別ベンチマークを読み解きます。Sonnet 4.5でもスワヒリ語91%・ヨルバ語80%まで下がる数値と、モデル間の差が低リソース言語ほど開く構造を扱います。
サーバーツールとクライアントツールが同一ターンで混在すると、stop_reasonはpause_turnではなくtool_useになります。判定方法と、tool_resultのみで応答しないと400エラーになる条件を扱います。
個人のPro・Maxアカウントを日本企業が業務利用すると、契約はConsumer Termsのままになり、秘密保持や補償などCommercial Termsが持つ保護が抜け落ちます。規約上のギャップをまとめます。
AnthropicのCommercial Terms of Serviceを、日本企業の法務担当が契約審査で確認したい契約主体・準拠法・秘密保持・補償条項の観点から読み解きます。
claude.aiのチャット添付・Projects・Claude Code・Files APIで、ファイル形式とサイズ・ページ数の上限がどう違うかを比較表でまとめます。
Claudeで作った文章・画像・コードを仕事の成果物に使うとき、規約上の権利譲渡と、日本の著作権法上の保護は別の話です。確認すべき二層のポイントを解説します。
会社の許可なく個人のFree・Pro・Maxアカウントを仕事に使うこと自体は規約違反ではありません。ただし会社が本来持てるはずの統治機能が及ばない構造があり、判断基準とチェックリストで確認できます。
同じプロンプトでもClaudeの答えは揺れます。サンプリング・推論サービス側・エージェントの経路分岐という3層で原因を切り分け、structured outputsや複数回実行など再現性が要る場面の対処をまとめます。