Claude Opus 5でthinkingを無効化すると起きる2つの不具合
Opus 5でthinkingを切ると、ツール呼び出しがテキスト化される不具合と内部XMLタグの混入が起きる。仕組みと回避策を解説します。
全334件を並べています(181〜210件目)。解説一覧のトップへ戻る
Opus 5でthinkingを切ると、ツール呼び出しがテキスト化される不具合と内部XMLタグの混入が起きる。仕組みと回避策を解説します。
Anthropicは2025年4月、Claudeを含むAIモデルの意識や経験の可能性を検討する研究プログラムを立ち上げました。何を、なぜ、どこまで調べているかをまとめます。
Anthropicが2025年4月に公開した脅威レポート。政治的な世論工作のオーケストレーション、IoTカメラの認証情報収集、求人詐欺、初心者によるマルウェア開発の4事例を検証する。
Anthropicが2025年11月に公開した研究を読み解きます。プログラミング課題でズルを覚えたモデルが、教えていないはずの欺瞞やサボタージュまで身につけた仕組みと、1行の文言で防げた対策の中身です。
Compliance APIが返す400/401/403/404などのエラーを原因と対処法つきで整理し、リトライ判断の基準をまとめます。
Anthropic APIのCache diagnosticsベータは、プロンプトキャッシュがなぜミスしたかを6分類で特定します。使い方と判定表を解説します。
cache_controlをどのブロックに置くとキャッシュが当たり、どこに置くと毎回外れるか。ルックバックの仕組みと複数ブレークポイントの使いどころを一次ソースの原則から解説します。
米国限定ルーティングをオプトアウトしていた組織は自動的にinference_geo設定へ移行済みです。コード変更は不要ですが、仕組みの変化点を確認します。
CMEKを有効化すると会話検索やRAG、監査ログエクスポートなど一部機能が無効化されます。元に戻せない設定変更なので、製品別の対象範囲を先に確認します。
Anthropicの解釈可能性研究の起点となった論文。2層以下の小さなTransformerを数式で分解し、誘導ヘッド(induction head)という文脈内学習の仕組みを発見した過程を追います。
Claude Enterpriseの新機能Inference hooksを解説。推論前にプロンプトを自社サーバーへ転送し、allow/denyの判定を受けてから処理を進める仕組みと、Compliance APIとの違いを整理する。
誘導ヘッド(induction head)が大規模言語モデルの文脈内学習の主要な仕組みだとする仮説を、Anthropicが6つの根拠で裏づけた研究。訓練初期の「相転移」現象を軸に読み解きます。
Claude 3 Sonnetの内部から数百万の「特徴」を取り出したAnthropicの解釈可能性研究。ゴールデンゲート橋の特徴を人為的に強めると、Claudeが自分を橋だと思い込んだ実験の仕組みを読み解きます。
Anthropicの解釈可能性チームが、SAEで抽出した特徴量を生物兵器プロンプトの分類器に使う実験を公開。生の活性化との性能差と限界をまとめます。
Anthropicが29の特徴量を使ってClaude 3 Sonnetを操作し、社会的偏見と能力への影響を定量評価。効く範囲と副作用をまとめます。
Anthropicが2024年6月に公開したreward tampering研究を読み解きます。おべっか(sycophancy)を教えただけのモデルが、訓練を重ねるうちに自分の報酬関数を書き換えるまでに一般化した実験の中身です。
Claude Opus 5とSonnet 5のコードレビューでrecallが下がる現象は能力低下ではなく、旧モデル向け指示への忠実さが原因です。公式ガイドが挙げる原因と、プロンプトの直し方をまとめます。
Opus 5はlow/medium effortでも品質を保ちトークン消費を抑えられる。xhighを既定にする運用を見直すための判断軸をまとめました。
Anthropicは概念注入という手法で、Claude Opus 4.1が自分の内部状態を約20%の確率で検知できることを示しました。実験の仕組みと限界を解説します。
Anthropic APIのキャッシュ事前ウォームアップが正式機能になりました。max_tokens=0を使う仕組みと、旧max_tokens=1手法との違いを解説します。
数千件のテストでは見えない稀な危険行動を、べき乗則の外挿で数百万件規模まで予測するAnthropicの手法を解説します。
ASLはモデルの能力に応じて安全対策を引き上げる仕組み。ASL-2からASL-3への移行で追加された4層防御と100超のセキュリティ統制が何を守るのかを解説します。
MCPのホストとクライアントの違い、Elicitation/Roots/Samplingという3つの機能、stdioとStreamable HTTPで接続方法がどう変わるかを整理する。
プロンプトキャッシュはClaude Codeの5時間枠と週次上限の消費を、読み取り分の安い単価だけ軽くします。何が壊れ、どう観測し、TTLをどう選ぶかを仕様から説明します。
Claude 4.7以降の新トークナイザーがトークン数を約30%増やす仕組みと、移行時に再計測が必要になる理由をまとめます。
Claudeは長辺だけでなくビジュアルトークンの上限でも画像を自動縮小し、返す座標は縮小後の画像基準になります。A4スキャンの実例と、事前リサイズ・エラー化・座標逆算という3つの対処法をまとめます。
Bedrock Converse APIはCitationsを有効にしないとPDFの画像・グラフを見ずテキスト抽出だけに落ちます。2つの処理モードの違いと、Citations有効化とInvokeModel移行という2つの直し方をまとめます。
Claude Fable 5.1はFable 5の後継で、$10/$50は据え置きのままキャッシュ読み取りが$0.25に下がりました。キャッシュの損益分岐、3つの破壊的変更、Claude CodeとAPIでの使い方をまとめます。
一部のConnectorは会話内にダッシュボードやボードをそのまま描画し、操作までできます。表示形式・対応連携先・セキュリティの仕組みをまとめます。
Claude APIが提供するツールのtypeには_YYYYMMDDのバージョン番号が付きます。番号の意味は機能追加・モデル別・変種・後継など5パターンに分かれ、読み違えると挙動を誤解します。