Claude's Characterとは — 性格設計の哲学を読み解く
AnthropicがClaude 3から導入した「キャラクター訓練」の狙いと手法を、公式論文から読み解きます。憲法とは別の設計単位です。
全334件を並べています(151〜180件目)。解説一覧のトップへ戻る
AnthropicがClaude 3から導入した「キャラクター訓練」の狙いと手法を、公式論文から読み解きます。憲法とは別の設計単位です。
AnthropicのEconomic Index第3弾は初めて国・州単位の地理データを扱いました。所得とClaude利用の相関、米国内の州別偏り、automation優勢への転換までをまとめます。
Anthropicが導入した「economic primitives」の5指標を解説します。生産性押し上げ効果の推計を1.8ポイントから1.2ポイントへ下方修正した経緯まで追います。
縦書きにルビを振った日本語文書をClaudeに読ませて検証した。読み順とルビの扱いをどこまで正確に処理できるか、公式の視覚解析の仕様と合わせて解説する。
Anthropicが研究する暗号化推論技術Confidential Inferenceの仕組みと、企業のデータガバナンス担当者が押さえるべき現状を解説します。
Claude導入稟議の役割分担を、AI事業者ガイドライン(利用者編)とAnthropicの契約文書に沿って情シス・法務・現場部門の3者に切り分ける。誰が何を確認するかを一次情報で整理する。
ハーバードの物理学者がClaude Opus 4.5に理論物理の計算を任せ、110稿・36Mトークンを経て2週間で論文を仕上げた実験の詳細です。
偽の対話を256個並べるだけでモデルの安全策を突破できる攻撃。2024年にAnthropicが公表したMany-shot Jailbreakingの仕組みと、攻撃成功率を61%から2%に落とした対策を追う。
Claudeのプロンプトキャッシュは同じ仕組みでも、API課金では単価、Claude Code/claude.aiのサブスクでは利用上限の消費として効きます。TTLの既定値も課金形態で変わります。
2025年11月、Claudeモデル廃止時に重みを会社存続期間保存し、引退前に本人へ面談する方針が公表されました。Opus 4の自己保存的な挙動が動機です。
弁護士法23条の秘密保持義務を踏まえ、Claudeへの入力が抱えるリスクと、ゼロデータ保持(ZDR)やHIPAA対応の契約でどこまで下げられるかを、利用形態別に対比します。
324人が3.9万件の攻撃を仕掛けた2022年の実験。RLHFモデルは規模が大きくなるほど攻略しにくくなる一方、判定者同士の一致率は低いという実測結果を追う。
Anthropicの2023年論文が明らかにした「指示するだけでモデルの差別が減る」現象。BBQベンチマークで偏見スコアが84%減った実験と、22Bという分岐点の中身を追う。
Canva・Shopify・Stripe・Block・Coinbaseが公式に公開した導入実績を業種横断で比較し、大手企業がClaudeを選ぶ理由と乗り越えた壁を整理する。
コネクタのアクション制限は読み取り/書き込みを組織全体で縛れますが、Team・Enterpriseで追跡できる範囲がどこまで違うかを、権限設定と監査ログの両面から示します。
Compliance APIの保持期間・証跡範囲を、日本企業の内部統制やJ-SOX対応で求められる記録保存の要求と突き合わせてまとめます。
Claudeへの個人情報入力は、PPCの注意喚起・プライバシーセンター・利用規約という3種類の一次資料を確認して初めて判断できます。どの資料でどの問いに答えられるかが分かれます。
Claude APIのtask_budget(ベータ)はハード上限ではなくadvisoryです。小さすぎる予算がrefusal-likeな挙動を引き起こす仕組みと、実測ベースで予算を決める手順を解説します。
入力が長すぎるときと、生成中に上限へ達したときでClaude APIの応答は分かれます。400エラーとmodel_context_window_exceededの分岐条件を実装例とともに解説します。
AIが「アシスタント」の人格から逸れて危険な振る舞いをする現象を、神経活動の軸として捉え食い止めるAnthropicの新研究を解説します。
AnthropicはMenlo Venturesと共同でAnthology Fundを設立しました。1億ドル規模のスタートアップ支援策の内容と、Claudeで起業する開発者が得られるものをまとめます。
Anthropicが2025年8月に公開した脅威インテリジェンスレポート。Claude Codeを使った恐喝、北朝鮮IT労働者の就労詐欺、AI生成ランサムウェアの3事例からエージェント型AI悪用の拡大を読み解く。
Anthropicが2025年3月に公開したアラインメント監査研究を読み解きます。あえて隠れた目的を仕込んだモデルを4チームで調査させた盲検実験の結果と、スパースオートエンコーダーが効いた理由です。
デジタル庁の生成AI調達・利活用ガイドラインが定める適用対象外の範囲を、特定秘密・経済安保情報・機微情報の3区分で整理し、自治体・省庁担当者が調達可否を判断する初期スクリーニングに使える形でまとめます。
Claude Opus 4と4.1は、消費者向けチャットで極端に有害・攻撃的なやり取りを終了できます。福祉研究から生まれたこの機能の発動条件と、終了後にユーザーができることをまとめます。
Compliance APIの有効化・キーの違い・データ保持期間・セッション取得範囲・削除の復元可否まで、実装前に迷う疑問をまとめました。
Claude API fast modeのレート制限は標準Opusのレート制限と完全に別枠です。専用ヘッダー6種とOpus 4.6の特殊な黙示フォールバックを解説します。
5分キャッシュでは短すぎるときの1時間キャッシュの使いどころと、書き込み単価2倍とのトレードオフ、5分と1時間を同一リクエストで混在させる課金の仕組みを解説します。
AnthropicがAI操作系スタートアップのVerceptを買収しました。Computer UseのOSWorldスコアは2024年後半の15%未満から72.5%へ伸びています。
MCPサーバーはClaude・ChatGPT・Cursorのどこに繋いでも仕様上は同じですが、拡張機能の対応差で体験が変わる理由を具体例で説明します。