Collective Constitutional AIとは — 公衆参加でモデルの憲法を作った実験
Anthropicが2023年、約1,000人の一般市民の投票でAIの憲法を作った実験がCollective Constitutional AIです。合意形成プラットフォームPolisの設計と、訓練後のバイアス変化を解説します。
全334件を並べています(91〜120件目)。解説一覧のトップへ戻る
Anthropicが2023年、約1,000人の一般市民の投票でAIの憲法を作った実験がCollective Constitutional AIです。合意形成プラットフォームPolisの設計と、訓練後のバイアス変化を解説します。
AnthropicがClaude Sonnet 4.5をサイバー防御向けに強化した方針と評価結果を解説します。Cybench・CyberGymの数値、パッチ生成の限界、HackerOneらの導入評価まで扱います。
Anthropicは2025年7月、米国防総省(DOD)から2年間で上限2億ドルのプロトタイプ契約を獲得しました。CDAO経由の契約内容とAnthropicの政府部門戦略における位置付けをまとめます。
AnthropicとAmazonの提携は2023年の40億ドル出資から始まり、2026年4月の10年5GW・計算容量拡張まで拡大しました。投資額とTrainium協業の変遷を時系列で追います。
自傷・自殺に関わる会話にClaudeがどう対応するかの保護方針をAnthropicが検証結果つきで公開しました。分類器による危機バナー表示とsycophancy対策の実測値を解説します。
Anthropicが2026年8月に公開した研究から、複数のAIエージェントが同じ場を共有したときに起きる協調の失敗を4つの型で読み解きます。
Compliance APIは組織のActivity Feedやチャット・ファイル・セッションへプログラムでアクセスする仕組みです。監査ログ・OpenTelemetry・Inference hooksとの違いを一次資料で確認します。
AnthropicはClaudeを政治的に「even-handed」に訓練していると説明します。訓練方法と自動評価の仕組み、GPT-5・Gemini・Grok・Llamaとのスコア比較を一次ソースからまとめます。
Claude ProjectsのRAG検索がいつ発動し、通常の全文コンテキスト投入と何が違うのかを、公式説明に沿って見ていきます。
cache_controlをブロックごとに置かなくても、会話が伸びるたびにキャッシュ境界が自動で前進する仕組みと、20ブロックの遡及窓に引っかかる条件を整理する。
budget_tokensで予算を固定するextended thinkingと、Claudeが自律判断するadaptive thinkingの違いを、モデル別対応表とエラーの原因から示します。
MCP AppsはVS Code(GitHub Copilot)とClaude Desktopの両方が対応済みですが、サーバーの繋ぎ方とローカル開発の手順が大きく異なります。違いをまとめます。
MCP AppsやOAuth Client Credentialsなど公式拡張機能は、クライアントごとに対応状況が違います。マトリクス表の読み方と、対応していないときに何が起きるかを解説します。
Claudeは会議に自動参加して録音しません。Otter・Fireflies専用ツールとの機能・料金の違いと、乗り換えを検討する場面をまとめます。
Claude TagとClaude Code in Slackは、同じSlack上のClaude連携でも権限の持ち方・課金・対応範囲がまったく別物です。権限・課金・対応作業の3点で違いを見ていきます。
Anthropicが4D AI Fluency Frameworkの11行動を9,830件の会話で計測したAI Fluency Indexを解説します。反復修正の効果とアーティファクト生成時の評価低下を扱います。
Anthropicのインド版Country Briefを読み解きます。世界2位の利用シェアと101位の1人あたり利用という落差、州別集中、economic primitivesの数値まで扱います。
総務省・経済産業省のAI事業者ガイドラインが定める10の共通指針とAI利用者向け7項目を、Claudeを使う企業の社内規程の条文にそのまま対応させられます。
AnthropicがEUの汎用AI行動規範(Code of Practice)への署名を表明しました。RSPとの関係とClaude利用企業への実務的な意味をまとめます。
Claude Scienceによるタンパク質バインダー設計と、NMR・LC-MS解析を23分で終える化学分析の2実験を、業界標準比の数値で検証します。
Anthropicの新ベンチマークBioMysteryBenchで、Claudeは人間の専門家パネルが解けない問題の一部を解いた。99問の設計と結果を読む。
AnthropicがConsumer TermsとPrivacy Policyを改定し、Free・Pro・Maxの学習利用をオプトイン方式に変更しました。同意時は保持期間も5年に延びます。
日本弁理士会「弁理士業務AI利活用ガイドライン」が求める確認事項を、Claudeの学習ポリシーやZDR設定でどこまで満たせるか整理しました。
東京弁護士会のガイドラインと日弁連AI戦略WGの注意事項が求める確認ポイントを、Claudeの設定でどこまで満たせるか整理しました。
クライアントデータを生成AIに入力する行為が監査の独立性を損なうかを整理し、外部送信の技術的な対策をClaudeの契約形態で確認します。
JICPA研究文書第11号が整理した監査AIの利用領域とリスクを、Claudeで監査調書を扱う場合の留意点に接続します。
Anthropicが520億パラメータ規模まで拡張したInfluence Functionsで、どの学習データがClaudeの出力を形作るかを分析。手法と発見をまとめます。
FISCの考察が挙げる情報漏洩・シャドーIT・ハルシネーションの課題と対応策を、金融機関がClaudeを導入する際の設定にどう落とし込めるか整理しました。
第6.0版が強化した外部委託事業者との責任分界・サービス仕様適合開示の要求を、AnthropicのBAA・HIPAA readiness資料のどこで確認できるかを対応づけます。
OktaとGoogle WorkspaceとEntra IDは、ClaudeのSAML設定自体は同条件です。差が出るのはSCIMの追加コストと設定の手間で、Entra IDだけがP1/P2ライセンスを要求します。