ClaudeのAIスパイ悪用を阻止した内幕 — 約30組織を狙った自律型サイバー攻撃
2025年11月、Anthropicは中国の国家支援を受けたとみられるグループがClaude Codeを悪用した大規模スパイ活動を検知・阻止したと発表しました。攻撃の80〜90%はAIが自律実行していました。
全2568件中 871〜900件(公開日の新しい順)
2025年11月、Anthropicは中国の国家支援を受けたとみられるグループがClaude Codeを悪用した大規模スパイ活動を検知・阻止したと発表しました。攻撃の80〜90%はAIが自律実行していました。
医療機関がClaudeでPHIを扱うにはBAA締結が前提ですが、対象はEnterpriseとAPIのみでFree・Pro・Max・Teamは対象外です。有効化の手順と機能ごとの適用範囲をまとめます。
ストリーミング中断からの復旧手順が、Claude 4.6以降でassistantメッセージからuserメッセージ方式に変わりました。
Claude APIのservice_tierパラメータはauto/standard_onlyの2値で、Priority Tierの容量を使うかを制御します。新規購入停止後の仕組みとキャッシュ・地域推論の消費レートを扱います。
Claude APIのレスポンスに付くanthropic-ratelimit-* ヘッダー13種の意味と、Workspace制限時にどちらの値が返るかの分岐ロジックを一覧で示します。
Admin APIは組織メンバー・ワークスペース・APIキーを操作するAPIで、監査ログそのものは別のCompliance API Activity Feedが担います。両者の役割分担と内部統制での組み合わせ方をまとめます。
言語モデルは自分の答えが正しいか自己評価できるか。2022年のAnthropic論文が示した「P(True)」「P(IK)」という2つの手法とその限界を解説します。
人がClaudeと対話しながら難問を解くと、Claude単独より、人だけより正解率が上がります。Anthropicのscalable oversight研究をもとに、人とAIの共同作業がなぜ機能するのかをまとめます。
AIの攻撃指示を実際のコマンドに変換するツールキットIncalmoの仕組みと、専用ツール無しでも攻撃が成立し始めた最新の検証結果をまとめます。
Claude APIのweb_fetchツールは既定でキャッシュ済みコンテンツを返します。use_cache:falseで最新情報を強制取得する手順とレイテンシとのトレードオフを解説します。
Claude APIのITPM(入力トークン/分)制限は、キャッシュから読んだトークンを原則カウントしません。計算式とHaiku 3.5だけの例外を具体例で示します。
StanfordのBiomniやMITのCheeseman labなど、ClaudeをCRISPR解析や遺伝子研究の相棒にする3つの現場を紹介。数か月かかる作業が数十分に縮んだ事例もあります。
Anthropic Trust CenterのSOC2・ISO27001報告書は、公開ダウンロードと申請制の2系統に分かれます。情シス・調達担当が請求フォームを埋める手順を実際の画面構成で解説します。
MCPのSkills over MCP Working GroupはAgent Skillsの配布をどう標準化しようとしているのか。Claude Code・APIの既存Skillsとは別レイヤーの話です。
MCPのHost・Client・Serverという参加者の役割分担と、データ層・トランスポート層の2層構造を仕様書ベースで解説します。LSPからの設計継承と2026-07-28のステートレス化がもたらす影響も扱います。
AnthropicはClaude悪用アカウント832件をMITRE ATT&CKへ写像し、ARiESという加算式のリスクスコアで可視化するNavigatorを公開しました。
複雑な質問をChain-of-Thoughtで一気に解かせると、答えの理由が実際の判断根拠と食い違うことがあります。Anthropicの研究をもとに、質問を分解して答えさせる手法がなぜ信頼性を高めるのかをまとめます。
学習データのごく一部を繰り返すだけでモデル性能が半分規模に劣化する現象をAnthropicが解明。二重降下とinduction headsへの損傷を読む。
MCP公式C# SDKでstdioサーバーとHTTPサーバーを最短で立てる手順。Tool定義の書き方とクライアント接続、ホスト名検証の注意点まで一次ソースの実装例で確認します。
Anthropicの解釈可能性研究は、アルゴリズムだけでなくデータ規模のエンジニアリングが律速段階になっています。分散シャッフルと特徴可視化パイプラインという2つの実例を読み解きます。
Anthropic Instituteの調査で、社内のコード生成が2年で8倍になった実測が公開された。AIがAIを作る未来を3つの分岐で読み解く。
「渡邊」と「渡辺」、「髙橋」と「高橋」は見た目が近くても別の文字です。異体字を含む氏名をClaudeで正確に扱うための、確認手順と実践的な指示の出し方を解説します。
Claudeの拡張思考(extended thinking)に表示される思考過程が、実際の判断根拠と一致するとは限りません。Anthropicの実験でわかった忠実性の実態と、Claude Codeで思考ログを読むときの注意点をまとめます。
Claudeを人間向けサイバー競技会7大会に参加させた結果を検証します。上位25%に入る大会もあれば0問正解の大会もあり、強さと弱さの境界が明確に見えます。
Anthropicが13万件超の会話を分析。恋愛・仕事の相談やコンパニオンシップにClaudeを使う会話は全体の2.9%、うちコンパニオンシップ・ロールプレイは0.5%未満でした。
米国CAQが公表し日本の公認会計士協会が翻訳した「生成AIの時代の監査」のリスク評価軸を、監査法人や経理部門がClaudeを財務報告プロセスで使う際の点検リストに転用する方法をまとめます。
2022年にAnthropicが公開したRLHF実装の原点論文。週次で選好モデルを更新する「iterated online training」の仕組みと、報酬とKL距離の関係を読む。
Claude Codeやclaude.aiのセッションは既定で6年保存され、read:compliance_user_dataを持つ鍵の保有者が読めます。保存期間と閲覧権限が何で決まるかを一次資料から示します。
AnthropicはClaude Opus 4.6がFirefoxのWasm型混同バグからエクスプロイトを組み立てた実験を公開しました。同条件で他の5モデルは全て失敗しています。
Claude APIの通信はinbound 160.79.104.0/23・outbound 160.79.104.0/21の固定IPを使う。ファイアウォール許可設定の手順と、削除すべき旧IPを整理する。