医療情報システム安全管理ガイドラインで生成AI入力はどう扱われるか
厚生労働省の企画Q&A26は、AIの学習に使われないことが契約で担保されればサーバーの所在国は問わないと回答しています。ClaudeのZDR・BAAで何が担保されるかを整理しました。
全334件を並べています(121〜150件目)。解説一覧のトップへ戻る
厚生労働省の企画Q&A26は、AIの学習に使われないことが契約で担保されればサーバーの所在国は問わないと回答しています。ClaudeのZDR・BAAで何が担保されるかを整理しました。
文部科学省「大学・高専における生成AIの教学面の取扱いについて」の論点整理を、大学がClaude for Educationの利用ポリシーを策定する際の骨格として読み替える方法をまとめます。
日本企業の情報セキュリティチェックシートでよく聞かれる項目に、Anthropicの一次資料だけでどこまで具体的に回答できるかをまとめます。
Anthropicがロボット犬を使った人間とAIのアップリフト実験Project Fetchを公開。Claudeを使えたチームは使えなかったチームの約2倍の速さでタスクを終えました。
Anthropicの論文が示す、モデル評価スコアの差が統計的に有意かを判定する5つの推奨手法をまとめます。
Anthropicは不正利用で停止した832アカウントをMITRE ATT&CKに照らして分析。AIの使われ方が侵入後の工程へ移り、既存フレームワークが追いつかない実態が見えました。
Anthropicがオープンソース公開した行動評価ツールBloomの仕組みと、人間評価との相関0.86を出した検証結果を解説します。
Anthropicが2023年に始めた「フロンティア脅威レッドチーミング」は、生物兵器領域の実証実験から、現在のサイバー脅威分析まで続く安全対策の土台です。
金融庁のAIディスカッションペーパーで最多の指摘を集めた個人情報保護の論点を、Claudeを含む生成AI活用の実務に引き寄せてまとめます。適法判断ではなく論点の紹介です。
AnthropicのTransparency Hubは、Model Report・System Trust and Reportingの2ページとVoluntary Commitmentsアンカーで構成されます。3窓口の読み分けを解説。
AnthropicとBoston Consulting Groupが2023年9月に提携。Claude 2をBCGの企業顧客向けAI活用支援に組み込みました。
Opus 4とSonnet 4のサイバー攻撃能力をPattern Labsと検証した結果をまとめます。柔軟な戦略転換と多段階攻撃の実行力が伸びた一方、長時間の計画維持には限界が残ります。
AnthropicとPNNLが、ClaudeベースのエージェントALOHAで水処理プラントへの攻撃再現を3時間に短縮した実証実験を解説します。
医療機関がClaudeでPHIを扱うにはBAA締結が前提ですが、対象はEnterpriseとAPIのみでFree・Pro・Max・Teamは対象外です。有効化の手順と機能ごとの適用範囲をまとめます。
言語モデルは自分の答えが正しいか自己評価できるか。2022年のAnthropic論文が示した「P(True)」「P(IK)」という2つの手法とその限界を解説します。
人がClaudeと対話しながら難問を解くと、Claude単独より、人だけより正解率が上がります。Anthropicのscalable oversight研究をもとに、人とAIの共同作業がなぜ機能するのかをまとめます。
AIの攻撃指示を実際のコマンドに変換するツールキットIncalmoの仕組みと、専用ツール無しでも攻撃が成立し始めた最新の検証結果をまとめます。
StanfordのBiomniやMITのCheeseman labなど、ClaudeをCRISPR解析や遺伝子研究の相棒にする3つの現場を紹介。数か月かかる作業が数十分に縮んだ事例もあります。
複雑な質問をChain-of-Thoughtで一気に解かせると、答えの理由が実際の判断根拠と食い違うことがあります。Anthropicの研究をもとに、質問を分解して答えさせる手法がなぜ信頼性を高めるのかをまとめます。
学習データのごく一部を繰り返すだけでモデル性能が半分規模に劣化する現象をAnthropicが解明。二重降下とinduction headsへの損傷を読む。
Claudeの拡張思考(extended thinking)に表示される思考過程が、実際の判断根拠と一致するとは限りません。Anthropicの実験でわかった忠実性の実態と、Claude Codeで思考ログを読むときの注意点をまとめます。
Claudeを人間向けサイバー競技会7大会に参加させた結果を検証します。上位25%に入る大会もあれば0問正解の大会もあり、強さと弱さの境界が明確に見えます。
Anthropicが13万件超の会話を分析。恋愛・仕事の相談やコンパニオンシップにClaudeを使う会話は全体の2.9%、うちコンパニオンシップ・ロールプレイは0.5%未満でした。
米国CAQが公表し日本の公認会計士協会が翻訳した「生成AIの時代の監査」のリスク評価軸を、監査法人や経理部門がClaudeを財務報告プロセスで使う際の点検リストに転用する方法をまとめます。
2022年にAnthropicが公開したRLHF実装の原点論文。週次で選好モデルを更新する「iterated online training」の仕組みと、報酬とKL距離の関係を読む。
Claude Codeやclaude.aiのセッションは既定で6年保存され、read:compliance_user_dataを持つ鍵の保有者が読めます。保存期間と閲覧権限が何で決まるかを一次資料から示します。
AnthropicはClaude Opus 4.6がFirefoxのWasm型混同バグからエクスプロイトを組み立てた実験を公開しました。同条件で他の5モデルは全て失敗しています。
Anthropicが公開したcrosscoderは、複数レイヤーや複数モデルをまたいで特徴を取り出す解釈手法です。Claude 3 Sonnetのファインチューニング前後を比較した実験結果を読み解きます。
人間の有害性ラベルなしで無害なアシスタントを学習させたAnthropicの2022年論文。原則リストとAIフィードバックで訓練するSL-CAI/RL-CAIの仕組みを読む。
AnthropicがClaudeの価値観の拠り所として公開する文書がConstitutionです。安全・倫理・ガイドライン遵守・有用性の4つをどの順で優先するか、誰の指示にどこまで従うかを解説します。