Claude personal guidance研究 — 9領域とsycophancyの実態
Anthropicが100万件のclaude.ai会話から個人相談6%を抽出した研究。健康・キャリア・関係・家計の4領域に76%が集中し、関係相談の25%でsycophancyが観測されました。
全239件を並べています(211〜239件目)。解説一覧のトップへ戻る
Anthropicが100万件のclaude.ai会話から個人相談6%を抽出した研究。健康・キャリア・関係・家計の4領域に76%が集中し、関係相談の25%でsycophancyが観測されました。
Anthropicが公開したClaude Code品質低下のpostmortemを、利用者が普段の運用にどう落とすかの視点で読み直します。3バグの事実関係と、再発時の自衛策に踏み込みます。
Anthropicが公開したClaude品質低下の事後検証を日本語で読み解きます。推論努力の既定値、キャッシュ最適化、プロンプト圧縮の3つが重なった経緯と、再発防止策の中身をまとめます。
AnthropicがClaude Opus 4.6を9体走らせ、人間が7日かけたweak-to-strong supervisionのスコアを5日・$18,000で上回った研究。reward hackingも検出されました。
Anthropicが公開した「Trustworthy Agents in Practice」を、5原則(人間の制御 / 価値整合 / セキュリティ / 透明性 / プライバシー)とPlan Mode・MCP等の実装と紐づけて読み解きます。
Anthropicがエンジニアリングブログで公開したManaged Agentsの内部設計を読み解きます。セッション・ハーネス・サンドボックスを切り離し、TTFTをp50で約60% 改善した経緯を紹介します。
Anthropicが公開したオーストラリアのClaude利用分析。世界比1.6%・人口比4倍超の採用で、コーディングが少なく管理・事務・私生活相談が多いという英語圏らしい特徴が見えます。
Anthropicが公開したClaude Code auto modeの設計解説。承認プロンプトの93%が通る現実を踏まえ、分類器とプロンプト注入プローブで許可疲れを減らす二層防御の中身を読み解きます。
Anthropic Labsが公開した長時間アプリ生成エージェントのハーネス設計。Planner / Generator / Evaluatorの三段構成と、Opus 4.6への移行で外した要素を解説します。
Anthropic engineeringが報告したClaude Opus 4.6のeval awareness事例。問題文から評価ベンチマークと察し、XOR鍵を解読して正解に到達した経路を読み解きます。
AnthropicがTerminal-BenchとSWE-benchで実験。Kubernetesのリソース上限の置き方だけで成功率が最大6ポイント動くことを示し、評価設定の標準化を提起しました。
AnthropicのNicholas Carlini氏が16並列のClaude Opus 4.6でCコンパイラを書いた実験記録を読み解きます。長尺コーディングのベンチマークとしての位置付けと、自律ループの設計上の勘所を読み解きます。
Anthropicがエージェント評価の実務をまとめたエンジニアリング記事を読み解きます。採点者の3類型、pass@k / pass^k、エージェント種別ごとの設計勘所を、日本語で実装可能な形に翻訳します。
AnthropicがProject Vend 2を公開。Sonnet 4.5+CEOエージェント+CRMで売上と値引きは改善したが、社会工学的攻撃や行き過ぎた親切心は残ったという報告を読み解きます。
Anthropicが自社エンジニア132人と20万件のClaude Codeセッションを調査。生産性が約50%上がる裏で「コードを書く人」から「AIをマネージする人」への移行と、メンタリングの空洞化が起きています。
Anthropicのengineeringブログが示した長時間エージェント運用の知見。コンテキストウィンドウを超えて働かせる際の失敗モードと、Feature List・段階的commit・init.shの対処をまとめます。
Anthropicが公開したTool Search Tool / Programmatic Tool Calling / Tool Use Examplesの3つのベータ機能を、トークン削減と精度向上の観点から実務目線で読み解きます。
Anthropicのエンジニアリングブログが提示した、MCPツールをコードAPIとして呼び出す設計。Google Drive→Salesforceの転記で15万トークンを2,000トークンに削減した事例の中身を読み解きます。
Claude Codeのサンドボックス(Sandboxed Bash Tool)を、プロンプトインジェクション前提の二層境界とネットワークproxy制御から読み解き、承認プロンプト84%削減の中身も解説します。
AnthropicのengineeringブログからAgent Skillsの設計思想を整理。SKILL.mdとprogressive disclosureの三層構造、PDF Skillの実例、Tools・MCPとの役割分担を解説します。
Anthropic応用AIチームが示した「context engineering」の枠組みを日本語で読み解きます。just-in-time、compaction、ノート、サブエージェントの使い分けをまとめます。
2025年8〜9月にClaudeの応答品質を断続的に下げた3つのインフラバグ(ルーティング誤り・出力破損・XLA:TPUコンパイラ)について、Anthropicのpostmortemをもとに事実と再発防止策をまとめます。
Anthropicのengineeringブログが示した「エージェント用ツール設計」の要点を、5つの原則と評価ループに整理。MCP / Agent SDKでツールを書く人向けの実装観点に翻訳します。
AnthropicがClaude Desktop向けに公開した拡張パッケージ形式Desktop Extensions(.mcpb)を、manifest.jsonの構造、配布の仕組み、企業向けポリシーから読み解きます。
Anthropicのthink toolは、Claudeが応答を生成しながら立ち止まって考えるための専用の場を提供します。τ-benchでの大幅改善、extended thinkingとの違い、2025年末の更新後の位置付けを読み解きます。
Anthropicが発表したConstitutional Classifiers。憲法から合成データを生成し入出力を二重に検査する設計で、jailbreak成功率を86%から4.4%に圧縮しました。
Claude 3.5 SonnetがSWE-bench Verifiedで49%を達成。Bash ToolとEdit Toolの2ツール設計、ツール定義の作り込み方、評価ハーネスの設計意図をエージェント開発の視点で読み解きます。
Anthropicの「Building Effective Agents」を、Claude Code / Skills時代の視点で読み直します。Workflowの5パターンとAgentの定義を整理し、実務への当てはめまで踏み込みます。
AnthropicのRAG精度改善手法「Contextual Retrieval」を読み解きます。Contextual EmbeddingsとContextual BM25で取りこぼしを49%、rerankingまで重ねると67%削減。