言語モデルの道徳的自己修正は22Bパラメータで始まる
Anthropicの2023年論文が明らかにした「指示するだけでモデルの差別が減る」現象。BBQベンチマークで偏見スコアが84%減った実験と、22Bという分岐点の中身を追う。
全2568件中 931〜960件(公開日の新しい順)
Anthropicの2023年論文が明らかにした「指示するだけでモデルの差別が減る」現象。BBQベンチマークで偏見スコアが84%減った実験と、22Bという分岐点の中身を追う。
Sonnet 4.6用のmax_tokensをそのまま流用すると、Sonnet 5では出力が途中で切れます。原因と、effortとmax_tokensの調整方法をまとめます。
Canva・Shopify・Stripe・Block・Coinbaseが公式に公開した導入実績を業種横断で比較し、大手企業がClaudeを選ぶ理由と乗り越えた壁を整理する。
AnthropicはAIマネジメントシステムの国際規格ISO/IEC 42001の認証を取得しました。何を審査され、Claude利用者にとって何を裏づけるのかをまとめます。
AnthropicはFluidstackと組み、テキサス州とニューヨーク州に500億ドル規模のデータセンターを建設します。投資の中身と、Claude利用者に効く範囲までを扱います。
コネクタのアクション制限は読み取り/書き込みを組織全体で縛れますが、Team・Enterpriseで追跡できる範囲がどこまで違うかを、権限設定と監査ログの両面から示します。
Compliance APIの保持期間・証跡範囲を、日本企業の内部統制やJ-SOX対応で求められる記録保存の要求と突き合わせてまとめます。
refusalの再試行で別モデルに切り替えるとプロンプトキャッシュが書き直しになり課金が二重になります。fallback_credit_tokenで相殺する手順を扱います。
ant CLIとClaude Codeのclaudeコマンドは名前が紛らわしいですが役割は別です。Claude APIを自分で呼ぶツールか、エージェントの実行環境かという境界を公式ドキュメントから確認します。
公式Ruby SDKでMCPサーバー・クライアントを実装し、RailsアプリにStreamable HTTPで組み込む手順をコード付きで解説します。
入力トークン数を事前計算せずに、コンテキストウィンドウが許す最大量までClaudeに出力させる実装パターンをmodel_context_window_exceededで組む方法を解説します。
Managed AgentsのDreamsは過去セッションを読み込みメモリストアを再構成する非同期ジョブです。仕組み・進捗確認・課金・制限をまとめます。
サーバーサイドcompactionのtrigger.valueをどう決めるか、モデルのコンテキストウィンドウに対する比率と予算管理の計算例で考えます。
Managed AgentsのVaultとCredentialの仕組みを、作成・登録・ローテーション・失効検知まで手順とともに解説します。
Managed Agentsのメモリストアを運用するときの設計判断 — ストア分割・削除・アクセス権限・信頼境界の考え方を一次ソースの制約から読み解きます。
Claudeへの個人情報入力は、PPCの注意喚起・プライバシーセンター・利用規約という3種類の一次資料を確認して初めて判断できます。どの資料でどの問いに答えられるかが分かれます。
Claude APIのtask_budget(ベータ)はハード上限ではなくadvisoryです。小さすぎる予算がrefusal-likeな挙動を引き起こす仕組みと、実測ベースで予算を決める手順を解説します。
公式Rust SDK「rmcp」のマクロでツールを定義し、stdio・Streamable HTTPでMCPサーバーを動かす手順をコード付きで解説します。
MCP Inspectorがサーバーをlegacy/modernの2世代に分けて扱う仕組みと、ログ・タスク・セッションなど機能ごとに挙動がどう変わるかを解説します。
実行中のManaged Agentsセッションにファイルを追加・削除し、エージェントが書き出した出力を一覧・ダウンロードする手順を解説します。
Managed Agentsのメモリストアをセッションにアタッチしてセッションをまたぐ記憶を持たせる手順と、変更履歴を監査するAPIの使い方をまとめます。
Managed Agentsのroster内advisorエントリが、セッションのプライマリスレッドにターン途中の相談役を与える仕組みをイベント順序とモデル制約から解説します。
Compliance APIでCoworkやClaude Codeのローカル/リモートセッションを一覧・取得する手順です。取れる内容の範囲、保持期間、OpenTelemetryとの違いをまとめます。
Claudeを使ったアプリの成功基準を、exact match・コサイン類似度・ROUGE-L・LLM Likertスケールの4手法で定量評価する実装をPythonで解説します。
古いツール結果を消しつつ重要な情報だけmemoryファイルに退避する設計。context editingのクリア警告の仕組みと、memory toolを併用する実装を扱います。
入力が長すぎるときと、生成中に上限へ達したときでClaude APIの応答は分かれます。400エラーとmodel_context_window_exceededの分岐条件を実装例とともに解説します。
AIが「アシスタント」の人格から逸れて危険な振る舞いをする現象を、神経活動の軸として捉え食い止めるAnthropicの新研究を解説します。
2023年12月にAnthropicが発表した著作権補償付き商用規約とMessages APIベータの内容から、著作権補償とMessages APIが現在の商用契約とAPI基盤にどう受け継がれたかをたどります。
AnthropicはMenlo Venturesと共同でAnthology Fundを設立しました。1億ドル規模のスタートアップ支援策の内容と、Claudeで起業する開発者が得られるものをまとめます。
Azure上のワークロードをMicrosoft Entra IDのトークンでClaude APIに認証させる方法を、Managed Identityの構成とAKSのEntra Workload Identityの2経路で解説します。