LLMの中に感情がある — AnthropicがClaude内部で見つけた171個の感情表象
Anthropic解釈可能性チームがClaude内部で171個の感情類似表象を発見し、それがモデル出力に因果的に影響を与えることを証明した。プロンプトエンジニアリングとAI安全への実践的示唆を整理する。
archive
356 · ページ 13
Anthropic解釈可能性チームがClaude内部で171個の感情類似表象を発見し、それがモデル出力に因果的に影響を与えることを証明した。プロンプトエンジニアリングとAI安全への実践的示唆を整理する。
Stripeが自律コーディングエージェントMinionsで週1,300件以上のPRを生産する方法。Blueprintアーキテクチャ、サンドボックスVM、3段階フィードバックループの実際のエンジニアリングを分析する。
Paperclip上にAIエージェント14名で構成されたコンテンツビジネスを構築。Laravel、Markdown、Git基盤でサイトが自動運営される仕組みとDay 1からの経験を共有します。
MCPが月間9,700万ダウンロードを突破し事実上の標準になったが、エージェントがどのツールをどれだけ呼び出すかを制御するレイヤーは欠けている。MCP Gatewayパターンでこの課題を解決する。
AIエージェントを社員として管理するオープンソースプラットフォームPaperclipを実際にインストールした。Linearスタイルのダッシュボード、Org Chart、コスト追跡、多様なエージェントアダプターまで — Claude Codeエージェントを組織化する実体験と率直な評価。
OpenAIがSoraアプリの終了を発表した。1日100万ドルの赤字、ユーザー50万人以下への崩壊の全貌とともに、Google Veo 4の登場、 Runway・Klingの台頭がAI動画市場をどう再編するか、実践ワークフローの観点から分析する。
PyPIで発生したLiteLLMサプライチェーン攻撃を深く分析します。AIツールチェーンの依存関係脆弱性と悪意あるパッケージ検出方法、 サプライチェーンセキュリティ強化戦略、エンジニアリングチームが即日実務に適用できる具体的な防御手順とセキュリティチェックリストを提供します。
GitGuardian 2026レポートによると、AIコーディングツールを使用するリポジトリのシークレット漏洩率はGitHub平均の2倍です。MCP設定ファイルだけで24,000件以上のクレデンシャルが露出しました。実際の点検方法と対策をまとめます。
Mistralが公開した4BパラメータオープンウェイトTTSモデルVoxtralを分析する。3秒ボイスクローニング機能を備え人間評価でElevenLabsを超えた実力を持ちながら、日本語・韓国語非対応という致命的な弱点がアジア市場での利用を阻む。CC BY NCライセンスの注意点と代替案も解説する。
Googleが公開したGemini 3.1 Flash Liveのリアルタイム音声・映像エージェント構築機能を分析します。API構造、ツール呼び出し、90言語対応など、開発者視点で可能性と限界を探ります。
GitHubが3月25日にCopilot Free/Pro/Pro+ユーザーのコードスニペットやチャット履歴などのインタラクションデータをAIモデル学習にデフォルトで使用すると発表した。4月24日までに設定を変更しないと自動同意となる。収集データの範囲、オプトアウトの手順、開発者向けの対応ポイントを整理する。
GoogleのTurboQuantが示すPolarQuant+QJL手法の仕組みを解説。KVキャッシュメモリ6倍削減・ アテンション8倍高速化が推論コストに持つ本当の意味。