AI×コーディング

AI×コーディング

AIコーディングエージェントのサンドボックスはどこまで守るか|Cursor・Codex・Gemini CLI・Antigravityで確認された7件の越境経路

サンドボックスは動いていたのに、開発者のマシンでコマンドが走った。Pillar Security が Cursor・Codex・Gemini CLI・Antigravity で確認した7件の越境経路を、4つの失敗モードとベンダー対応の差から整理する。
AI×コーディング

LLM APIのプロンプトキャッシュでコストを削る|割高になりやすい設定と最適化のコツ

プロンプトキャッシュはAnthropicやGPT-5.6以降のOpenAIでは書込が通常入力より割高になり、入れれば必ず安くなるとは限らない。可変データが先頭だと割引が効かず書込だけ増える。固定を前・可変を後ろに並べ、usageで読出/書込を実測し採算を確かめるコツを、現行の公式仕様で整理する。
AI×コーディング

Mellum2とは|JetBrainsの12B MoEを「エージェントの中間層」に据える理由【2026年6月】

Mellum2とは、JetBrainsが2026年6月にApache 2.0で公開した12B MoE(活性2.5B)のコーディングモデル。チャット用途でなくルーティング・サブエージェント・オンプレ推論の「中間層」向け。仕組み・instruct/thinking版・速度比較・導入の前提を公式情報で解説します。
LLM開発・技術

LLMワークフローのオブザーバビリティ設計|ログだけでは足りない本番運用の観測戦略

LLMオブザーバビリティとは、単なる会話ログではなく、リトリーバルやツール呼び出しを含むワークフロー全体の挙動を計測・追跡する設計思想です。本番運用で問題の原因を特定するために、トレース・ログ・メトリクスを組み合わせた観測戦略の具体的な実装指針を解説します。