LLM開発・技術

AI×コーディング

MiniMax M3とは?意味・仕組み・使いどころをわかりやすく解説

MiniMax M3とは、2026年6月公開の中国MiniMax社製オープンウェイトMoEモデル。総約428B・活性約23B、最大100万トークン、MSAによる長文効率、マルチモーダル対応。スペックの読み方・他モデルとの違い・API/自己ホストの選び方を公式情報で解説します。
LLM開発・技術

MiniMax MSAとは?長文アテンション計算を28.4倍削減する2段階スパースアテンションを解説【2026年6月】

長文LLMの計算コスト増という壁に対し、MiniMax Sparse Attention(MSA)は「読むべき範囲を絞り、主計算量を一定に固定する」アプローチを取ります。GQAベースの2段階構造(Index/Main Branch)が、どのようにしてコンテキスト長と計算量を切り離すのか、その仕組みと効果を109Bモデルでの実証例を基に解説します。
AI×ライティング

NuExtract 3でPDF・請求書をローカルでJSON抽出する|クラウドAIとの使い分け・選び方

NuExtract 3で請求書PDFをテンプレート指定のJSONに落とす手順を、環境構築から抽出結果の検証コードまで整理。ローカルVLMとクラウドAIの使い分けを、データの送信先・処理量・構築コストの3点で判断する見方も解説します。
AI×コーディング

OllamaでローカルRAGパイプラインを構築する方法

ローカルRAGは、文書の検索から回答生成までを自分の環境内で完結させる構成。OllamaでローカルLLMと埋め込みモデルを使い、Python/TypeScriptで「取り込み・分割・ベクトル化・検索・生成」のパイプラインを最小構成から組む手順を、現行APIと実装時の落とし穴つきで解説する。
AIエージェント

AIエージェント構築フレームワーク比較2026

AIエージェント を自分で組むなら、複雑な分岐や状態管理が必要なときはLangGraph、役割分担で素早く形にしたいならCrewAI、Gemini/Google Cloud連携が強いのが Google ADK 。最初に押さえるべき結論はこの3択です。
AI×自動化

ReActエージェントとは?思考・行動・観察ループで精度を上げる仕組みを解説

ReActは、推論(Reasoning)と行動(Acting)を組み合わせ、検索やAPIで得た実データに接地させながら進むAIエージェントの設計。思考→行動→観察ループの仕組み、RAGとの違い、暴走を防ぐガードレール、向く用途までを整理します。効果はモデルやタスク、ツールの質に依存します。
AI×ライティング

Dify で社内ドキュメントを使う RAG チャットボットを作る

Difyとは、ノーコードでLLMアプリを構築できるオープンソースの開発プラットフォームである。社内マニュアルや就業規程、製品ドキュメントが年々増え、必要な一文を探すだけで数十分かかる——そんな状況に心当たりはありませんか。検索窓にキーワードを打ち込んでも、ファイル名が違う、用語の表記が揺れている、そもそもどのフォルダ…
AI×コーディング

Cline でローカル LLM を動かして無料・オフラインで AI コーディングする(Ollama 連携)

Clineとは、VS Code 上で動く自律型の AI コーディング支援エージェントである。API キーの料金も、月額のサブスクも払わずに AI コーディングを動かす方法があります。Cline と Ollama を組み合わせるやり方です。Cline がクラウドの API ではなく、自分の PC の中で動くモデルを呼び…
LLM開発・技術

Ollama をローカル API サーバーにして社内アプリから LLM を呼ぶ

社内データを ChatGPT に貼り付けるわけにはいかない、でも LLM の処理能力は業務に使いたい——この板挟みを解く現実的な答えが、ローカル LLM の API サーバー化です。Ollama とは、ローカルでLLMを動かしREST APIで呼べる実行環境である。クラウドの API に頼らず、自分の PC やサーバ…
LLM開発・技術

Open WebUI で Ollama に Web UI を足して、チームでローカル LLM を使う

Open WebUIとは、Ollamaなどのローカルツールにブラウザ画面を足すオープンソースのWeb UIである。ターミナルで ollama run と打つたびに、社内の非エンジニアの手が止まる。コマンドを覚えてもらうわけにもいかず、結局ローカル LLM を触れるのは一部の技術者だけ——この状態のまま「チームで使おう…