ブログ
LLMのハルシネーションを減らす方法:実践的な7つの対策
ハルシネーションとは、LLMが事実と異なる内容をもっともらしく生成する現象です。根拠の付与・プロンプト設計・検証ステップなど、実践的に減らす方法を解説します。
ローカルLLM vs ホスト型API:小さいモデルは手元、大きいモデルはAPIで
小さいモデルは Ollama で手元に、メモリに載らない大きなオープンモデルはホスト型APIで。両者はOpenAI互換なので同じコードで切り替えられます。具体例つきで解説します。
プロンプトインジェクションとは?仕組みと実践的な対策
プロンプトインジェクションとは、悪意ある入力でLLMの指示を乗っ取る攻撃です。直接型・間接型の仕組みと、権限の最小化や入力の分離といった実践的な対策を解説します。
Kimi K3 vs GPT-5.6 Sol:オープンはエージェント用途で旗艦に並んだか
史上最大級のオープンモデル Kimi K3 と、OpenAI のフラッグシップ GPT-5.6 Sol を比較。エージェント的コーディングでオープンはどこまで戦えるかを、実際の評判で解説します。
LLM APIゲートウェイの選び方:主要な選択肢と比較の観点
複数のLLMを一つのAPIでまとめるゲートウェイ。OpenRouter・LiteLLM・その他の主要な選択肢を、課金方式・対応モデル・セルフホストの観点から比較し、選び方を整理します。
データ主権とモデルの地政学リスク — Fable 5 が世界から消えた3週間
米国の輸出規制で Claude Fable 5 が世界中で3週間止まった。データ主権の議論が過熱するいま、特定の一社・一モデルに事業を賭けることのリスクを考えます。
GPT-5.6 Sol vs Claude Fable 5:ベンチマークと実地の評価が食い違う2モデル
OpenAI の新旗艦 GPT-5.6 Sol と Anthropic の最上位 Claude Fable 5 を、ベンチマークだけでなく実際の評判・弱点まで踏まえて比較。どちらをどう使い分けるかを解説します。
Grok 4.5 vs GPT-5.6 Sol:価格性能比なら Grok、実務の安定感なら Sol
1日違いで登場した xAI の Grok 4.5 と OpenAI の GPT-5.6 Sol を比較。安さと実力で注目される2つの新モデルを、実際の評判や弱点まで踏まえて解説します。
Claude Sonnet 5 vs GPT-5.6 Sol:丁寧に自己検証する Sonnet、軽快に数をこなす Sol
Anthropic の Claude Sonnet 5 と OpenAI の GPT-5.6 Sol を比較。エージェント的コーディングでの丁寧さと速さ、コスト、弱点まで、実際の評判を交えて解説します。
Grok 4.5 vs Claude Opus 4.8:コスト重視なら Grok、一貫性なら Opus 4.8
xAI の Grok 4.5 と Anthropic の Claude Opus 4.8 を比較。価格性能比で注目される新鋭は、実績あるフラッグシップにどこまで迫るのかを、実際の評判で解説します。