ブログ
RAG vs ロングコンテキスト:全部渡す方式は本当に安いのか
「100万トークン入るならRAGは不要」という話は本当か。実際の円建て単価で1リクエストあたりのコストを計算すると200倍の差が出ます。キャッシュを効かせても20倍。判断基準を数字で整理します。
Muse Glimmer 30B vs Qwen3.6 27B:30Bクラスのオープンモデルを円建てで比べる
Meta が8月10日に公開した Muse Glimmer 30B と、同じ30Bクラスの定番 Qwen3.6 27B を比較します。ベンチマークの読み方の注意点と、円建ての実コスト差、使い分けまで具体的に見ていきます。
Embedding(埋め込み)とは?意味の近さを数値で測る仕組み
Embeddingは文章を数値のベクトルに変換し、意味の近さを計算できるようにする技術です。仕組み、次元数の意味、チャンク分割の勘所、そしてどこで入手すべきかを実務目線で解説します。
RAGとは?検索して渡す仕組みと、実装に必要な5つの部品
RAGは「モデルに覚えさせる」技術ではなく、「答える直前に必要な資料を探して渡す」仕組みです。5つの部品に分解して、それぞれ何が必要か・どこでつまずくかを整理します。
Qwen3.8 Max vs Claude Opus 5:難所は Opus 5、量は Qwen3.8 Max
2026年8月に登場した Qwen3.8 Max と、7月公開の Claude Opus 5 を比較します。ベンチマークの読み方の注意点と、同じ作業を投げたときの円建ての差まで具体的に見ていきます。
Hermes vs OpenClaw:オープンソースのエージェント2つを1つのキーで使い分ける
オープンソースのエージェント Hermes と OpenClaw は、似ているようで役割が違います。それぞれの得意分野と、FastMetal に繋ぐ設定、常駐型エージェントを従量課金で回すときの注意点をまとめました。
オープンウェイトモデル禁止論争 — Anthropic と OpenAI の回答を読み解く
米国でオープンウェイトモデルの規制論が過熱。Anthropic の Amodei と OpenAI はどう答えたのか。禁止は現実的なのか、日本の開発者への影響を含めて整理します。
DeepSeek V4 Pro vs Claude Opus 5:長文脈を安く回すか、最難関を確実に通すか
MITライセンスの巨大オープンモデル DeepSeek V4 Pro と、最新クローズド旗艦 Claude Opus 5 を、コスト・性能・弱点まで比較。コストを取るか、最高品質を取るか。
Claude Opus 5 vs GPT-5.6 Sol:品質なら Opus 5、コスト効率なら Sol
2026年7月に相次いで登場した Claude Opus 5 と GPT-5.6 Sol を、コーディング・エージェント性能・料金・弱点まで、実際の評判を交えて比較します。
LLM APIプロバイダー比較(2026年):種類と選び方、料金の見方
LLM APIのプロバイダーは、フロンティアラボ・推論プロバイダー・ゲートウェイの3種類に大別できます。それぞれの特徴と、用途に応じた選び方を整理します。