記事
意思決定向けの深掘りレビューと実践ガイド。単発のランキングスナップショットではありません。
-
DeepSeek V4.1 Flash:CED 552B、ベンダー表のagent点、そして存在しない V4.1 Pro
カタログ初出 2026-09-10。OpenRouter主listing $0.15/$0.60。Fireworks $0.22/$0.66、Together $0.30/$1.20。HFカード:CED 552B、prefill 8B / decode 16B、KV 890 B/token、MIT。自己評価 TB2.1 90.6、DeepSWE 74.2(max effort)。本スナップに V4.1 Pro なし。総合榜 #100(文脈/$代理)。0731は約3倍安い。
-
Cursor内蔵モデル探訪:Auto低保、Composer / Grok、いつOpus 4.6を使うか
二プール:Cursor Models(Composer / Grok)は厚い。Opus 4.6はOther Models。Autoはルーターで第四のモデルではない——Auto Cost=日常低保。100K+20K:Composer ~$0.10、Grok ~$0.32、Opus ~$1.00。独立ベンチではない。
-
Qwen3.8-27B:24GB民生GPUでOpus 4.6のコーディング表に並ぶ
Apache-2.0密27.78B。Q4約17GBで24GB民生GPUに載る。OpenRouter主listing $0.45/$3.20。Qwen起動表(自己評価)SWE-bench Pro 61.7対Opus 4.6 Max輸入点53.4。Terminal-Bench 73.0対78.2。100K+20K:ローカル約$0、ホスト約$0.11、Opus $1.00。独立ベンチマークではない。
-
ローカルコーディングモデルを組む:スタック、重み、VRAM帯
スタックは安い。モデルサイズがハードウェアをロックする。重みが載っても目標コンテキストが載るとは限らない。
-
DeepSeek V4 Flash 0731 詳細レビュー:1M文脈MoE、OpenRouterは$0.09/$0.18
284B/13B スパースMoE、100万トークン文脈、reasoning/tools。OpenRouter主listing $0.09/$0.18。HF Hot +64%、カタログ初出 2026-08-01。総合榜 #9(コンテキスト/$代理、非能力)。
-
Claude Opus 5 詳細レビュー:Anthropicの推論・コーディング旗艦、価格はFableの約半分
1Mコンテキスト、マルチモーダル、reasoning/tools。$5/$25(OpenRouter主listing+anthropic-direct検証)。2×価格のFast SKU($10/$50)あり。カタログ初出:2026-07-26。
-
Kimi K3 詳細レビュー:2.8T オープン旗艦は Claude / GPT からどれだけ離れているか
2.8T MoE、1Mコンテキスト、$3/$15(cache $0.30)。AA Index 57でFable/Solに迫り、長期エージェントコーディングで際立つ——K2.6からのアップグレード判断。2026-07-22時点。
-
AIインフラの選び方:モデルAPIホスト(Token Provider)実践ガイド
Vendorはモデルを作り、Token Providerが推論APIをホストします。AI HippoのマルチホストUSD/1M実勢と本枠組みで、公式直結・アグリゲータ・クラウドを再現可能に選びます。
-
Qwen モデルシリーズ徹底レビュー:Qwen2.5 から Qwen3.7 までの選び方
カタログに49のQwen SKUがMax・Plus・Flash・Coder・VLの5ライン。旗艦Qwen3.7 Maxは入出力$1.25/$3.75、Flashは$0.065/$0.26、無料Coderはunified榜#6。
-
Grok 4.5 詳細レビュー:xAIのコーディング&STEM旗艦
500Kコンテキスト、マルチモーダル、推論とツール利用。入出力 $2/$6(OpenRouter主listing)。同門4.20より高く短コンテキストだが旗艦定位。
-
Claude Fable 5 詳細レビュー:AnthropicのMythosクラス旗艦
1Mコンテキスト、マルチモーダル、推論とツール利用に対応。入出力 $10/$50(複数ソース検証)。誰に向くかを解説。
-
2026年のベストAIモデル:AI Hippoランキングの読み方
統合ランキングと価格スナップショットの読み方、独自ベンチマークのタイミング。
-
Claude Mythos 5 とは:AnthropicのMythosクラス家族と話題のオープンウェイト派生
「Mythos 5」は単一モデルではなく、Fable 5が属するMythosクラス家族。Hugging Faceでは Qwythos-9B など(DL150万超)の派生で急上昇中。
-
マルチソースTokenコスト比較:AI Hippo価格マトリクスの読み方
OpenRouter主価格・公式・クラウド価格の並列表示と price-correction のタイミング。
ダイジェスト
定期ランキングパルス、トークン経済ブリーフ、その他パイプライン生成の更新。
-
週次ホット 2026-W39: laya
直近トレンドシグナルは —、ベンダーは convaiinnovations。
-
週次ランキング 2026-W39: 統合Top4
今期スナップショット上位: #1 SpaceXAI: Grok 4.20 Multi-Agent (2.0M ctx); #2 Z.ai: GLM Flash Latest (1.3M ctx); #3 Meta: Llama 4 Scout (1.3M ctx); #4 DeepSeek: DeepSeek V4 Flash Latest (1.3M ctx)。
-
Tokenエコノミクス週報 2026-W39
Verified coverage 100% · Top-50 dual-source 26%.
-
Thinking Machines: Inkling Small (free):無料枠で実際に何ができるか
Thinking Machines: Inkling Small (free) は AI Hippo ボードで #11、1.0M コンテキスト。仕様・コスト計算・比較を解説。
-
Z.ai: GLM 5.3 Flash:マルチモーダル仕様・価格・適所
Z.ai: GLM 5.3 Flash は AI Hippo ボードで #5、1.3M コンテキスト。仕様・コスト計算・比較を解説。
-
Meta: Muse Spark 1.3 Contributor:マルチモーダル仕様・価格・適所
Meta: Muse Spark 1.3 Contributor は AI Hippo ボードで #14、1.0M コンテキスト。仕様・コスト計算・比較を解説。
-
Meituan: LongCat 2.0 レビュー:仕様・価格・適所
Meituan: LongCat 2.0 は AI Hippo ボードで #10、1.0M コンテキスト。仕様・コスト計算・比較を解説。
-
Google: Lyria 3 Pro Preview:無料枠で実際に何ができるか
Google: Lyria 3 Pro Preview は AI Hippo ボードで #12、1.0M コンテキスト。仕様・コスト計算・比較を解説。
-
Qwen: Qwen3.8 2.4T A95B レビュー:仕様・価格・適所
Qwen: Qwen3.8 2.4T A95B は AI Hippo ボードで #18、1.0M コンテキスト。仕様・コスト計算・比較を解説。
-
Poolside: Laguna S 2.1 レビュー:仕様・価格・適所
Poolside: Laguna S 2.1 は AI Hippo ボードで #13、1.0M コンテキスト。仕様・コスト計算・比較を解説。
-
MiniMax: MiniMax M3:マルチモーダル仕様・価格・適所
MiniMax: MiniMax M3 は AI Hippo ボードで #15、1.0M コンテキスト。仕様・コスト計算・比較を解説。
-
Meta: Llama 4 Scout:マルチモーダル仕様・価格・適所
Meta: Llama 4 Scout は AI Hippo ボードで #3、1.3M コンテキスト。仕様・コスト計算・比較を解説。
-
Tencent: Hy4 preview レビュー:仕様・価格・適所
Tencent: Hy4 preview は AI Hippo ボードで #16、1.0M コンテキスト。仕様・コスト計算・比較を解説。
-
MoonshotAI: Kimi K3 (batch):マルチモーダル仕様・価格・適所
MoonshotAI: Kimi K3 (batch) は AI Hippo ボードで #20、1.0M コンテキスト。仕様・コスト計算・比較を解説。
-
OpenAI: GPT-6 Luna Pro (batch):マルチモーダル仕様・価格・適所
OpenAI: GPT-6 Luna Pro (batch) は AI Hippo ボードで #7、1.1M コンテキスト。仕様・コスト計算・比較を解説。
-
Xiaomi: MiMo-V2.5:マルチモーダル仕様・価格・適所
Xiaomi: MiMo-V2.5 は AI Hippo ボードで #8、1.1M コンテキスト。仕様・コスト計算・比較を解説。
-
SpaceXAI: Grok 4.20 Multi-Agent:超長コンテキスト候補をレビュー
SpaceXAI: Grok 4.20 Multi-Agent は AI Hippo ボードで #1、2M コンテキスト。仕様・コスト計算・比較を解説。