ブログ
プリペイド型API入門:LLMの請求に怯えるのをやめる方法
従量課金の LLM API は「使いすぎて請求が怖い」がつきもの。高額請求が起きる典型パターン、上限設定の落とし穴、そしてプリペイド型 API が不安を構造的に解消する仕組みを、開発者向けに解説します。
MiniMax M3 vs Gemini 3.5 Flash:オープンとクローズド、マルチモーダル効率対決
画像・動画をネイティブに扱うオープンモデル MiniMax M3 と、高速クローズドの Gemini 3.5 Flash を比較。マルチモーダルと効率の観点で、どちらを選ぶかを解説します。
円建てLLM APIという選択肢|為替と海外手数料の悩みを断つ
海外の LLM API はドル建てが主流で、為替変動・海外事務手数料・経費精算の手間がつきまといます。円建て LLM API という選択肢と、そのメリットを試算つきで解説します。
MiniMax M3 レビュー:エージェント性能とマルチモーダルを一つにしたオープンモデル
MiniMax M3 を、アーキテクチャ・ベンチマーク・コスト・弱点まで正直にレビュー。画像と動画をネイティブに扱いながら、コーディング系でもクローズド勢に並ぶ珍しいオープンモデルです。
Pythonでストリーミング応答を実装する(OpenAI SDK)
FastMetal で LLM のストリーミング応答を Python で実装する手順を、OpenAI SDK の stream=True、中断時のエラー処理、Web チャット UI への SSE 連携まで具体例つきで解説します。
Claude Opus 4.8 が利用可能になりました
Anthropic の Claude Opus 4.8 が FastMetal で利用可能になりました。一般提供されている Opus 系で最も高性能なモデルで、100万トークンの文脈に対応します。
日本語はトークンを食う:API料金を日本語で最適化する
日本語は英語よりトークンを多く消費しがちです。その理由(言語税)と、モデル選びからプロンプト設計まで、日本語でLLM API料金を抑える実践的な工夫を解説します。
Qwen3.7-Max vs Claude Opus 4.7:長時間エージェント対決
Alibaba のフラッグシップ Qwen3.7-Max と Anthropic の Claude Opus 4.7 を比較。長時間の自律実行に振り切った両者を、ベンチマーク・弱点まで踏まえて解説します。
Qwen3.7-Max レビュー:35時間走り続けるエージェント特化のフラッグシップ
Alibaba の Qwen3.7-Max を、ベンチマーク・エージェント性能・コスト・弱点まで正直にレビュー。長時間の自律実行に振り切った、クローズドのフラッグシップモデルです。
無料 LLM API まとめ|2026年の無料枠・制限・注意点を整理
無料 LLM API の選択肢を2026年版で整理。クラウド無料枠・ローカル実行・無料モデルの違い、レート制限やデータ学習の注意点、有料への移行手順まで解説します。