ブログ

コラム

プリペイド型API入門:LLMの請求に怯えるのをやめる方法

従量課金の LLM API は「使いすぎて請求が怖い」がつきもの。高額請求が起きる典型パターン、上限設定の落とし穴、そしてプリペイド型 API が不安を構造的に解消する仕組みを、開発者向けに解説します。

コラム

MiniMax M3 vs Gemini 3.5 Flash:オープンとクローズド、マルチモーダル効率対決

画像・動画をネイティブに扱うオープンモデル MiniMax M3 と、高速クローズドの Gemini 3.5 Flash を比較。マルチモーダルと効率の観点で、どちらを選ぶかを解説します。

コラム

円建てLLM APIという選択肢|為替と海外手数料の悩みを断つ

海外の LLM API はドル建てが主流で、為替変動・海外事務手数料・経費精算の手間がつきまといます。円建て LLM API という選択肢と、そのメリットを試算つきで解説します。

レビュー

MiniMax M3 レビュー:エージェント性能とマルチモーダルを一つにしたオープンモデル

MiniMax M3 を、アーキテクチャ・ベンチマーク・コスト・弱点まで正直にレビュー。画像と動画をネイティブに扱いながら、コーディング系でもクローズド勢に並ぶ珍しいオープンモデルです。

チュートリアル

Pythonでストリーミング応答を実装する(OpenAI SDK)

FastMetal で LLM のストリーミング応答を Python で実装する手順を、OpenAI SDK の stream=True、中断時のエラー処理、Web チャット UI への SSE 連携まで具体例つきで解説します。

新モデル

Claude Opus 4.8 が利用可能になりました

Anthropic の Claude Opus 4.8 が FastMetal で利用可能になりました。一般提供されている Opus 系で最も高性能なモデルで、100万トークンの文脈に対応します。

コラム

日本語はトークンを食う:API料金を日本語で最適化する

日本語は英語よりトークンを多く消費しがちです。その理由(言語税)と、モデル選びからプロンプト設計まで、日本語でLLM API料金を抑える実践的な工夫を解説します。

コラム

Qwen3.7-Max vs Claude Opus 4.7:長時間エージェント対決

Alibaba のフラッグシップ Qwen3.7-Max と Anthropic の Claude Opus 4.7 を比較。長時間の自律実行に振り切った両者を、ベンチマーク・弱点まで踏まえて解説します。

レビュー

Qwen3.7-Max レビュー:35時間走り続けるエージェント特化のフラッグシップ

Alibaba の Qwen3.7-Max を、ベンチマーク・エージェント性能・コスト・弱点まで正直にレビュー。長時間の自律実行に振り切った、クローズドのフラッグシップモデルです。

コラム

無料 LLM API まとめ|2026年の無料枠・制限・注意点を整理

無料 LLM API の選択肢を2026年版で整理。クラウド無料枠・ローカル実行・無料モデルの違い、レート制限やデータ学習の注意点、有料への移行手順まで解説します。

66件中 31-40件を表示