APIMaster.ai
ブログに戻る
APIMaster ブログ

DeepSeek V4.1 Flash プレビュー:速度、API料金、アクセス方法

DeepSeek V4.1 Flashがテスト開始:報告された300〜507トークン/秒、V4 Flashと同額の料金、一時的なモデルID。APIMasterが開発者に必要な情報を解説します。

DeepSeek V4.1 FlashDeepSeek APIAPI料金マルチモーダルAIAPIMaster

公開 2026-09-08

クイック回答

Zhidxの報道によると、DeepSeek V4.1 Flashは2026年9月8日に限定テストを開始しました。 一時的なモデルIDは deepseek-v4.1-flash-expires-on-0910 です。報道によると、既存のDeepSeek開発者はベースURLをそのまま使用し、新しいモデルIDを使うことで、アカウントあたり最大20の同時リクエストを送信できます。現在の課金はV4 Flashと同じです。コミュニティの例では300〜507出力トークン/秒に達したと報告されていますが、これらは個々の観察結果であり、APIMasterのベンチマークや保証されたサービス速度ではありません。

APIMasterでは、このリリースを、より高速なモデル応答、マルチモーダルワークフロー、APIコストをまとめて評価する有用な機会と捉えています。2026年9月8日時点の公開カタログ確認では、APIMasterはV4 Flash、V4 Pro、V4 Flash Vision Expを掲載しており、V4.1 FlashプレビューIDは掲載されていませんでした。 APIMasterアカウントを作成して、利用可能なDeepSeekモデルを使い始め、モデルマーケットプレイスで現在のオプションを比較できます。

DeepSeek V4.1 Flashの新機能は?

9月8日の報道では、V4.1 Flashの中間バージョンが新しいモデルアーキテクチャを採用し、ネイティブのマルチモーダルサポート、より強力な機能、より高速な応答、より低いコストを実現したと説明されています。これは初期のテストリリースであるため、これらの主張はその文脈で読む必要があります。

開発者にとって興味深い組み合わせは、公開されているAPI価格が同じでありながら、より高い能力を実現していることです。内部モデルコストの低下は、必ずしも顧客の請求額の低下を意味しません。現在のプレビューはV4 Flashの料金で請求されます。

この報道では、コンテキストウィンドウ、最大出力長、対応画像形式、音声・動画インターフェース、詳細な評価スコアは明記されていません。ネイティブのマルチモーダル対応だけでは、すべてのメディアタイプへの対応が保証されるわけではありません。これらの機能を中心にアプリケーションを設計する前に、実際のインターフェースを確認し、代表的な入力をテストすることをお勧めします。

速度はどのくらい?507トークン/秒の報告を理解する

Zhidxは、開発者がXに投稿した体験を引用しています。ある開発者はピーク出力速度507トークン/秒を報告しました。別の開発者は、自転車に乗ったペリカンのSVGアニメーションを含むHTMLページを生成中に328トークン/秒を達成し、さらに別の開発者は同様のタスクで平均300トークン/秒以上を報告しました。

これはコード生成、長い応答、インタラクティブアシスタントにとって有望です。ただし、これはまだ管理された比較ではありません。この記事では、共通の測定方法、完全なリクエスト設定、再現可能な結果の分布は提供されていません。

APIMasterでは、次の3つの測定値を一緒に確認することをお勧めします:

測定値 わかること
最初のトークンまでの時間 応答が始まるまでユーザーが待つ時間
出力トークン/秒 生成開始後の応答の速さ
合計完了時間と正確性 タスク全体が迅速に完了し、使用可能な結果が得られるかどうか

図解であり、ベンチマークではありません: 持続的な300トークン/秒で1,000トークンの回答を生成する場合、約3.3秒の出力生成時間が必要です。507トークン/秒では約2.0秒かかります。どちらの計算にも、キューイング、初期処理、推論時間、ネットワーク遅延は含まれていません。より高速なストリームは価値がありますが、それだけでワークフロー全体がより高速または正確になることを証明するものではありません。

DeepSeek V4.1 Flash API料金

報道によると、プレビューはDeepSeek V4 Flashと同じ価格を使用します。以下の金額はすべて**100万トークンあたりの人民元(CNY/RMB)**であり、米ドルでもAPIMasterのルート価格でもありません。

トークンタイプ オフピーク価格(CNY / 100万トークン) ピーク価格(CNY / 100万トークン)
キャッシュヒット入力 0.05 0.10
キャッシュミス入力 1.50 3.00
出力 4.50 9.00

コスト例: 100万キャッシュミス入力トークンと100万出力トークンの場合、報告された価格を使用すると、オフピークでCNY 6、ピーク時でCNY 12になります。この例では他の使用量を除外し、すべての入力がキャッシュミスであると想定しています。

提供された報道では、ピーク時間帯のスケジュールやタイムゾーンは定義されていません。ワークロードをスケジュールする前に、DeepSeekの現在の請求ドキュメントを確認してください。APIMasterの利用については、マーケットプレイスに表示されているライブのモデルとルート価格を参照してください。上記のアップストリーム表は、当社サービスの見積もりではありません。

プレビューへのアクセス方法と、0910の意味は?

DeepSeek独自のAPIを使用する対象開発者にとって、報告された変更は簡単です:

model = deepseek-v4.1-flash-expires-on-0910
base_url = keep your existing DeepSeek base URL
account concurrency limit = 20

この指示はアップストリームのDeepSeekプレビューに適用されます。すべてのサードパーティゲートウェイでの利用可能性を保証するものではなく、20リクエスト制限はAPIMasterの公開アカウント制限ではありません。

モデル名は2026年9月10日に期限切れになることを示唆しています。Zhidxはその名前からシャットダウン日を推測しています。提供されたテキストには正確な終了時刻やタイムゾーンは記載されていません。識別子を一時的なものとして扱い、それに依存する前に現在のアップストリームの通知を確認してください。

モデル名を設定可能に保ち、実際のタスクの小さなセットを評価し、テスト済みの代替モデルを保持することをお勧めします。プレビュー期間後は、expires-on-0910モデルが利用可能なままであるか、後継モデルに自動的にマッピングされると想定せず、現在サポートされている識別子を使用してください。

DeepSeekの最近のリリースにおける位置づけ

この報道では、V4.1 Flashは急速な一連のモデルおよび開発者ツールのアップデートの中に位置づけられています:

2026年の日付 Zhidxが報告したアップデート
7月31日 V4 Flash本番版APIが公開テストを開始
8月13日 V4 Pro本番版APIがリリースされ、DeepSeek Harness開発者プレビューv0.1が公開テストを開始し、オープンソース化
8月19日 DeepSeek Harnessがv0.1.0-rc.8に更新
8月21日 V4 Flash Vision ExpがAPIプラットフォームでローンチ
8月31日 V4 Flash Vision Expがオープンソース化
9月8日 中間版V4.1 Flashが限定テストを開始

DeepSeek Harness の GitHub リポジトリ。V4.1 Flash の速度テストではありません。

DeepSeek Harness の GitHub リポジトリ。V4.1 Flash の速度テストではありません。

私たちの視点から見ると、開発者は現在、いくつかの異なるものを評価できるようになりました:テキストワークロード用のFlash、別のモデルオプションとしてのPro、画像関連タスク用のVision Exp、そして初期実験用の新しい一時プレビューです。リリースタイムラインは継続的な開発を示唆していますが、最終版V4.1のリリース日を確認するものではありません。

APIMasterでDeepSeekを使い始める

新しいモデルリリースを追うことは、実際に構築できるものにつながるはずです。APIMasterはDeepSeekと他のモデルファミリーを1つのコンソールとOpenAI互換APIに統合するため、プロバイダーごとに個別の統合を維持することなく、サポートされているモデルを比較できます。

2026年9月8日の公開カタログ確認では、deepseek-v4-flashdeepseek-v4-prodeepseek-v4-flash-vision-expが返されました。一時的なdeepseek-v4.1-flash-expires-on-0910識別子はその結果に含まれていませんでした。モデルを選択する前に、ライブマーケットプレイスで現在の利用可能性と価格を確認してください。

始めるには:

  1. APIMasterに登録します。
  2. 利用可能なモデルを選択し、現在の価格とサポートされているインターフェースを確認します。
  3. コンソールを開き、必要に応じてクレジットを追加し、APIキーを作成します。
  4. APIMasterのベースURLと選択したモデルIDを使用してアプリケーションを設定します。
  5. 小さなリクエストを送信し、結果と使用量を確認してから、ワークロードに合わせてスケールします。

一時的なプレビューではなく、現在掲載されているV4 Flashを使用したテキストの例を以下に示します:

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["APIMASTER_API_KEY"],
    base_url="https://apimaster.ai/v1",
)

response = client.chat.completions.create(
    model="deepseek-v4-flash",
    messages=[
        {"role": "user", "content": "Write a Python function that validates an email address."}
    ],
)

print(response.choices[0].message.content)

セットアップの詳細については、DeepSeek APIガイドAPIキーガイドをお読みください。DeepSeek APIテスターを使用して、接続と応答を確認することもできます。接続テストが成功しても、それだけでモデルの同一性が検証されたり、パフォーマンスのベンチマークが確立されたりするわけではありません。

FAQ

DeepSeek V4.1 FlashプレビューのモデルIDは何ですか?

報告された識別子は deepseek-v4.1-flash-expires-on-0910 です。これは2026年9月8日の報道で発表された一時的な中間テストリリースに属します。

V4.1 FlashはV4 Flashより安いですか?

報道によると、現在のプレビューAPI価格はV4 Flashと同じです。オフピークのキャッシュミス入力は100万トークンあたりCNY 1.50、出力はCNY 4.50で、ピーク価格はそれぞれCNY 3.00とCNY 9.00です。これらは報告されたアップストリーム価格であり、APIMasterの見積もりではありません。

DeepSeek V4.1 Flashは507トークン/秒を保証しますか?

いいえ。507トークン/秒という数値は、Zhidxが引用した個々のコミュニティ結果です。APIMasterはこの記事で独立したV4.1 Flashベンチマークを提示しておらず、実際のパフォーマンスはリクエスト設定、ワークロード、サービス状況によって異なります。

V4.1 FlashプレビューはAPIMasterで利用できますか?

2026年9月8日の公開カタログ確認では掲載されていませんでした。V4 Flash、V4 Pro、V4 Flash Vision Expが掲載されていました。その後の利用可能性の変更については、ライブマーケットプレイスを確認してください。

一時的なモデルはいつ期限切れになりますか?

名前は2026年9月10日を示唆しています。提供された報道はその日付をモデルIDから推測しており、正確な時刻やタイムゾーンは提供されていません。DeepSeekの現在の通知を確認し、代替モデルを準備しておいてください。

モデルニュースを次のプロジェクトに活かす

V4.1 Flashのプレビューは、報告された速度とマルチモーダルの方向性から注目に値します。今日から始めたい作業には、現在利用可能なモデルを選択し、自分のタスクで結果を測定し、そこから構築してください。

**APIMasterアカウントを作成**して、DeepSeekや他のサポートされているモデルを探索し、現在のAPI価格を比較し、使い慣れた1つのインターフェースから最初のリクエストを行いましょう。

割引ルートを比較し、従量課金で利用できます。割引額は選択したモデルとルートによって異なります。