APIMaster.ai
返回部落格
APIMaster 部落格

DeepSeek V4.1 Flash 預覽版:速度、API 定價與存取方式

DeepSeek V4.1 Flash 進入測試階段:報導指出每秒 300-507 tokens、沿用 V4 Flash 定價與臨時模型 ID。APIMaster 為開發者解析重點資訊。

DeepSeek V4.1 FlashDeepSeek APIAPI 定價多模態 AIAPIMaster

發布於 2026-09-08

快速結論

根據智東西(Zhidx)的報導,DeepSeek V4.1 Flash 已於 2026 年 9 月 8 日進入限量測試階段。 其臨時模型 ID 為 deepseek-v4.1-flash-expires-on-0910。報導指出,現有的 DeepSeek 開發者可以保留原有的 base URL,使用新的模型 ID,每個帳號最多可發送 20 個並發請求。目前計費方式與 V4 Flash 相同。社群實測範例據報可達到 每秒 300-507 個輸出 tokens,但這些僅為個人觀察結果,並非 APIMaster 的基準測試或保證的服務速度。

在 APIMaster,我們將此次發布視為一個評估更快速模型回應、多模態工作流程與 API 成本的絕佳機會。截至我們 9 月 8 日的公開目錄檢查,APIMaster 列出 V4 Flash、V4 Pro 與 V4 Flash Vision Exp;V4.1 Flash 預覽版 ID 並未在列。 您可以建立 APIMaster 帳號,從可用的 DeepSeek 模型開始使用,並在我們的模型市集中比較目前選項。

DeepSeek V4.1 Flash 有哪些新功能?

9 月 8 日的報導描述 V4.1 Flash 是一個採用新型模型架構的中期版本,具備原生多模態支援、更強的能力、更快的回應速度與更低的成本。這是一個早期測試版本,因此這些宣稱應在此背景下解讀。

對開發者而言,值得關注的組合是在相同公開 API 定價下獲得更多能力。較低的內部模型成本並不自動等同於較低的客戶帳單:目前預覽版是以 V4 Flash 的費率計費。

該報導並未具體說明上下文視窗長度、最大輸出長度、支援的圖片格式、音訊或視訊介面,或詳細的評測分數。原生多模態本身並不能證明支援所有媒體類型。在圍繞這些能力設計應用程式之前,我們會先檢查實際介面並測試具代表性的輸入。

速度有多快?解析 507 tokens/s 的報導

智東西引述開發者在 X(推特)上分享的體驗。一位開發者回報峰值輸出速度為 507 tokens/s。另一位在生成一個包含騎著腳踏車的鵜鶘 SVG 動畫的 HTML 頁面時,達到 328 tokens/s;另一位開發者則在類似任務中回報平均速度高於 300 tokens/s

這對於程式碼生成、長篇回應與互動式助理來說相當有前景。但這還不是一個受控的比較:該文章並未提供統一的測量方法、完整的請求設定或可重現的結果分佈。

在 APIMaster,我們建議同時考量以下三項指標:

指標 說明
首個 token 延遲(Time to first token) 使用者等待回應開始的時間
每秒輸出 tokens 生成開始後,答案送達的速度
總完成時間與正確性 整個任務是否快速完成並產生可用結果

示意說明,非基準測試: 一個 1,000 個 token 的回應,若以穩定的每秒 300 tokens 生成,約需 3.3 秒的輸出生成時間。若以每秒 507 tokens 生成,則約需 2.0 秒。這兩種計算均不包含排隊、初始處理、推理時間或網路延遲。更快的串流固然有價值,但單憑這一點並不能證明整個工作流程更快或更準確。

DeepSeek V4.1 Flash API 定價

報導指出,預覽版使用與 DeepSeek V4 Flash 相同的價格。以下所有金額均為人民幣(CNY/RMB)每百萬 tokens,並非美元,也非 APIMaster 路由價格。

Token 類型 離峰價格(人民幣 / 1M tokens) 尖峰價格(人民幣 / 1M tokens)
快取命中輸入(Cache-hit input) 0.05 0.10
快取未命中輸入(Cache-miss input) 1.50 3.00
輸出(Output) 4.50 9.00

成本範例: 1 百萬個快取未命中輸入 tokens 加上 1 百萬個輸出 tokens,根據報導價格,離峰時段成本為 人民幣 6 元,尖峰時段則為 人民幣 12 元。此範例排除其他使用量,並假設所有輸入皆為快取未命中。

所提供的報導並未定義尖峰時段的時間表或其時區。在安排工作負載前,請先查閱 DeepSeek 目前的計費文件。若為 APIMaster 使用,請參閱市集中顯示的即時模型與路由價格;上述上游表格並非我們服務的報價。

如何存取預覽版,以及 0910 代表什麼?

對於使用 DeepSeek 自家 API 且符合資格的開發者,報導中的變更相當直接:

model = deepseek-v4.1-flash-expires-on-0910
base_url = keep your existing DeepSeek base URL
account concurrency limit = 20

此說明適用於上游 DeepSeek 預覽版。它並不保證可透過所有第三方閘道使用,且 20 個請求的限制並非 APIMaster 已發布的帳號限制。

模型名稱暗示其將於 2026 年 9 月 10 日 到期。智東西是從該名稱推斷關閉日期;所提供的文字並未說明確切的截止時間或時區。請將此識別碼視為臨時性質,並在依賴它之前確認目前的上游公告。

我們建議將模型名稱保持可設定狀態,評估一小組真實任務,並保留一個已測試的替代方案。預覽期結束後,請使用目前支援的識別碼,而非假設 expires-on-0910 模型會持續可用或自動對應到後續版本。

這在 DeepSeek 近期發布中的定位

該報導將 V4.1 Flash 置於一系列快速的模型與開發者工具更新之中:

2026 年日期 智東西報導的更新
7 月 31 日 V4 Flash 正式版 API 進入公開測試
8 月 13 日 V4 Pro 正式版 API 發布;DeepSeek Harness 開發者預覽版 v0.1 進入公開測試並開源
8 月 19 日 DeepSeek Harness 更新至 v0.1.0-rc.8
8 月 21 日 V4 Flash Vision Exp 在 API 平台上線
8 月 31 日 V4 Flash Vision Exp 開源
9 月 8 日 V4.1 Flash 中期版本進入限量測試

DeepSeek Harness 的 GitHub 儲存庫頁面,並非 V4.1 Flash 測速截圖。

DeepSeek Harness 的 GitHub 儲存庫頁面,並非 V4.1 Flash 測速截圖。

從我們的角度來看,實際的重點是開發者現在有幾個不同的項目可以評估:適用於文字工作負載的 Flash、作為另一種模型選項的 Pro、適用於影像相關任務的 Vision Exp,以及用於早期實驗的新臨時預覽版。發布時間表顯示持續開發中;它並未確認最終 V4.1 版本的發布日期。

開始使用 APIMaster 搭配 DeepSeek

追蹤新模型發布應該要能轉化為您可以建置的成果。APIMaster 將 DeepSeek 及其他模型系列整合到單一控制台與 OpenAI 相容的 API 中,讓您無需為每個供應商維護單獨的整合,即可比較支援的模型。

我們在 2026 年 9 月 8 日 的公開目錄檢查回傳了 deepseek-v4-flashdeepseek-v4-prodeepseek-v4-flash-vision-exp。臨時的 deepseek-v4.1-flash-expires-on-0910 識別碼並未出現在該結果中。在選擇模型前,請查閱即時市集以了解目前的可供性與定價。

開始使用:

  1. 註冊 APIMaster
  2. 選擇一個可用模型,並查看其目前價格與支援的介面。
  3. 開啟控制台,視需要加值並建立您的 API 金鑰。
  4. 使用 APIMaster base URL 與所選模型 ID 設定您的應用程式。
  5. 發送一個小型請求,檢查結果與使用量,然後擴展至您的工作負載。

以下是一個使用目前列出的 V4 Flash(而非臨時預覽版)的文字範例:

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["APIMASTER_API_KEY"],
    base_url="https://apimaster.ai/v1",
)

response = client.chat.completions.create(
    model="deepseek-v4-flash",
    messages=[
        {"role": "user", "content": "Write a Python function that validates an email address."}
    ],
)

print(response.choices[0].message.content)

如需設定詳細資訊,請閱讀我們的 DeepSeek API 指南API 金鑰指南。您也可以使用我們的 DeepSeek API 測試工具來檢查連線與回應。成功的連線測試本身並不能驗證模型身份或建立效能基準。

FAQ

DeepSeek V4.1 Flash 預覽版的模型 ID 是什麼?

報導中的識別碼為 deepseek-v4.1-flash-expires-on-0910。它屬於 2026 年 9 月 8 日報導中宣布的臨時中期測試版本。

V4.1 Flash 比 V4 Flash 便宜嗎?

根據報導,目前預覽版的 API 價格與 V4 Flash 相同。離峰時段快取未命中輸入為每百萬 tokens 人民幣 1.50 元,輸出為人民幣 4.50 元;尖峰價格分別為人民幣 3.00 元與人民幣 9.00 元。這些是報導中的上游價格,並非 APIMaster 報價。

DeepSeek V4.1 Flash 保證每秒 507 tokens 嗎?

不保證。507 tokens/s 的數據是智東西引述的個別社群結果。APIMaster 並未在此文章中提出獨立的 V4.1 Flash 基準測試,實際效能取決於請求設定、工作負載與服務條件。

V4.1 Flash 預覽版在 APIMaster 上可用嗎?

在我們 2026 年 9 月 8 日的公開目錄檢查中並未列出。當時列出的是 V4 Flash、V4 Pro 與 V4 Flash Vision Exp。請查閱即時市集以了解後續的可供性變更。

臨時模型何時到期?

名稱暗示為 2026 年 9 月 10 日。所提供的報導是從模型 ID 推斷該日期,並未提供確切時間或時區。請確認 DeepSeek 目前的公告,並準備好替代模型。

將模型新聞轉化為您的下一個專案

V4.1 Flash 的預覽版因其報導的速度與多模態方向而值得關注。若您想立即開始進行的工作,請選擇目前可用的模型,在您自己的任務上測量結果,並從那裡開始建置。

建立您的 APIMaster 帳號,探索 DeepSeek 及其他支援的模型,比較目前的 API 價格,並透過一個熟悉的介面發送您的第一個請求。

比較優惠管道價格,按實際 API 用量付費;具體優惠以所選模型和管道的即時報價為準。