DeepSeek API 恢復,V4 Flash 占 70%
By: www.tokenpost.kr|2026/08/04 06:09:31
0
分享
DeepSeek API 在 4 日上午經歷性能下降後已恢復。V4 Flash 在代理工作中佔據了 70% 的使用比例,模型性能和 API 運行穩定性成為主要變數。DeepSeek 表示已在服務狀態頁面上解決了問題。故障的開始時間、影響範圍和錯誤率並未公開。DeepSeek 在 7 月 31 日正式發布 V4 Flash API,並轉為公開測試。V4 Flash 是一個擁有 2840 億個總參數和 130 億個活躍參數的專家混合模型,上下文長度為 100 萬個標記。OpenRouter 在 6 月 30 日分析了 450 兆個標記請求日誌,結果顯示截至 5 月底 V4 Flash 佔據了 DeepSeek 代理工作負載的 70%。最低端點成本為每 100 萬個標記輸入 0.09 美元,輸出 0.18 美元。開發者社區對速度和穩定性表示擔憂,LINUX DO 論壇報告稱 V4 Flash 測試中每 5 次請求僅成功 1 次,輸出速度為每秒 12.8 個標記。AI API 可用於交易機器人、鏈上數據摘要、客戶支持自動化等,調用延遲或錯誤增加可能會影響服務質量。
-- 價格
--
--
--
本內容僅供參考,不構成任何金融、投資、法律或稅務建議。文中提及的任何活動、獎勵、線上活動或相關資訊,不應被視為對購買、出售或交易任何加密資產的推薦、招攬或邀請。加密資產具有高波動性,存在價值損失風險。WEEX服務、產品及相關活動的可用性可能因地區而異。用戶在參與前有責任確保符合當地適用法律法規。
猜你喜歡

Google Gemini 減少高達 88% 的標記使用量以分析視頻
Google 將基於代理的視頻分析整合到多個 Gemini Flash 模型中。該工具能夠自主選擇相關的場景、幀、音頻或文字記錄,根據公司說法,能夠將標記的使用量減少高達 88%,同時在某些評估中略微提高準確性。

B.AI 宣布 DeepSeek V4 Flash 將結束免費並 5 折計費

谷歌Gemini 3.8 Flash最快周三上線,內部代號Skimaki

DeepSeek 開放 V4-Flash-Vision-Exp 權重,支持本地部署

B.AI 平台 Token 吞吐量突破 5.74 萬億

Google 創建 WikiSkill 讓 AI 代理記住錯誤並改進
Google Research 的研究人員介紹了 WikiSkill,這是一個保存 AI 代理錯誤和成功的框架,並在持久的維基中創建更好的指令以便未來的執行。測試顯示在數學、電子表格和互動環境方面取得了重要進展,儘管該系統仍未在嚴格意義上代表持續學習。

B.AI 免費模型陣容全面上線,六大旗艦模型可免費使用

螞蟻百靈推出金融模型 Ling-3.0-flash-Fin,下週開源

租賃波場能量,降低 USDT 手續費:TronBid 拓展交易市場

人權基金會資助16個拉丁美洲和加勒比海的比特幣項目

英偉達 Qwen3.8-Flash-Next 在 GB300 NVL72 上實現超 1.6 萬 Token/秒吞吐

GLM-5.3-Flash 正式開源,320B 參數啟動 18B,價格為 GLM-5.2 十分之一

長鑫與長江存儲借蘋果驗證品質,拓展北美市場

人權基金會向 16 個項目發放 6000 萬聰比特幣資助

阿里發布 Qwen3.8-Flash-Next 預告,基於 Qwen4 架構

Muse Spark 1.2 Contributor 版本限時免費

微軟修復 Entra ID 中的 CVE-2026-69836 漏洞

DeepSeek API 週末調用將適用低價費率
DeepSeek 將於 23 日上午 1 時(韓國時間)開始,對 API 週末調用的費用整天計算為低價區間價格。平日高峰時間與週末費用的區別將影響開發者和 AI 服務。

Gemini 3.7 Flash 上線一週破增長紀錄

AI安全成本重估|Rewire新聞早報

DeepSeek推出V4 Pro,Claude Fable 5在成本提高4600%下表現提升5.3%

DeepSeek V4 Pro,自4月24日起提供
DeepSeek V4 Pro在API和聊天界面中再次被捕捉到。然而,官方文件中已明確指出V4 Pro和V4 Flash自4月24日起已經提供,因此難以視為新產品...

Flash Trade 或將停止營運,尋求收購方案

谷歌Gemini 3.5 Pro發布時間延遲
彭博社報導,谷歌的下一代人工智慧模型Gemini 3.5 Pro的發布時間比原定的時間推遲了。8月10日...

2026年第三季伺服器DRAM價格預期上漲13~18%
由於AI伺服器對高帶寬記憶體(HBM)的需求增加,2026年第三季伺服器DRAM合約價格預計將較前一季上漲13~18%。記憶體廠商將生產能力轉向HBM和伺服器產品...

SK海力士與 Sandisk 發布首個 HBF 標準,Google 與 Tenstorrent 加入聯盟

國家超算互聯網上線 DeepSeek-V4-Flash API

摩根大通解讀:Token和H100同步降價,AI成本開始降溫?

美銀重申美光「買入」評級,稱半導體回調屬正常修正

Deepseek 官網公布 deepseek-v4 接口文件
ChainCatcher 消息,Deepseek 官網上線 deepseek-v4 接口和模型介紹,包括 deepseek-v4-flash 和 deepseek-v4-pro。
Google Gemini 減少高達 88% 的標記使用量以分析視頻
Google 將基於代理的視頻分析整合到多個 Gemini Flash 模型中。該工具能夠自主選擇相關的場景、幀、音頻或文字記錄,根據公司說法,能夠將標記的使用量減少高達 88%,同時在某些評估中略微提高準確性。
B.AI 宣布 DeepSeek V4 Flash 將結束免費並 5 折計費
谷歌Gemini 3.8 Flash最快周三上線,內部代號Skimaki
DeepSeek 開放 V4-Flash-Vision-Exp 權重,支持本地部署
B.AI 平台 Token 吞吐量突破 5.74 萬億
Google 創建 WikiSkill 讓 AI 代理記住錯誤並改進
Google Research 的研究人員介紹了 WikiSkill,這是一個保存 AI 代理錯誤和成功的框架,並在持久的維基中創建更好的指令以便未來的執行。測試顯示在數學、電子表格和互動環境方面取得了重要進展,儘管該系統仍未在嚴格意義上代表持續學習。
...


