法國AI初創Kog押注軟體提速GPU推理
AI 推理提速競爭正在升溫。法國初創公司 Kog 沒有選擇自研晶片,而是押注透過底層軟體優化,進一步釋放企業現有數據中心 GPU 的推理能力。
先瞄準企業高時延場景
這家公司在今年 5 月因一項技術預覽受到關注。Kog 當時展示,使用 AMD MI300X 和 Nvidia H200 等標準數據中心 GPU,也能實現極快的單請求解碼速度。公司隨後稱,這一展示帶來了約 200 個明確的商業線索。
Kog 目前優先關注對響應速度要求較高的專業工作流,尤其是軟體工程場景。按照公司說法,一些重度代碼生成用戶等待結果的時間可能長達數小時,推理延遲已成為影響使用體驗和成本的重要問題。
公司還在與部分設計合作夥伴推進應用落地。這類客戶允許用戶透過提示詞生成遊戲或應用,若推理速度提升,通常意味著更高的轉化效率和收入空間。
小模型已跑出 3000 TPS
Kog 此前提出「讓大模型推理提速 30 倍」的目標,但目前公開演示仍主要基於小模型。其展示使用的是約 20 億參數的 Laneformer 2B,單請求推理速度達到每秒 3000 個 token。該模型現已開源。
不過,市場需求並未停留在小模型微調。Kog 表示,潛在客戶並不準備把重點放在小模型上,因此公司自發布演示後,已將主要精力轉向更大模型的加速開發,以匹配實際需求。
9 月前後驗證大模型能力
Kog 認為,GPU 在推理解碼上的潛力仍未被完全釋放。公司首席執行官 Gaël Delalleau 表示,隨著新一代 GPU 記憶體帶寬持續提升,軟體層仍有較大優化空間。
這種方法的代價是研發週期較長。Kog 表示,每適配一款新 GPU,團隊往往需要投入數週甚至數月做硬體層面的研究。以目前 11 人團隊規模來看,公司短期內可支持的晶片數量仍然有限。
Kog 計劃未來把這套方法逐步接入基於智能體的研發流程,以支持更多晶片和模型。眼下更關鍵的節點,是先證明這一路線能在大模型上成立。Delalleau 預計,公司將在 9 月前後完成首個主要模型約 10 倍提速的實現,並據此展示客戶進展,推動後續 A 輪融資。
-- 價格
本內容僅供參考,不構成任何金融、投資、法律或稅務建議。文中提及的任何活動、獎勵、線上活動或相關資訊,不應被視為對購買、出售或交易任何加密資產的推薦、招攬或邀請。加密資產具有高波動性,存在價值損失風險。WEEX服務、產品及相關活動的可用性可能因地區而異。用戶在參與前有責任確保符合當地適用法律法規。
猜你喜歡

Qwen 27B 在部分編碼基準中超越 Claude Opus

英偉達擴展AI融資計畫至5000億美元
![[阿爾法分析] 彼得·蒂爾,投資組合72%轉向電力…AI投資的瓶頸正在轉移](/public-static/7_ca1b7746d1.png?format=avif)
[阿爾法分析] 彼得·蒂爾,投資組合72%轉向電力…AI投資的瓶頸正在轉移

百度 Q2 財報總營收 313 億元,AI 業務收入占比過半

瑞銀調研中國AI產業鏈:大模型加速迭代,資金開始湧向半導體

NVIDIA共同封裝光學開關量產,供應鏈擴大

當 AI 向華爾街借錢:科技巨頭的「CapEx 週期」,加速金融化

CME計劃於10月5日上市兩種GPU租賃期貨

OpenAI 俄亥俄超級數據中心簽約,英偉達最高擔保 1050 億美元

AI時代的「新石油」,算力期貨即將上線

Gonka 開始支援 DeepSeek V4 Flash 0731
蔚山水下數據中心,推動AI基礎設施實證計畫

大型科技公司的人工智慧支出將達6650億:投資還是泡沫?

比特幣礦工轉向人工智慧,哈希率下降

HIVE 2027 年第一季度收入:增長 73.5%,但虧損達 1.42 億美元

資本關鍵時刻來臨?AI敘事從技術轉向融資,巨頭現金流告急、債市已拉響警報

英偉達擬向SB Energy投資30億美元支持OpenAI項目

閃迪股價飆升500%後:SNDK還能繼續上漲嗎?

H100 租金上漲 40% GPU 市場分化
Gemini 3.7 快速評測:Google 的廉價模型不再愚蠢

中國開源 AI 模型崛起,超越美國同行

媒體報導:Anthropic 預計在 2028 年 IPO 前收入可達 2000 億美元

馬克·庫班將人工智慧晶片視為新的投資領域






