Writer发布新模型Palmyra X6主打降本
币界网报道:
企业客户正越来越关注 AI 部署成本,尤其是在大模型调用量持续上升的背景下。Writer 这次发布的新模型和配套工具,瞄准的就是这一压力点:尽量在不改变企业使用习惯的情况下压低执行成本。
Palmyra X6面向企业部署
Writer 周四发布新旗舰模型 Palmyra X6。该模型基于 Z.ai 开源模型 GLM-5.2 的后训练版本打造,定位是面向企业直接落地使用,而不是单纯追求基准测试成绩。
公司称,Palmyra X6 将与其他 Writer 模型,以及通过 Azure 或 Amazon Bedrock 接入的外部模型并行提供,客户不需要围绕单一模型重建整体系统。
配套升级瞄准令牌成本
与新模型一同发布的,还有 Writer 标准 agentic harness 的一轮重要升级。重点不只是模型本身,而是模型执行多步骤任务时的调度、调用和推理流程。
- 新模型为 Palmyra X6
- 基础模型来自 GLM-5.2
- 基础任务成本最高可降 50%
Writer 预计,新模型加上这套基础设施调整后,客户在基础任务上的成本最高可下降 50%。公司强调,复杂任务如果能以更少 token、更快速度完成,整体部署费用就会明显下降。
研究称流程优化更有效
Writer 研究团队近期发布的一篇论文也支持这一判断。论文测试了多种模型在不同执行流程下的成本变化,结果显示,很多情况下,优化 harness 效率比单纯更换模型更稳定,平均可带来约 40% 的成本下降。
Writer 首席执行官 May Habib 表示,企业客户对持续追逐新基准测试的兴趣正在减弱,关注点正转向成本能否稳定下来。她还称,部分企业技术负责人对大型 AI 实验室的信任正在下降,原因之一是后者的商业模式与 token 使用量高度相关。
-- 价格
本内容仅供参考,不构成任何金融、投资、法律或税务建议。文中提及的任何活动、奖励、线上活动或相关信息,不应被视为对购买、出售或交易任何加密资产的推荐、招揽或邀请。加密资产具有高波动性,存在价值损失风险。WEEX服务、产品及相关活动的可用性可能因地区而异。用户在参与前有责任确保符合当地适用法律法规。
猜你喜欢

Hermes Bot Mode 正式内置,支持 AI 群组协作

人工智能竞赛:美国要求选择阵营 - 法国Mistral转向中国

GPT-5.6,工作成本降低三分之一

ZCode 免费送 1 亿 GLM-5.3 Token 活动上线一小时暂停

web3: Z.ai发布GLM-5.3 编程模型瞄准开源权重市场

比特币红队在Kimi K3扫描后发现7,958个问题

智谱唐杰预告 GLM-5.3 上线在即

GPT-5.6 解决方案,成本比 K3 低 13%

Mistral 开始托管智谱 GLM-5.2 模型

克劳德代码在28个模型比较中超越17个代码伙伴

智谱ZCode升级,Goal+子Agent功能上线

智谱用户接近700万,启用超5万块国产AI芯片

GLM-5.2暴跌95%,威胁DeepSeek的价格战

比特币的人工智能安全冲刺在55小时内发现6700个问题,但没人知道其中有多少是真实的

Pally 完成 520 万美元融资,Cyber Fund 和 Y Combinator 领投

AMD推出企业级AI编程平台AMD Instinct Coder

OpenRouter 周榜中国模型占八席













