每日更新2026-09-23天天译,天天新
牛金金天天译站.NIUJINJIN
订阅
深度解读AI 人工智能全球

深层Seek-V4.1-Flash首播,收视率为0.003/1M美元,收视率和基准为GPT-5.6 Sol, Claude Opus 5

来源:VentureBeat 2026-09-10 约 2 分钟读完
字号

本期编译精选。【导语】DeepSeek昨晚推出DeepSeek-V4.1-Flash, 拥有5520亿参数的专家混合骨干。本土视野,100万个托克背景窗口,然而对于评价编码代理和其他长期运行的工作流程模型的开发者来说。头条API率只讲述了部分故事。DeepSeek昨晚推出DeepSeek-V4.1-Flash, 拥有5520亿参数的专家混合骨干,本土视野。100万个托克背景窗口,然而对于评价编码代理和其他长期运行的工作流程模型的开发者来说,头条API率只讲述了部分故事。在非高峰时段,DeepSeek价格为V4.1-Flash,按缓存命中每百万个输入令牌0.003美元。缓存错失每百万个输入令牌0.15美元和每百万个输出令牌0.60美元。峰值是这些数字的两倍。这种区分很重要,因为一个代理人反复针对同一寄存器、工具定义、系统指令或对话历史进行工作,可能比新上下文重读要多得多。因此,DeepSeek本身说,缓存-打击费用可以占代理成本的一大部分。因此,DeepSeek已设立的高峰窗口从周一至周五从1:00–04:00 UTC和06:00–10:00 UTC运行;因此,其他所有时间都停放。因此,因此,对于可安排的代理工作来说,工作量运行的时间本身就是另一个成本控制杠杆。因此,这使得V4.1-Flash成为一个问题的一个特别有用的测试案例 Beat自己的研究表示许多企业仍无法清晰地看到。因此,在VentureBeat Pulse 研究 2026年7月对雇员超过100名的170个企业的调查中。因此,只有47%的人说他们严格跟踪AI计算成本和ROI — — 这意味着53%没有。因此,与此同时,12%的人说他们还没有解决推理-memory限制,如KV-cache容量,还有7%的人不知道这种限制。因此,即使在大规模生产中经营AI的组织中。因此,严格的成本跟踪也只达到56%. 对建筑商的影响是直截了当的:仅比较未固定投入价格的模型就可能掩盖代理经济学中增长最快的组成部分之一。因此,0.003美元的数字改变了比较 DeepSeek 的外峰缓存输入率相对于边疆API相对w的异常低。因此,

(编译自 VentureBeat;原文

来源:VentureBeat(原文)
本文系本站对该英文资讯的编译与转述,非全文翻译;版权归原作者所有。
免费订阅

每天 5 分钟,看懂世界在发生什么

订阅「牛金金天天译站」,每日精选海外科技/AI/文化资讯编译送到你邮箱。非经营性、无广告、可随时退订。

立即订阅 →

评论

登录后可发表评论,评论审核通过后展示。

延伸阅读

↑