DeepSeek V4 Pro 登陆硅基流动:百万级上下文…

AI广播站11小时前更新 小悠
6 0 0

DeepSeek-V4-Pro-0813正式上线硅基流动 SiliconFlow,而且是 Day-0首发。这次更新的核心卖点是三个数字和一种取向:1M 上下文窗口、低/高/最大三档推理强度,以及更明确地把重心压在编码、工具调用和智能体工作流上。开源协议没变,仍然是 MIT。

定价结构也摆得很清楚:每百万输入 token 收1.32美元,每百万输出 token 收3.96美元,而缓存命中 token 只要0.44美元。最后这个数字才是真正值得琢磨的——对大量依赖反复调用、长上下文输入的 Agent 工作流来说,缓存命中价格压到这个水平,意味着长文本场景下的单位成本测算有了更具体的锚点,不至于一跑长上下文就烧穿预算。

DeepSeek V4 Pro 登陆硅基流动:百万级上下文窗口配三档推理强度,缓存命中每百万 token 只要 0.44 美元

同系列里还摆着 DeepSeek-V4-Flash-0731,定位截然不同:它面向的是追求速度和高性价比的日常生产负载,走快而省的路子;V4Pro 则冲着复杂推理、编码和智能体工作流去,要的是脑子。两个型号一快一重,把日常生产和重度推理的档位分开,用户各取所需。

微软宣布,Copilot语音模式中会做表情的黄色小团子Mico将不再出现在聊天界面,并迁移至Learn Live学习平台,以便“有更多可反应的内容”。Mico去年10月才上线,距今不到一年。微软AI CEO穆斯塔法·苏莱曼曾称其旨在赋予聊天机器人“身份感”。该变动最早由GeekWire报道。

MiniMax推出音乐生成模型MiniMax-Music3,输入歌词与音乐描述即可生成最长5分钟完整歌曲,输出32kHz、16-bit立体声WAV。其采用分层自回归架构,两模型分工:全局语言模型Global LLM参数8B,逐帧预测首个RVQ码本,负责歌曲长程语义与结构变化;该模型由Qwen3-8B初始化,训练时先让嵌入层和输出层适配音乐。

本地部署大模型不等于胜任真实业务,AI还需精准理解复杂规则、遵守安全边界、正确调用外部工具。针对这一痛点,蚂蚁ASystem团队联合开源社区维护的本地化后训练工具包AReno,携手百灵大模型推出轻量级后训练实践路径,以提升模型业务落地能力。

金山办公“灵犀专业版”于2026年8月14日接入DeepSeek-V4-Pro正式版,用户无需配置,手动切换即可体验。该模型支持100万token超长上下文,单次最大输出38.4万token,基准测试较Preview全面提升,落地场景具差异化优势。

贾樟柯编剧新片《敦煌妈妈》备案立项,讲述敦煌独居母亲借助AI排解寂寞、了解外界,最终完成横穿中国之旅。主演赵涛、廖凡,预计2027年上映。

DeepSeek V4 Pro 登陆硅基流动:百万级上下文…

关注 “悠AI” 更多干货技巧行业动态

© 版权声明

相关文章

没有相关内容!

暂无评论

您必须登录才能参与评论!
立即登录
none
暂无评论...