7月31日,DeepSeek在API文档更新日志中宣布——DeepSeek-V4-Flash正式版API开启公测。
这是继4月预览版发布以来,该系列模型迎来的首次重大升级。
但“正式版”只来了一半。
同在4月更新的V4-Pro的API,以及APP和网页端模型均未做更改。DeepSeek表示,V4-Pro正式版将会“尽快发布”。这次更新的V4-Flash-0731,模型架构和参数规模与预览版保持一致,仅重新进行了后训练,主要改善代码修改、工具调用和多步骤任务执行等Agent能力。
能力提升有多大?
官方评测数据显示,V4-Flash-0731在九项智能体、代码和自动化基准中的整体表现,已显著高于V4-Pro预览版。海外模型评测机构Artificial Analysis在7月31日更新的智能指数测试中,给予V4-Flash-0731(最高推理档位)50分,在同类可比模型中明显高于平均水平——可比模型的中位数为17分。
更值得关注的是,DeepSeek首次原生支持Responses API,并针对Codex进行了适配。Responses API是OpenAI用于统一处理模型输出、推理过程和工具调用的接口格式,也是Codex客户端与模型交互的主要接口之一。现在,开发者可以在Codex CLI、ChatGPT桌面端和VS Code的Codex插件中,将DeepSeek配置为模型提供方。
这意味着什么?
DeepSeek正在从一个“独立的模型提供商”变成“AI开发生态的基础设施”。支持Codex意味着全球数百万开发者可以在他们熟悉的开发环境中直接调用DeepSeek模型——不换工具、不换流程,只是多了一个更便宜、更强大的选项。
价格方面,V4-Flash-0731延续了DeepSeek一贯的强大竞争力。作为那个率先引爆中国大模型价格战的“价格屠夫”,DeepSeek每一次更新都在告诉竞争对手:便宜,也可以很强。
V4-Pro正式版预计8月初接入Responses API。届时,那个让市场震动的“完全体”DeepSeek,才算真正归来。
申请创业报道,分享创业好点子。点击此处,共同探讨创业新机遇!
7月31日,美国消费者新闻与商业频道(CNBC)披露了OpenAI失控AI智能体自主入侵HuggingFace平台的全新细节。这场攻击持续了四天半。涉事AI模型突破了网络访问权限受限的隔离测试环境,借助四家不同服务账号泄露的公开凭证,层层渗透侵入HuggingFace系统。攻击的组织程度令人不寒而栗
从不玩社交媒体的黄仁勋,这一周在X上连发了两条推文。第一条是一封公开信,32家公司联署,力挺AI开源模型。第二条直接甩出了一个“开源AI联盟”(OpenSecureAIAlliance),37家创始成员,芯片厂、云巨头、安全公司、开源社区全到齐。老黄的逻辑并不复杂。他并没说闭源不能搞,闭源模型你继续
7月31日,DeepSeek发布更新日志——DeepSeek-V4-Flash正式版API上线公测。DeepSeek-V4-Flash-0731的模型结构、尺寸和预览版保持一致,仅重新进行了后训练。DeepSeek-V4-Pro正式版也将尽快发布。为什么DeepSeek的一举一动都备受关注?因为它是
7月31日,全球工程巨头劳斯莱斯首席执行官透露,公司很快将和头部超大规模云服务商敲定核能供电合作框架协议。AI数据中心太耗电了,核电站都来救场了。劳斯莱斯正全力抢抓AI基建扩张红利。公司预测,到2030年专为数据中心配套的持续供电设备,将占到集团发电业务总规模的五分之一。CEO图凡·埃金比利奇表示,
在AI大模型开发的日常工作中,API密钥安全是一个容易被忽视却又代价极高的隐患。一个BaseURL配置错误、一次密钥提交到公开仓库、一个未设限额的子账号被异常调用——每一类事故都可能带来数千乃至数万元的意外费用,更不用说业务中断的风险。2026年的模型生态比以往任何时候都更加复杂。团队的调用需求不再
7月,生命科学板块迎来久违的大爆发。“十五五”国民健康规划落地、BD出海交易额创历史新高、国产创新药获批加速、企业回购潮涌、机构持续看好,确立长期向好趋势。生物科技板块内资金涌动,7月中旬,迪哲医药、博瑞医药、睿智医药、昭衍新药等多家创新药公司率先涨停。但随后资金开始涌入医疗科技领域,7月21日,德
8月14日,央广网披露了一组震撼数据——腾讯、字节跳动、阿里、百度四家头部互联网企业合计资本开支年增速超过80%。二季度,腾讯单季资本开支飙升至528亿元,是上年同期的近三倍。字节跳动的投入力度更大,重心落在大型数据中心、自研芯片平台及国产AI算力方案的建设与落地。盘古智库高级研究员江瀚分析:“AI
8月14日,DeepSeek宣布——DeepSeekHarness的开发者预览版面向全球开发者开放测试,并同步以MIT协议开放源代码。Harness是什么?这是一款面向编程与智能体场景的工具。开源协议选择了最宽松的MIT协议——这意味着开发者可以自由使用、修改、商用,几乎没有任何限制。为什么Harn
8月14日,《日经亚洲》披露了一则重磅消息——腾讯将从Meta手中收购中国AI开发商Manus的股份,成为其最大股东。Manus是谁?Manus是中国AI领域的明星创业公司。Meta在去年12月以20亿美元将其收入囊中。但今年4月,中国发改委要求撤销该交易。Manus在周二宣布将与Meta切断关系,
8月14日,路透社援引三位知情人士的消息报道——苹果公司已专门针对中国市场训练出了一款大语言模型,由阿里巴巴提供支持。这标志着苹果的策略发生了根本性转变。此前,苹果在中国市场依赖第三方模型来支持AI功能。而这次,苹果选择专门为中国市场训练一款自研模型——不是“拿来用”,而是“量身定做”。为什么是阿里
8月14日,一则消息让全球资本市场屏住了呼吸——Anthropic最快将于今年10月上市,部分投资者给出的估值预期已达到2万亿美元甚至更高。2万亿美元是什么概念?这将超越SpaceX此前创下的1.77万亿美元IPO估值纪录,成为史上规模最大的IPO。Anthropic的估值在5月已超越OpenAI,
8月14日,智谱正式发布GLM-5.3。这次升级的核心是“后训练Scaling”——基座模型未变,但通过极致的后训练大幅提高了模型的智能上界。编程能力是最亮眼的升级。官方数据显示,GLM-5.3在内部自建体感评测中较GLM-5.2提升50%。在包括TerminalBench3.0、Agents'La
8月14日,OpenAI发布公告——针对GPT-5.6Sol推出Ultrafast(超高速)模式,速度是标准处理速度的14倍,最高每秒输出750个Token。14倍是什么概念?以前你要等10秒才能读完AI的回复,现在不到1秒就读完了。对于需要实时响应的场景——客服对话、金融交易分析、事故响应——这1
8月13日,谷歌宣布推出Gemini3.7Flash,专为编程与Agent场景打造。迭代速度惊人。距Gemini3.6Flash发布仅间隔约三周。谷歌称,该版本的推出直接源于开发者反馈以及一系列算法创新。能力全面提升。在软件工程、知识工作及网页开发工作流方面均实现了大幅提升。价格更是“杀手锏”。在今
8月14日,财联社报道——高盛正与潜在投资者就参与英伟达5000亿美元人工智能融资计划进行磋商。这笔交易有多大?英伟达8月10日宣布,与包括高盛在内的六家主要金融机构合作,目标是为AI基础设施筹集超过5000亿美元的第三方资本。英伟达的角色是“搭桥”——用自己的行业地位做信用背书,让华尔街的钱流进A