来自频道: @AI_News_CN
来自频道: @AI_News_CN
旧版强制退役!Codex将下线多款大模型,GPT-5. 5 降智风波仍悬而未决

深受开发者依赖的旧版大语言模型,即将迎来由平台主导的“强制退役”潮。Codex 官方团队近日宣布,将从 2026 年 6 月 2 日起正式下线 GPT-5.2 和 GPT-5.3-Codex 等多款旧版本模型。平台此举旨在全面推行其最新的前沿旗舰模型 GPT-5.5,但这一决定在开发者群体中引发了不小的争议。

核心旧模型下线引发反弹

近期诸多开发者公开抱怨,最新版的 GPT-5.5 模型在实际应用中存在明显的“降智”行为,不仅逻辑处理能力有所下滑,问题处理过程也需要消耗更长的时间。为了维持业务稳定,不少开发者此前主动切换回了更成熟的 GPT-5.3-Codex 或 GPT-5.4 历史版本。如今 Codex 团队决定强行下线部分旧版,意味着免费用户未来将无法切换,被动绑定在备受争议的 GPT-5.5 上。

付费方案与特殊模型暂留缓冲

为了平息开发者的不满,Codex 在公告中也针对不同群体开出了差异化的模型留存政策。对于通过 ChatGPT 登录的订阅付费用户,虽然 GPT-5.2/5.3 无法继续使用,但平台后续仍会保留 GPT-5.4 和 GPT-5.5 供其选择;而通过 API 调用模型的商业开发者则暂时不受本次下线政策的影响。此外,主打极高响应速度的特殊模型 GPT-5.3-Codex-Spark 也被列入豁免名单,已获权限的开发者后续仍可正常调用。

via AI新闻资讯 (author: AI Base)
来自频道: @AI_News_CN
来自频道: @AI_News_CN
AI 独角兽 Cognition 完成 10 亿美元融资,估值飙升至 260 亿美元

5 月 27 日,自动驾驶 AI 软件工程师“Devin”的母公司 Cognition 正式宣布完成新一轮超过 10 亿美元 的融资。此次融资前的估值即高达 250 亿美元,投后估值达到 260 亿美元。

一、资本市场的“疯狂”跳跃

仅在八个月前(2025 年 9 月),Cognition 完成了 4 亿美元融资,当时的投后估值约为 102 亿美元。短短八个月内,其估值增长了超过 150 亿美元,这一跨越式增长不仅展示了资本对 AI 编码赛道的极度追捧,更凸显了 Cognition 在行业内的头部地位。

本轮融资由 Lux Capital、General Catalyst 和 8VC 领投,Founders Fund 等多家既有投资机构跟投,同时吸引了 Ribbit Capital 等新晋投资者入局。

二、破局者的底气:客户与营收双增长

在 OpenAI、Anthropic 等大模型厂商纷纷下场布局编程工具(如 Claude Code、Codex)的市场环境下,Cognition 的独立生存能力备受关注。然而,公司给出的成绩单极具说服力:

● 企业级客户: 凭借 Devin 的出色表现,Cognition 成功锁定了梅赛德斯-奔驰、NASA、高盛(Goldman Sachs)及桑坦德银行(Santander)等全球顶尖企业客户。
● 爆发式营收: 目前,Cognition 的年化收入运行率(ARR)已达到 4.92 亿美元。随着企业级用户对 Devin 的深度依赖,过去六个月内,该平台的企业端使用量保持了每月 50% 的高速增长。
● 技术整合: Cognition 此前收购了 Windsurf 的剩余资产,进一步强化了其在 AI 编码领域的底层技术与人才储备。

三、行业信号:AI 编码的“独立战场”

Cognition 的此轮融资向市场释放了一个强力信号:AI 软件工程领域并非仅是大模型厂商的附属品。

行业此前担忧 AI 代码生成市场会被 OpenAI、Google 等巨头模型厂商“吞噬”。但 Cognition 的实践证明,通过高度专注的 AI 智能体产品(Agentic AI),并深度整合企业级复杂工作流,初创公司同样能构建出高壁垒的商业闭环。

对于投资者而言,Cognition 代表了 AI 落地最核心的价值——直接生产力转化。Devin 不仅仅是一个辅助补全代码的工具,而是一个能够独立完成软件开发生命周期任务的“AI 工程师”,这种能够直接为企业削减人力成本、提升开发效能的解决方案,正是当前 AI 泡沫浪潮下,资本最渴望捕捉的“硬通货”。

via AI新闻资讯 (author: AI Base)
来自频道: @AI_News_CN
来自频道: @AI_News_CN
中外AI对决 国产三强只能争夺全球第五

SuperCLUE最新中文大模型测评结果出炉,全球第一梯队被海外模型牢牢占据,国产表现最好的三款模型,只能在全球第五名的位置上激烈竞争。本次测评覆盖21款国内外主流模型,测评集包括六大任务:数学推理、科学推理、代码生成、智能体(任务规划)、精确指令遵循、幻觉控制,共492题。

Gemini、GPT-5.5、Claude-Opus、Gemini-Flash四款海外模型稳居前四,形成难以撼动的第一梯队。

DeepSeek-V4-Pro、Qwen3.7-Max、豆包Seed 2.0 Pro三款国产模型分数非常接近,组成国内第一梯队,全球排名集中在第五位附近,成为国产第一集团。

虽然整体仍有差距,但国产模型进步很明显。代码生成项目中,Qwen3.7-Max得分仅次于海外头部模型,差距不到2分。数学推理、科学推理等项目,国产模型也多次冲进全球前列。

性价比方面,国产模型优势突出,多款产品进入高性价比区间,用更低成本实现接近头部的效果。推理效能上,海外模型仍垄断高效能区,国产模型多处在中低区间,还有提升空间。

整体来看,国产大模型正在快速追赶,但全球第一梯队的格局暂时没变。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:快科技)
来自频道: @AI_News_CN
来自频道: @AI_News_CN
来自频道: @AI_News_CN
Codex将从6月2日起下线GPT-5.2/5.3-Codex模型 但GPT-5.5降智问题仍未解决

近期诸多开发者抱怨 GPT-5.5 模型存在明显的降智行为,并且问题处理过程也需要消耗更长的时间,开发者们不得不切换到旧版模型例如 GPT-5.3-Codex 或 GPT-5.4,不过现在 Codex 团队决定将从 6 月 2 日开始下线部分旧版模型,该团队仍然推荐开发者们使用 GPT-5.5 等前沿旗舰模型。

付费用户可继续使用 GPT-5.4/5.5:

对于使用 ChatGPT 登录且已经订阅付费方案,Codex 后续仅提供 GPT-5.4 和 GPT-5.5 模型,而 GPT-5.2 和 GPT-5.3-Codex 版模型将会被下线无法继续使用,如果开发者并非通过 ChatGPT 登录而是使用 API 调用则不受影响,API 平台的模型提供政策以 API 平台发布的公告为准。

而对于使用 ChatGPT 登录且使用的免费方案的用户,Codex 后续将默认使用 GPT-5.5 并且应该是没法切换的,不过本身免费版用户 Codex 使用额度非常低所以是否保留旧版模型似乎也没有太大的实际意义。

另外部分特殊模型也仍然按照原有政策提供,例如 GPT-5.3-Codex-Spark 模型,该模型提供极高的响应速度属于 OpenAI 提供的特殊模型,不受 Codex 或 ChatGPT 日常模型调整的影响,已经获得权限的开发者可以继续使用 Spark 系列模型。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:蓝点网)
来自频道: @AI_News_CN