谷歌员工内测下一代 Gemini 3.8 Flash,测试者称明显优于 3.7 Flash

谷歌员工已开始内测下一代 Gemini 3.8 Flash 预览版,一名测试者称其明显优于 3.7 Flash。该预览版通过内部编码平台 Jetski 向员工开放,谷歌拒绝置评。

谷歌新一代旗舰大模型一再延期,转而加快推出更快、更便宜的 Flash 系列:3.6 Flash 于今年 7 月发布,3.7 Flash 三周后跟进,CEO 皮查伊曾表示计划近乎每月推新。

Business Insider

🌸 在花频道 · 茶馆水群 · 投稿通道

via 科技圈🎗在花频道📮 - Telegram Channel
来自频道: @AI_News_CN
Anthropic首款在物理世界运行的AI工具问世

根据周四 Anthropic 发布的最新公告,该公司即将推出一套研究系统,该系统可让其软件控制科学和工程设备以进行实验,这标志着这家公司首款专为在物理世界中运行而设计的AI工具问世。这款名为“模型硬件标准” (Model Hardware Standard)的新工具,将使AI智能体能够自主操作各种可通过计算机代码编程的设备,范围从复杂的显微镜到液体处理仪、激光器和机械臂等。该工具可将硬件集成时间从数周甚至数月缩短至数小时甚至几分钟,支持24小时自主实验运行。

—— 财联社

via 风向旗参考快讯 - Telegram Channel
来自频道: @AI_News_CN
腾讯混元大模型王炸升级:770B旗舰新版Hy4preview震撼开源,直奔开源第一梯队

腾讯混元团队今天正式发布全新一代旗舰模型预览版——Hy4preview。该模型总参数量达到770B,激活参数为49B,上下文长度支持到1M。凭借在模型尺寸、上下文长度及数据规模上的全面扩展,它在代码、办公、科学等真实生产力任务中展现出卓越性能,稳居开源模型第一梯队。在多项内部盲测中,其综合表现优于同类竞品。

在真实生产力场景的应用上,Hy4preview通过与腾讯内部多领域专家的深度合作实现了多维跃升。软件工程方面,它显著增强了长程开发理解、规划、调试与验证能力,并优化了前端视觉审美与交互质量;办公分析方面,大幅提升了复杂办公环境理解与金融分析水平,能顺畅完成从信息处理到文档、表格与演示文稿的完整交付流程;游戏开发方面,支持仅凭一句需求直接生成可玩原型,并能熟练调用游戏引擎进行多轮迭代;科学研究方面,在AI研发、分子动力学模拟、凝聚态物理及基础数学等场景中均有长足突破。同时,它持续与 CodeBuddy、WorkBuddy 等工具深度协同,进一步打磨了真实用户体验。

在科学前沿与复杂推理的探索中,Hy4preview同样表现亮眼。它不仅能自主定位并优化推理系统瓶颈,实现端到端吞吐相较基线提升31.8%,还能像研究者一样协调多个 Codex Session 组织实验并持续迭代。在机器学习力场分子动力学模拟中,它配合Hyra实现了显著提速,为新材料筛选与药物研发打开了更大空间。在凝聚态物理低温量子输运器件设计中,它独立完成了量子散射求解器构建和五势垒结构的稳健优化,将高能阻带平均泄漏率大幅降低。此外,它还在百年经典几何难题——三维 Blaschke–Lebesgue 问题上取得重大突破,将体积下界推高至0.41104,使该猜想距离最终证明仅剩最后2%的差距。

目前,Hy4preview 已经全面开源,并上线腾讯云 TokenHub 与OpenRouter,用户也可通过元宝、ima 等多款产品进行体验。作为早期预览版本,团队未来将依托广泛的真实反馈加速敏捷迭代,持续带来正式版的升级。

via AI新闻资讯 (author: AI Base)
来自频道: @AI_News_CN
来自频道: @AI_News_CN
来自频道: @AI_News_CN
Anthropic重磅发布模型硬件标准MHS,AI Agent正式迈向实体操控

人工智能企业Anthropic近日正式推出面向硬件的MCP标准——模型硬件标准。作为一项旨在帮助大模型驱动的AI智能体安全、快捷操纵物理设备的新标准,MHS被视为推动AI技术跨越虚拟与现实鸿沟的关键一步。

该标准源于Anthropic与霍华德·休斯医学研究所Janelia研究园区的深度合作,目前已面向首批科研实验室和先进制造商开放研究预览版。在实际应用中,MHS展现出了惊人的效率提升,能够将硬件集成所需的时间从过去的数周甚至数月,大幅缩短至数小时甚至数分钟,极大地降低了科研与工业自动化的技术门槛。

在核心功能与协作表现上,MHS能够助力研究人员和工程师轻松协调自主全天候的实验与工作流程。在测试过程中,接入该标准的Claude展现出了类似人类科学家的探索性。AI智能体不仅能够自主推理实验步骤、动态更新各项参数,甚至能够在完全无需人工干预的情况下,从突发的硬件故障中恢复正常运行。

在硬件适配与控制机制方面,MHS具备极高的通用性。它能够适配任何具备可编程接口的物理设备,且与底层基础模型的种类无关。通过统一的标准化驱动程序,该标准有效攻克了设备通信以及与智能体交互等行业难题,甚至能让智能体自主理解陌生设备。目前,MHS主要提供MCP、命令行界面和代码文件这三种控制硬件的具体机制。

尽管展现出巨大的应用潜力,但MHS在现阶段仍存在一定局限性,例如目前尚无法兼容完全不具备可编程接口的传统硬件。对此,Anthropic正积极推进标准的完善工作,众多早期采用者也正积极参与相关的测试与集成,共同推动AI走向更广阔的物理世界接管与协作。

via AI新闻资讯 (author: AI Base)
来自频道: @AI_News_CN
Anthropic 推出 MHS 硬件标准,首次重拳杀入物理 AI 赛道

Anthropic 于 8 月 27 日发布博文,以研究预览形式推出"模型硬件标准"(MHS)。路透社、CNBC 等媒体解读认为,这标志着该公司首次公开进军具身智能与物理 AI 领域——即能感知物理世界、执行复杂动作并持续学习的 AI 系统,从自动驾驶到机械臂皆可承载。

给 AI 装"身体"的统一翻译层

与早前的模型上下文协议(MCP)类似,MHS 本质是一套统一的控制与通信标准,让 AI 智能体操控具备可编程接口的设备。借助这一"翻译层",代理可在几乎无人工干预下同时控制显微镜、液体处理器、机械臂乃至量子计算设备,全天候自主跑流程。

早期闭门测试中,MHS 在生物医药、量子计算与先进制造等硬科技领域展现出极强提速能力。制药巨头基因泰克称,赋予 AI 直接操控多台异构实验设备后,全自动剂量反应曲线实验的开发与运行周期缩短至原来的三分之一。Anthropic 把 AI 从数字世界推向实体产线的这一步,也意味着大模型竞争正从"对话"延伸到"动手"。

via AI新闻资讯 (author: AI Base)
来自频道: @AI_News_CN
来自频道: @AI_News_CN
OpenAI、微软、Anthropic等逾百家企业呼吁紧急强化网络防御

随着人工智能模型在网络安全任务上的能力迅速提升,科技行业领袖警告称,网络防御人员为应对下一代网络威胁所剩的准备时间已十分有限。OpenAI近期推出的GPT-5.6-Cyber,在漏洞利用链、身份验证绕过和权限提升等高级网络安全请求中完成率达到95%。该公司此前还透露,即将推出的Astra模型将具备更强的网络安全能力。

面对更强大的模型即将陆续问世,全球多家大型科技企业认为,网络防御机构必须尽快为未来威胁做好准备。OpenAI当天发布了一封公开信,呼吁在全球范围内加大网络防御投入。目前已有超过100家机构在信上签名,其中包括微软、Google、Anthropic、AWS、AMD、思科、Cloudflare、CrowdStrike、IBM、甲骨文、Palo Alto Networks、Fortinet等企业。

这些公司预计,随着模型能力持续增强,未来数月内,由人工智能驱动的网络攻击将变得更加普遍,也会更加复杂。医院、水处理设施、互联网基础设施及其他关键服务都可能受到严重影响,因为其中许多机构仍依赖老旧系统,存在软件未修补、身份验证薄弱、权限过度授予等安全问题。

公开信认为,应让更多网络安全专业人员获得高能力AI模型的使用权限,以便更快发现漏洞、制定修复方案并响应攻击事件。

信中敦促各组织优先修复风险最高的漏洞,并采用更严格的访问控制措施。同时,网络安全厂商也应持续根据前沿AI能力测试自身产品,并将AI驱动的防御机制纳入现有安全工具。

公开信在结尾呼吁产业界和政府部门调动全部技术、资源与专业能力,推动具备网络安全能力的AI优先服务于保护关键基础设施的防御团队;修复最危险的薄弱环节、验证修复效果,并分享有效经验,使其他机构能够在此基础上进一步提升能力。信中表示,应将当前AI技术进步转化为惠及所有人的长期安全改善。

此外,政府被呼吁为医院、公用事业机构、地方政府及其他资源不足的组织提供网络安全改进资金。OpenAI、Anthropic等前沿AI企业则应向防御人员提供模型访问权限、资金、培训、安全工具及现场支持。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
来自频道: @AI_News_CN
黄仁勋:在很多任务上我们已实现AGI

当被问及OpenAI对AGI的追求时,黄仁勋表示,就英伟达而言,“对于很多任务来说,我们可以说已经实现了 AGI。”他没有提供明确的定义或基准,但补充道,“我认为,所有这些所谓的里程碑……到了现在,其实已经没什么意义了。”他还指出,人工智能正在从响应简单提示词,发展到能够 “递归地” 学习新技能并改进自身的自主智能体。黄仁勋说,真正重要的是,人工智能正在“做有成效且有用的工作”并“生成可盈利的tokens”,更多的算力产生更多的tokens —— 并且必然带来更多的利润。这正是我们目前所处的阶段。这也是为什么每个人都在全力投入的原因。

—— Theverge

via 风向旗参考快讯 - Telegram Channel
来自频道: @AI_News_CN
AI自己找活干?OpenAI测试持久在线智能体

OpenAI正在为其旗舰AI智能体 Codex 开发一个具有主动性且高度持久性的版本。根据产品代码库变更,OpenAI近日已开始在其命令行版 Codex 中添加新的“持久模式”设置代码。目前,“持久模式” 尚未大范围推出,也尚未正式公布,但未来可能会推出。

“持久模式”出现了在Codex的“推理强度”菜单中。其中,用户可以选择允许AI模型在回答提示词之前使用多少计算资源、Token 以及时间进行 “思考”。从目前的信息来看,它似乎是OpenAI公司计算资源消耗最高的设置之一。当用户选择“持久模式”后,Codex将“持续工作,直到被置于休眠状态”。

—— 凤凰网科技连线杂志

via 风向旗参考快讯 - Telegram Channel
来自频道: @AI_News_CN
美国国防部被裁禁止拉黑Anthropic公司

当地时间 8月27日,美国加州北区联邦地区法院法官裁定,美国国防部将Anthropic公司列入黑名单属于非法行为。法官丽塔·林在裁决书中写道:“无可争议的事实记录表明,美国国防部的行为构成了对宪法第一、第五修正案的违反。事实记录进一步表明,美国国防部长赫格塞思将 Anthropic指定为‘供应链风险’的决定违反了相关法定框架…且属于武断和反复无常的行为,这一点不存在实质性争议。”今年三月初,Anthropic 公司因拒绝美国国防部无限制使用其人工智能技术的要求,被列入联邦政府供应链风险黑名单。该企业随即对美国国防部提起诉讼。

—— 财联社彭博社

via 风向旗参考快讯 - Telegram Channel
来自频道: @AI_News_CN
科技公司呼吁全社会集体防御AI黑客攻击

OpenAI、Anthropic、微软、谷歌和亚马逊等主要科技公司,呼吁全社会发起一场防御总动员,以击退他们所称的由AI驱动、即将来袭的一波黑客攻击。在周四发布的一封联合公开信中,这些公司与其他 100多家公司一道表示,在AI威胁到来之前,留给他们“让数字世界变得更加安全”的时间已经不多了。

信中写道:“未来几个月,随着世界各地的AI模型能力不断增强,由AI驱动的网络攻击将变得更加普遍。” 呼吁政府和行业领导者“倾尽全力,将其技术、资源和专业知识投入到这项工作中”。信中还呼吁各国政府加快推进可信访问计划,允许特定公司在更强大的AI模型向公众开放之前,提前获得访问权限。

—— 凤凰网科技路透社

via 风向旗参考快讯 - Telegram Channel
来自频道: @AI_News_CN
AI竞赛迅速推进 Google新模型刚上线 员工已开测下一版

据《商业内幕》报道,Google公司本月刚刚发布了一款新的AI模型,但其员工已经开始测试下一款模型了。一些Google员工已经开始使用Gemini 3.8 Flash的预览版本,这凸显出AI竞赛正在以惊人的速度推进。为了追赶OpenAI和Anthropic,Google不断推出新模型,有时前后仅相隔几周。

皮查伊称力争每月发布一款新模型

据《商业内幕》获取的图片显示,这款被称为“Gemini 3.8 Flash预览版”的新模型已在Google内部编程平台Jetski上向员工开放。

一名正在测试该新模型的员工表示,新模型感觉已经明显优于Gemini 3.7 Flash,但强调现在就给出全面结论还太早。

由于Gemini 3.5 Pro迟迟未发布,而Anthropic和OpenAI又在AI竞赛中一路领先,Google如今已经没有了顶尖模型。相反,在客户开始更加密切关注AI账单之际,Google加大了对“Flash”系列模型的投入。这类模型速度更快、使用成本更低。

Google将这些模型称为用于编程和运行智能体的“主力模型”。智能体在运行过程中消耗词元的速度往往比聊天机器人更快。那些旨在帮助用户处理日常任务的智能助手,正成为AI公司竞相追逐的下一个热点。Google今年早些时候推出了其Gemini Spark智能体,Meta也在内部测试其“Hatch”智能体。

Google一直在以极快的速度改进其Flash模型。Gemini 3.6 Flash在7月推出,三周后3.7 Flash便紧随其后。在Google第二季度财报电话会议上,CEO桑达尔·皮查伊(Sundar Pichai)表示,公司将力争保持几乎每月发布一次的节奏。

Google员工对预览版的测试表明,Gemini 3.8 Flash的公开推出可能已经不远了,但也并非板上钉钉。一些眼尖的AI爱好者确信,他们已经在Arena AI上发现了Gemini 3.8 Flash的踪迹。Arena AI是一个用于对模型进行基准测试的网站。Google此前曾利用该平台测试即将发布的新模型。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
来自频道: @AI_News_CN
↩️ 🤖 美国法官叫停五角大楼拉黑 Anthropic


科技圈🎗在花频道📮:

🤖 美国国防部将 Anthropic 列入黑名单 国防科技公司停止使用 Claude 特朗普政府决定将人工智能公司 Anthropic 列入黑名单并将其技术指定为供应链风险后,多家国防科技公司要求员工停止使用 Claude 模型,并切换至其他人工智能工具。 CNBC 🍀在花频道 🍵茶馆聊天 📮投稿

🤖 美国法官叫停五角大楼拉黑 Anthropic

美国旧金山地区法官裁定,特朗普政府必须解除对 Anthropic 人工智能技术用于联邦机构的禁令。法官认为国防部将 Claude 开发商列为供应链风险缺乏充分依据,此举意在因其批评政府而“杀鸡儆猴”,并非相信它会破坏自身模型。

Anthropic 表示欢迎这一裁决,称将继续与政府合作。此前其与五角大楼的军事 AI 谈判破裂后,国防部将其列为供应链风险并禁止政府机构使用其技术,Anthropic 随后起诉。

Bloomberg

🌸 在花频道 · 茶馆水群 · 投稿通道

via 科技圈🎗在花频道📮 - Telegram Channel
来自频道: @AI_News_CN
来自频道: @AI_News_CN
来自频道: @AI_News_CN
Google Gemini Notebook新增图书交互功能 已购电子书可成为AI资料来源

Google为其AI笔记应用Gemini Notebook推出“专家智能”(Expert Intelligence)功能,用户现在可以将自己在Google Play图书购买的书籍直接导入应用,并围绕书中内容提问、制定计划、生成信息图、制作AI播客等。

Google实验室编辑总监史蒂文·约翰逊展示了该功能的应用场景:系统可依据迈克尔·波伦所著《饮食规则》中的信息生成一本食谱;另一例中,Gemini Notebook运用金·斯科特管理学著作《彻底坦率》中的观点,回答如何与员工进行棘手谈话的问题。用户还可以直接在Notebook中查看图书全文。

首批将有超过10万本图书支持“专家智能”功能,参与出版方包括企鹅兰登书屋、约翰斯·霍普金斯大学出版社、麦克米伦出版社、O’Reilly Media等。Google还与15位作者合作,其中包括波伦、斯科特、史蒂文·平克和詹妮弗·华莱士等,共同推出“精选Notebook”。这些由作者定制的笔记本将补充额外资料、导言信及其他内容。支持该功能的书籍会在Google Play图书的“工具”标签下标注“Gemini Notebook”。

约翰逊表示,他对构建一个由自己重视的创作者组成的知识集合很感兴趣,让用户如同拥有一支随时可用、可随身携带的理想顾问团队。

Google同时表示,已在Gemini Notebook中设置保护措施,防止其他用户访问他们尚未购买的图书内容。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
来自频道: @AI_News_CN