AI 资讯 · 2026-08-17
-
关于 Hugging Face 入侵事件,OpenAI 终于放出了时间线
一批原本彼此独立运行的 AI 智能体,在 OpenAI 内部创建了一块留言板。 作者丨樊天骄 编辑丨郑佳美 今年 7 月,Hugging Face 披露了一起罕见的网络安全事件:由 OpenAI 模型驱动的自主智能体,在执行内部网络安全能力评估时突破沙箱限制,利用第三方服务作为攻击跳板,最终进入 Hugging Face 的生产基础设施。针对这起事件,当地时间 8 月 5 日,在 Black Hat USA 2026 安全大会上,OpenAI 终于首次首次公开还原该事件的完整时间线和技术过程。负责复盘事件的是两名直接参与本次安全事件调查的 OpenAI 员工:Eric Wallace 和 Michael Dalton。两人都从事 AI 安全相关工作。其中,Eric Wallace 是 OpenAI 对齐与安全研究员,主要研究大模型安全、对齐与鲁棒性,目前共同负责 Align
评分明细
重要性 6 新颖度 6 信源权威 6 技术深度 6 实体加权 ×1.60 -
原生全模态路线进阶,智象未来发布交互式世界模型HiDream-O1-World
HiDream-O1-World,一款原生全模态交互式世界模型。HiDream-O1-World 具备漫游、编辑、交互三大功能,支持文本、图像、交互等多模态方式输入。用户可一键生成时空一致、符合物理规律、可长时推演的完整世界。HiDream-O1-World 搭载的是智象自研的原生全模态(UiT)架构。作为核心基座,UiT此次迎来升级,在交互式世界模型领域公认的核心技术挑战——时空一致性与物理一致性上,取得了关键性突破。在新发布的世界模型中,这种突破表现为:当镜头推拉摇移时,场景空间的几何结构保持高度稳定,物体不会消失或变形;物体间的碰撞、遮挡、重力响应高度符合真实世界的因果逻辑,而非随机“猜”出来的画面拼接。智象未来CTO姚霆表示:“交互式世界模型的价值,不在于生成一个逼真的三维场景,而在于AI开始真正理解空间的深度、物体的质感、运动的惯性与光影的逻辑。这是对物理世界运行规律的系统性认知与重塑。HiDreamO1World,正是这场系统性重塑的第一道桥梁——让每一次交互,都通往一个从未抵达的世界。它的突破性效果,既坚定了我们推动原生全模态架构技术路线纵深发展的信心,也为智象持续构建世
评分明细
重要性 5 新颖度 5 信源权威 5 技术深度 5 实体加权 ×1.76 -
YC 开源自家 Harness,3 天斩获 3.9k Star,QM 如何划清 Agent 的权限边界
从拼模型能力,到搭管控骨架。 作者丨樊天骄 编辑丨郑佳美 过去两年,AI Agent 的竞争逻辑一直围绕一个核心问题展开:如何让一个 Agent 助手变得更加聪明及能干。从 Claude Code、Codex,到 OpenClaw、Manus,现在的 Agent 可以写代码、分析数据、调用工具,甚至独立完成过去需要数小时、数天才能完成的复杂任务。现在的 Agent 开始进入企业场景。这个时候 需要解决的就不仅仅是 “如何让一个程序员更高效”,还有 “如何让100个 AI 员工安全协作” 的问题。近日,由顶级孵化器 Y Combinator(YC)开源的 QM 项目迅速引爆技术社区 ——YC 正是 OpenAI CEO 山姆・奥特曼早年执掌、奠定其全球创投地位的平台。这个项目上线 3 天狂揽 3.9k GitHub Star,官宣当日直接登顶 Hacker News 榜首。区
评分明细
重要性 6 新颖度 6 信源权威 6 技术深度 6 实体加权 ×1.43 -
裁员1600人!诺基亚计划关闭中国研发中心;DeepSeek API 峰谷定价方案今日生效,高峰时段价格翻倍;Claude出现大规模服务故障
要闻提示1.诺基亚计划关闭中国杭州研发中心,裁员 1600 人2.DeepSeek API 峰谷定价方案今日生效,高峰时段价格翻倍3.苹果阿里合作再深入:不止千问接入,还参与模型训练4.华为天才少年宁博宇离职:焦虑对不起公司,回村卖玉米,将赴瑞典深造5.字节付费小说平台红烛故事正式关停6.宇树科技未上市先疯抢,部分中介出价520元/股!业内人士回应7.Claude出现大规模服务故障,旗下多项服务无法登录/无法加载7.曾担任网络安全公司 Wiz 总裁兼首席运营官,OpenAI 挖角 Dali Rajic 担任首席营收官今日头条诺基亚计划关闭中国杭州研发中心,裁员 1600 人8 月 16 日消息,据外媒日前报道,诺基亚撤出中国市场的步伐正在加快。5G 时代,这家公司一直未能在中国拿下大型合同,两年前这家芬兰公司曾计划在中国裁员 2000 人。据知情人士透露,诺基亚计划关闭杭州的一处研发中心,并计划裁员 1600 人。报道称,诺基亚管理层已就杭州办公地点关闭一事,向员工发送电子邮件。目前还有传闻称,诺基亚位于北京、成都、青岛和上海的办公地点也有可能在本次重组计划中被关闭。诺基亚发言人对此回
评分明细
重要性 5 新颖度 5 信源权威 5 技术深度 5 实体加权 ×1.60 -
深度拆解 DeepSeek Harness 架构:AGI 的自进化,终于有了「后悔药」
DeepSeek:一切皆插件,包括 Harness 作者丨樊天骄 编辑丨岑 峰 8 月 13 日,DeepSeek 正式开放 DeepSeek Harness v0.1 Developer Preview。项目非常火热,截至 8 月 14 日下午,DeepSeek Harness 在Github 上已经获得了 4.5 万星。不过这次比较值得讨论的倒不是 DeepSeek 又做了一个 Coding Agent,而是它对 Harness 提出了一个明确概念:一切皆插件。过去的 Harness 像一个固定浇筑的大楼,遵循一个相对固定的结构:核心 Harness + 外挂插件。用户可以在外围增加 Skill 或者接入 MCP 等其他工具,但工具调用、会话管理、沙箱、存储以及 Agent Loop 等底层运行机制,通常已经由厂商提前搭好并封装在产品内部,普通用户无法直接修改。这次
评分明细
重要性 5 新颖度 5 信源权威 5 技术深度 5 实体加权 ×1.60
-
为了「自我锤炼」,OpenAI 造了一个攻击力极强的「AI 黑客」
红队模型高危安全任务完成率达到 95%。 作者丨樊天骄 编辑丨郑佳美 昨天,OpenAI 宣布扩展网络安全计划 Daybreak,并推出了一款专门面向网络安全场景的模型 GPT‑5.6‑Cyber。雷峰网值得注意的是,GPT‑5.6‑Cyber 将 AI 网络安全能力划分为两个方向:面向防御工作的 Daybreak Blue(蓝队),以及面向高级安全研究和攻击模拟的 Daybreak Red(红队)。这种 “红蓝攻防体系” 是传统网络安全领域中用于验证系统安全性的核心演练机制。通俗来讲,就是红队模型模拟黑客视角,主动寻找漏洞,帮助安全团队提前发现系统中的薄弱环节;蓝队模型则模拟防御视角,根据红方发现的漏洞进行修复,提升系统抵御攻击的能力。之所以采用这种方式,是 OpenAI 认为,未来网络攻击和防御都将被 AI 重新塑造。攻击者将利用 AI 自动发现漏洞并构建攻击路径时,因
-
拆解 Mistral AI 新项目Shieldstral,看 3B 小模型如何重构 AI 安全审核范式
一款 3B 级分类器,可通过统一接口审核文本、图片以及图文混合内容。 作者丨樊天骄 编辑丨郑佳美 2026 年 8 月 4 日,法国大模型厂商 Mistral AI 正式发布 Shieldstral,一款 3B 级规则自适应多模态安全分类器,可通过统一接口审核文本、图片以及图文混合内容。与依赖固定风险标签的传统安全模型不同,Shieldstral 支持在推理阶段通过自然语言输入自定义审核规则,从而根据不同业务场景调整审核标准。它围绕三层设计重构了安全审核流程:将不同审核任务统一为 Yes/No 判断题,通过对比式训练让模型学习具体的规则匹配关系,再将文本理解、视觉理解和规则适应能力整合到同一个轻量级模型中。在多个文本和多模态安全基准上,Shieldstral 甚至取得了接近甚至超过部分参数量更大模型的结果,同时保持较低的部署门槛。因此,本文将从任务建模、训练数据构造、视觉能
-
中国电信领投,觅蜂科技再获数亿元融资,聚焦物理AI数据服务平台
雷峰网获悉,近日,一站式物理AI数据服务平台觅蜂科技完成新一轮数亿元融资。本轮由中国电信领投,张江集团跟投,红杉中国、元启创新等老股东超额追加。资金将用于扩大MEgo系列无本体采集产品量产、提升数据采集—治理—评测全栈能力,并加速千万小时级物理交互数据产能落地。成立约半年,觅蜂科技已连续完成多轮融资,投资方涵盖国资平台、头部基金及产业方。进入真实场景采集,定位“懂模型与场景”的数据平台觅蜂科技认为,物理AI要实现高阶推理和物理规律掌握,需依赖大规模、高质量真实交互数据。相比大语言模型,物理AI数据有效信息密度更低、噪声更高,需求更大。MEgo系列已进入真实场景采集公司从采集、治理、评测三端切入:采集端:自研MEgo系列无本体采集产品已量产,并在工厂、物流、超市、家庭、酒店、餐饮、安防、养老、文旅等真实场景部署。产品轻量化,可同步采集环境感知与手部操作数据,轨迹精度达毫米级,实现低成本、规模化采集。同时构建分层数据供给金字塔,覆盖真机遥操等多种类型。治理端:MEgo Engine平台打通预处理、空间重建、多模态标注、质量评测自动化闭环,效率提升10倍以上。自研VIO位姿算法支持人机技能迁
-
Anthropic explains how Claude’s invisible text watermarks will work
Anthropic has clarified how it's planning to apply invisible watermarks to Claude-generated text in order to comply with Europe's AI transparency rules. On Friday, Anthropic announced that Claude's text marking system is "a version of the SynthID-Text approach" - an open-source watermarking technology developed by Google DeepMind that creates detectable patterns using wording probabilities. This […]
-
From AI Copilots to Agent Swarms
The impact of AI on software development has been both profound and ever-evolving. Last year, I wrote about AMD’s plans to use AI not just for generating new lines of code, but also for other steps in the software development lifecycle (SDLC), such as triaging problems, debugging code, and testing the software. At the time, we were hoping for a 25 percent productivity boost from AI use over the course of two or three years.But with each new release, the capabilities of large language models (LLM
-
Amazon, which started off selling books, is destroying rare texts to train AI
Rare books are incredibly valuable for training LLMs, since these models have already trained on whatever's available online.