AI 资讯 · 2026-08-06
-
OpenAI Didn’t Notice Its AI Agents Using a Message Board to Plan Their Hacking Spree
At the Black Hat security conference, the AI giant revealed new details about how its agents went rogue, hacked several other companies—and did it all right under the company’s nose.
评分明细
重要性 5 新颖度 5 信源权威 5 技术深度 5 实体加权 ×1.60 -
GPT-Live 底层拆解:OpenAI 如何让 95% 的音频帧不再延迟
通过重写 Python、魔改 WebRTC 握手,GPT-Live 让Agent从单向对话进入「实时交互」时代。 作者丨郑佳美 编辑丨岑 峰 在实时语音交互中,延迟是唯一的“死线”。文字回答慢几百毫秒,用户顶多觉得体验不佳;但音频只要卡顿一次,那种“非人”的割裂感就会瞬间摧毁信任。为了解决这个工程顽疾,OpenAI 耗时 6 个月重做了整个语音系统。刚刚,OpenAI 发布了一篇 GPT-Live 工程文章,详细披露了新版 ChatGPT 语音系统背后的架构改造。其中最值得注意的一组数据是:新的媒体系统,其 p95 音频帧延迟已经降到了旧系统 p50 的水平。这意味着,新系统中最慢的 95% 的音频帧,现在都能跑得和旧系统中最快的 50% 音频帧一样的顺滑。虽然 OpenAI 没有公布具体毫秒数,但这个结果说明,改造主要压缩了那些偶发但明显的慢帧。现在的 GPT-Liv
评分明细
重要性 6 新颖度 6 信源权威 6 技术深度 6 实体加权 ×1.60 -
Artificial Analysis榜单:阿里Qwen3.8Agentic能力得分全球第一
评分明细
重要性 5 新颖度 5 信源权威 5 技术深度 5 实体加权 ×1.60 -
金刚GC3芯片重新定义视频AI算力规则,国产RISC-V高端算力商业化提速
近日,第三届中国计算机学会芯片大会(CCF Chip 2026)在太湖之滨无锡成功举办。会场中,两院院士与顶尖工程师们的讨论话题直指底层架构的“根技术”创新。一个核心追问被反复推至台前:当摩尔定律逼近物理极限,制程红利日益稀薄,堆核心、拼频率的老路越走越窄,是否该彻底换一条路走?换言之,与其在通用架构上不断打补丁,能否从数据流动的本质出发,为特定场景原生设计一颗芯片?作为全球首款RISC-V数据流架构视频智能AIGC芯片,金刚GC3芯片的出现,不仅是一次产品首发,更是为视频而生的专用算力。视频洪流之下,通用芯片的搬运困局当前,AI消耗的算力,大半都喂给了视频。从Sora引领的文生视频,到城市摄像头每秒数千路的实时解析,再到工业产线上毫秒级的质检判定,视频流不再是锦上添花的内容载体,而是AI基础设施的主航道。然而,传统CPU、GPU骨子里流淌的是控制流的血液。它们依赖程序计数器一步步推进指令,数据在内存和计算单元之间来回搬砖。中科通量总工程师罗鑫算过一笔账:在视频处理中,数据搬运消耗的能量往往是实际计算的数倍,这种搬砖式算力,面对视频流的海量、连续、高并发特性,就像用快递三轮车去运洪峰期
评分明细
重要性 6 新颖度 6 信源权威 6 技术深度 6 实体加权 ×1.30 -
苏神复盘 Kimi K3:896 个专家背后,藏着哪些关键技术取舍?
从异常激活到专家拥堵,拆解超大模型训练难点。 作者丨郑佳美 编辑丨岑 峰 这几天,Kimi 研究员、RoPE 提出者苏剑林发布了一篇名为《简单谈谈 K3 的 MoE 和 Attention》的文章,集中讨论了 Kimi K3 在专家架构、训练稳定性、负载均衡和注意力设计上的几项关键取舍。苏神在文章中提到 K3 拥有 2.8 万亿总参数,并配置了 896 个路由专家。但模型不会让每个 Token 调用全部专家,而是只从中激活 16 个。在注意力结构上,K3 也没有沿用单一方案,而是将 KDA 与 Gated MLA 交替排列。这些配置共同指向了 K3 的基本设计思路:模型可以继续扩大容量,但不能让计算成本随着总参数量和上下文长度同步增长。更多专家意味着模型拥有更细致的能力分工,混合注意力则让模型能够以更低成本处理长上下文。然而,规模扩张也会带来新的问题。 当专家数量增加时
评分明细
重要性 6 新颖度 6 信源权威 6 技术深度 6 实体加权 ×1.30
-
长鑫拒绝苹果压价:坚持要求不低于三星电子和SK海力士;马斯克个人财富亏掉2个「黄仁勋」;宇树上市在即,王兴兴身价即将突破百亿
要闻提示1.马斯克个人财富缩水约合人民币2.45万亿元,相当于亏掉2个“黄仁勋”2.长鑫拒绝苹果压价:坚持要求不低于三星电子和SK海力士3.余承东:手机要大规模涨价,否则都在亏损销售4.宇树科技IPO初步询价开启,王兴兴身价即将突破百亿5.曝DeepSeek低调重启第二轮融资,拟募资500亿元6.苏泊尔低俗AI擦边广告引争议:女生洗澡时大叔闯入提议帮搓背7.1分钟25.8万!AI短剧虚拟演员商单报价超真人网红8.Anthropic任命库埃拉尔为首位全球事务官,负责应对AI政策今日头条马斯克个人财富缩水约合人民币2.45万亿元,相当于亏掉2个“黄仁勋”8 月 5 日消息,据微信公众号“福布斯”消息,6月12日SpaceX上市,马斯克成为全球首位万亿富豪。但他13位数字的身家并未维保持多久——SpaceX的股价此前一路飞升,如今却跌回地表,马斯克在7月单月财富缩水3630亿美元(约合人民币2.45万亿元),创下纪录。这一缩水幅度,甚至超过了全球第2至第10大富豪中任何一人的全部身家,是英伟达CEO黄仁勋身家(1740亿美元)的两倍多。截至美国东部时间8月1日零点,排名第2的拉里·佩奇身家微
-
都叫3D芯片,为什么是三门不同的生意?
芯片一级市场又热起来了。上一轮国产GPU投资陆续进入兑现期后,资本开始寻找下一批可能跑出来的AI芯片公司。近存计算、存算一体、3D近存、3D TokenPU……名字各不相同,却越来越频繁地被归入同一个标签:3D堆叠。有的3D芯片企业半年内连续完成两轮融资,累计规模接近10亿元;还有的芯片尚未量产,估值已经攀升至百亿元。但当投资人真正开始比较这些公司时,却发现相似的技术语言背后,是不同的市场、工程难题和商业验证标准。“技术架构看起来都差不多,谁的产品最好、谁能搞定大客户,我们都不知道。”参投过某上市GPU企业的投资人老张告诉雷峰网。经历过上一轮芯片投资后,他所在的机构更倾向于等企业完成流片、拿出真实订单,再决定是否下注。这轮热潮背后,芯片瓶颈也在变化。Agent将一次性的模型问答拉长为持续执行的任务,存储容量、带宽和数据搬运效率的重要性随之上升。让数据离计算更近,成为这一轮芯片创业的共同故事,而3D堆叠则成为芯粒重组、存储扩容和存算融合共同使用的技术手段。但同样是把芯片“叠起来”,不同企业究竟在解决什么问题?在先进制程、HBM和高端封装受到约束的情况下,国内创业公司为何尤其热衷于将计算与
-
国内首个,千问办公通过中国信通院办公智能体能力评估
8月6日消息,中国信通院公布“互联网智能体治理·办公智能体能力评估”结果,“千问办公”成为国内首个通过评估的办公智能体(Agent)产品,意味着其在办公任务执行、企业数据安全、风险管理等关键能力上均已达标,具备可信赖、可落地的企业级办公服务能力。 目前,Agent产品正加速走进各类办公场景。与个人办公场景不同,企业办公场景涉及大量业务资料与经营信息。Agent在自主执行任务过程中,面临提示词滥用、信息泄露、结果可信度不足等潜在风险。为此,中国信通院启动首批互联网智能体治理·办公智能体能力评估工作,旨在建立统一标准,推动行业兼顾效能与安全。 首批办公Agent能力评估,主要围绕智能交互与多模态能力、全场景办公任务执行能力、安全防护以及 Skills 管理能力等四大维度展开,千问办公在多模态处理、数据处理与分析、协同办公适配能力、数据安全与私密性、服务环境安全、skill执行可信测试等16项测试中均达到评估标准,证明其满足企业级场景对Agent功能丰富度和安全可控的需求。 信息安全方面,千问办公基于端云协同架构,建立覆盖基础设施、应用、模型、Agent 运行时、数据及扩展生态的纵深防御体系
-
把512 GiB闪存搬到xPU旁边,HBF能打破推理内存墙?
HBM已经证明,通过堆叠和共封装把存储介质迁移至GPU附近,可以缓解AI计算中的数据搬运瓶颈。现在,SK海力士联合闪迪,将类似的思路正式应用到NAND上,通过HBF将大容量闪存放到包括GPU在内的各类xPU旁,以缓解AI推理内存墙问题。近日,双方通过OCP发布《High Bandwidth Flash(HBF)High-Level Base Die Specification, Version 0.7.0》。谷歌和Tenstorrent在致谢中被列为规范的反馈与建议提供方。这份约130页的规范,首次明确了HBF的位置、边界与代价:介于HBM与SSD之间,HBF是紧邻xPU、由Base Die和主机软件共同管理的大容量闪存。应用范围从静态模型权重进一步延伸至KV Cache、多模型、MoE和Agent工作负载。NAND的写入、耐久性和管理上的物理约束并未被消除。这些约束带来的复杂性,最终转移到了Base Die和加速器的软件栈上。在不改变规范原意的基础上,雷峰网对此进行编译和整理,重点解读HBF的系统定位、高带宽缘起、推理应用场景以及NAND介质带来的工程约束。01不是取代或者给HBM扩
-
频发高温故障!特斯拉FSD升级事故,看清中美智驾监管根本差异
近期,据海外媒体Electrek报道,海外部分特斯拉HW3老车主遭遇一场OTA升级引发的安全隐患。据报道,特斯拉向400余万辆搭载老款HW3自动驾驶硬件的车型推送FSDV14Lite版本更新后,车辆自动驾驶ECU主板满载运行,温度飙升至96℃,频繁弹出过热故障警报,FSD功能强制下线,车主只能靠边停车降温才能恢复辅助驾驶;更有车辆因长期高温直接烧毁自动驾驶计算机,超出质保周期的车主需自费整套更换该硬件。老车主的烦心事不止于此,OTA升级后的版本还暴露出系统性感知缺陷,倒车时无法识别后方行人、障碍物,多次出现碰撞险情,给道路安全埋下巨大隐患。本次事故发酵同期,我国先后于今年6月、7月发布两项分别聚焦组合驾驶辅助、高阶自动驾驶的强制性国家标准:《智能网联汽车组合驾驶辅助系统安全要求》(GB47955—2026)、《智能网联汽车自动驾驶系统安全要求》(GB44721—2026),将在2027年正式落地实施,文件针对智能网联汽车OTA升级设置了全流程硬性规范。行业普遍认为,全球智能驾驶领域核心产业主体集中于中美两国,两国车企技术研发实力相对领先。此次特斯拉OTA升级暴露出的安全问题,直观折射出
-
OpenAI is giving ChatGPT free users unlimited text chats
OpenAI is making a big change for ChatGPT users on its free and Go tiers: Starting next week, users on those tiers will be able to have unlimited text chats with the chatbot, according to OpenAI. Right now, you may run into rate limits if you do too many text chats on those tiers, but […]
-
From asking to doing: How the world is putting ChatGPT to work
New OpenAI Signals data shows how people use ChatGPT worldwide, with country-level insights on adoption, usage trends, and evolving behavior.
-
OpenAI says Apple’s trade secrets lawsuit is ‘rotten to its core’
OpenAI has asked a federal judge to toss out Apple's landmark lawsuit accusing the ChatGPT maker of stealing trade secrets, describing the allegations as "meritless." In a motion filed yesterday to dismiss the complaint, OpenAI says that Apple is mischaracterizing both the actions of the AI startup's employees as theft, and "generic" product development information […]
-
Improving GPT‑5.6 Sol in ChatGPT—and expanding access to GPT-5.6 Luna for free users
ChatGPT introduces improved GPT-5.6 Sol with better accuracy and consistency, plus expanded access for free users and unlimited everyday chats with GPT-5.6 Luna.
-
ChatGPT brings unlimited text chats to free users
OpenAI said that ChatGPT free and Go users are also getting a new think button for complex queries.
-
Anthropic will design its own hardware to power Claude
Anthropic and OpenAI are racing to scale up while reducing dependence on Nvidia.
-
AI Safety Regulations in the U.S. Could Give Hackers an Edge
On 11 July, Hugging Face was subjected to an intense cyberattack from a then-unknown actor. The speed and coordination of the attack on the company that hosts and supports popular AI developer resources led Hugging Face’s security team to conclude it was the work of an AI agent. Realizing this, the team tried to use “frontier models behind commercial APIs”—presumably from Anthropic and OpenAI, although only Anthropic was named in the second of the company’s two posts about the security incident—
-
Cloudflare open-sources vibe-coding platform for people who aren't coders
Cloudflare built an AI agent workspace for its employees. Now it’s open source.
-
Why Normal People Aren’t Using AI Agents
The tech industry is realizing it needs to build agents based on what regular consumers want, not just what its AI models can do.