AI 资讯 · 2026-08-18
-
NPU不够,诚恒微为什么还给端侧AI芯片加了GPGPU?
如果只看今天端侧AI芯片的热门叙事,NPU几乎是绕不开的主角。大模型从云端向手机、PC、机器人等终端下沉,芯片厂商不断刷新TOPS,围绕Transformer、增加专用加速能力。一颗新的端侧AI芯片,似乎应该尽可能把有限的晶体管留给NPU。诚恒微却在首款旗舰SoC上做了一个不同的选择。近期在无锡举行的CH37系列边端侧AI SoC产品发布会上,诚恒微正式发布CH3715。除了48 TOPS INT8的六核NPU,CH375还集成了10核CPU(含4大4小主核及2个R8实时控制核,R8核频率达800MHz)、自研渲染GPU(358 GFLOPS)、六核NPU(48 TOPS INT8/24 TOPS FP16)、四核GPGPU(1 TFLOPS FP32,兼容CUDA生态)、双核DSP及自研FFT硬件加速器。为什么一颗端侧AI芯片,需要同时拥有NPU和GPGPU?诚恒微CEO楚立斌诚恒微CEO楚立斌对雷峰网表示,“CH3715的产品定义其实始于2022年。彼时ChatGPT尚未发布,具身智能也没有成为芯片行业追逐的热点,我们首先看到的是机器视觉、雷达、工业设备里一些长期没有被单颗芯片很好
评分明细
重要性 7 新颖度 7 信源权威 7 技术深度 7 实体加权 ×1.30 -
DeepSeek 为什么把缓存涨了 11 倍?长上下文需求暴涨,得交点「存储税」了
缓存涨价背后,是大模型的存储与数据搬运困境。 作者丨高允毅 编辑丨岑 峰 一直以来,DeepSeek都是白菜价的代名词,这次它开始涨价了,而且还按时间段收钱。8 月 17 日,DeepSeek V4 Pro API 的输入和输出价格涨幅如下图。其中,最便宜的缓存命中价格在空闲时断直接涨了5倍,在高峰时期,它竟然涨了11倍,从0.025 元 / 百万Token 涨至 0.3 元/ 百万 Token。很多人或许并不了解“缓存命中”是什么。简单理解,它就像大模型的“草稿纸”,AI 每次回答问题时,不必每次都去重新翻阅所有信息。只要它之前计算过一次,这段长文本就会以“KV单元”的形式沉淀在存储集群里,后续调用直接提取即可。一直以来,极高的缓存命中率是DeepSeeek最出圈的“性价比杀器”,它依靠极致的KV压缩技术和冷热记忆分层搬运架构,直接省掉了这部分海量的重复计算,把长文本
评分明细
重要性 5 新颖度 5 信源权威 5 技术深度 5 实体加权 ×1.60 -
以GLM-5为例,探究九章智算云强化学习系统如何落地“训推一致”
过去几年,大模型竞争的主线很清晰:更大的模型、更多的数据和更强的GPU集群。但随着预训练边际收益递减,模型能力Scaling正从单纯的预训练堆叠向后训练强化学习(RL)转变,数学推理、代码生成、复杂决策、长时序Agent等高阶能力,越来越依赖后训练强化学习(RL)激发。RL通过生成、执行、反馈和奖励,让模型持续学习推理、规划与自我纠错的能力。由此,大模型发展从“一次性训练”进入“持续训练”,模型能力Scaling也从预训练延伸至生成、反馈和迭代全过程。SemiAnalysis指出,当RL成为模型能力持续Scaling的关键,竞争的就不只是算法,还有支撑模型持续生成、训练和更新的AI基础设施系统。问题也随之变成:当模型越依赖RL获得能力,谁来支撑这种能力持续低成本地生产。从“模型+算力”到算法与AI基础设施共同Scaling智谱近期的模型迭代,为观察后训练RL提供了一个窗口。智谱公告指出,GLM-5.3与GLM-5.2在相同基座上推进强化学习,通过后训练Scaling持续提升模型智能上界。以GLM-5.2为例,其在SWE-bench Pro取得62.1分、Terminal-Bench 3
评分明细
重要性 6 新颖度 6 信源权威 6 技术深度 6 实体加权 ×1.30 -
阿里云扩建全球基础设施,韩国第三座数据中心上线
8月18日消息,阿里云在韩国的第三座数据中心正式上线,并同步推出Agentic AI相关服务,进一步满足当地市场持续增长的AI及云计算需求。近期,阿里云已先后在法国、日本、马来西亚、墨西哥等市场持续完善AI与云基础设施布局。本轮扩建完成后,阿里云全球基础设施将覆盖30个地域、104个可用区,并计划进一步拓展至巴西等国家和地区。目前,阿里云在亚太云计算市场排名第一。 阿里云在韩国持续加大基础设施投入,背后是当地企业数字化转型和重点行业云需求的持续攀升。近年来,伴随游戏、电商、内容、制造等产业加速上云,阿里云也在不断完善本地云服务能力,支持企业承载关键业务和创新应用。 AI成了韩国云市场的新增长动力。随着AI应用加速落地,企业对稳定、弹性、安全的云基础设施需求持续提升。此次上线的新数据中心将提供计算、存储、网络、安全、数据库、容器及云原生等企业级服务,并布局AgentRun、STAROps等6项Agentic AI服务,覆盖智能体开发、部署、运营及安全管理等各类客户需求。 与此同时,阿里云持续通过开源模型扩大AI开发者生态。目前,Qwen模型家族全球累计下载量已超过20亿次,开发者基于Q
评分明细
重要性 5 新颖度 5 信源权威 5 技术深度 5 实体加权 ×1.43 -
OPPO唐凯:模型能力已经超过产业链的组织能力
近日,OPPO 软件工程事业部总裁唐凯出席支付宝AI生态合作伙伴大会。会上,唐凯表示,当前Agent发展的一个结构性矛盾是,模型能力已经超过产业链的组织能力。“今天基于模型做一个体验不错的To C Agent产品已经不困难,但要形成真正的商业闭环并不容易。”唐凯表示,Agent要更懂用户、要完成更多真实任务、需要调用丰富的服务和工具,才能为用户提供更优的体验。但目前行业仍存在大量服务和生态孤岛。”OPPO 软件工程事业部总裁唐凯 Agent产业协同:全球AI集体补课2024年底,Anthropic推出MCP,试图用开放协议解决AI应用与外部数据、工具的连接问题;2025年,Google推出A2A协议,为不同厂商、不同框架开发的Agent能够相互通信与协作提供解决方案。到2026年4月,A2A已经获得超过150家机构支持,并进入多家主流云平台。从"Agent 连接工具"(MCP),到"Agent 连接 Agent"(A2A),行业基础设施的演进指向同一个问题:当模型越来越聪明,如何把分散的需求、服务和产业能力真正组织起来,构建安全、可信、高效的智能体服务体系,正变得越来越重要。与此同时,
评分明细
重要性 5 新颖度 5 信源权威 5 技术深度 5 实体加权 ×1.30
-
比起让大模型写 100 万字的小说,AI 大牛们更想用 AI 拿诺贝尔奖
OpenAI前CPO创业获7.5亿美元融资——硅谷最聪明的一批大脑,正集体撤离“文字游戏”。 作者丨周蕾 编辑丨岑峰 产品没有公开,公司连名字都还没起,只有3位知情人士对外放风,但估值已经喊到了7.5亿美元,计划募资1.5亿美元——这就是前OpenAI首席产品官Kevin Weil的新公司,定位是“为AI模型收集科学数据”的平台。这位曾经在Meta和Twitter都做过产品高管的硅谷老兵,今年早些时候离开OpenAI,如今正在为手头上的创业项目奔走。算上前不久官宣创办Discovery Loop的Jeff Dean,AI4S(AI for Science)赛道似乎已经是硅谷离职AI高管的热门去向。换一个角度说,这群AI大牛的所想所做,释放了一个最新信号:AI4S赛道正在从概念叙事进入基础设施建设阶段。当大模型已经能写100万字小说、生成电影级视频,硅谷最聪明的一批人却在想另
-
OpenAI Overhauls Safety Protocols After Its AI Agents Went Rogue
The ChatGPT maker says its upcoming Astra model may have reached “critical” cyber capabilities, prompting it to halt a significant number of training runs while it tightens internal safeguards.
-
大厂押注AI办公,文库网盘正在从“通用”走向“专业
从十年前起,互联网大厂就一直想帮打工人提升效率。在线文档、企业微信、打卡审批——工具不断变换,看似办公室里的工作方式跟着变了,但好像真正被释放的时间并没有减少。直到十年后,大模型和agent 让事情有了好转,AI能够自己搜集资料、调用工具、拆解任务,办公软件开始真正替人干活。看看周围电梯的广告,一边是WorkBuddy,一边是豆包和千问,就连机场候机室,也被AI办公场景打透,所有大厂都在集中做一件事:收拢兵力,押注AI办公。艾媒咨询数据显示,2025年中国AI智能体市场规模804亿元,同比增长123.2%,预计2030年到6968亿元,办公生产力场景被标注为核心增长极,59.1%的使用者明确愿意为AI办公智能体付费。当所有玩家都挤进同一赛道,办公软件究竟是多个AI功能,还是重构工作方式?百度这个入局最早的玩家,它的选择或许能给出一些答案。01 中文名"库库AI":当AI成为独立入口办公是大模型时代第一个跑通"使用—付费"闭环的场景,聊天助手流量巨大但没人因此付高价,而PPT、表格、报告却是每天要做的事。一旦agent可能成为白领上班打开的"第一站",文档、表格、IM都会从入口变成被AI
-
IJCAI-ECAI 2026 开幕:吴佳俊斩获「计算机与思想奖」,SMOTE 算法获首届时间检验奖
经典大奖致敬AI先驱,14位青年学者站上全新焦点舞台,713篇主会论文把脉未来演进图景。 作者丨岑峰 马晓宁 当地时间 2026 年 8 月18日,第 35 届国际人工智能联合会议(IJCAI-ECAI 2026)在德国不莱梅拉开帷幕。作为历史最悠久、最具权威性的人工智能顶级学术会议之一,IJCAI 见证了 AI 半个多世纪的起伏与繁荣。今年,大会重回欧洲,不仅汇聚了全球顶尖的 AI 学者、产业领袖,更在 AGI 狂飙突进的当下,为全行业提供了一个反思基础理论、探讨技术落地的绝佳平台。AI科技评论小分队已抵达现场,为您发回开幕式及颁奖典礼的最新报道。01缅怀先驱与东道主致辞:AI 发展的传承与未来开幕式伊始,大会主席 Francesca Toni 登台致辞,正式宣布 IJCAI-ECAI 2026 开幕。本届大会受到了德国当地政府与科研机构的高规格重视。德国联邦研究、技术与空间部
-
OpenAI institutes new safeguards after Hugging Face breach
The new safeguards include more detailed monitoring of models during the development process, as well as greater emphasis on alignment and security during the post-training process.
-
OpenAI launches a safer ChatGPT for teens — years after teens started using it
ChatGPT for Teens adds age-appropriate safety measures, parental controls, and learning tools designed to steer teens away from harmful content — and from using AI to cheat on their homework.
-
How NVIDIA scales expertise with ChatGPT Work
NVIDIA teams use ChatGPT Work to reduce manual tasks, connect fast-moving signals, and scale successful workflows globally.
-
ChatGPT is getting a dedicated mode for teens
OpenAI is introducing a dedicated ChatGPT mode for teenagers, combining existing youth safeguards and new safety features under one roof. The launch comes amid mounting public scrutiny over how AI tools affect younger users, as other platforms implement their own age checks and teen-specific protections. ChatGPT for Teens is "an experience designed to help teens […]
-
Introducing ChatGPT for Teens: Built for learning, backed by protections
ChatGPT for Teens helps teens learn, think critically, and use AI with confidence, with stronger built-in protections, healthy-use features, and additional controls for parents.
-
OpenAI president urges enterprises to hasten AI security defences
OpenAI president and co-founder Greg Brockman warns that enterprise security teams face a compressed timeline to adopt AI defences. Brockman has published an account of what the company calls the “OpenAI-Hugging Face” incident, using it to argue that organisations need to uplevel their security practices with what he terms unprecedented speed. He writes that he […] The post OpenAI president urges enterprises to hasten AI security defences appeared first on AI News.
-
OpenAI lays out new security changes after its AI hacked Hugging Face
OpenAI is announcing security updates following the July news that its AI broke out of a sandboxed environment and accidentally hacked Hugging Face, including improvements to its research environments, monitoring, and alignment techniques. The company had already put the brakes on a new model, Astra, that it thinks could have "critical" cybersecurity capabilities, and the […]
-
ChatGPT Ads expands across Europe
ChatGPT Ads is expanding to 31 European markets. Learn how advertisers can reach people as they explore, compare options, and make decisions.
-
We still don’t know how people are really using AI
AI companies like Anthropic and OpenAI regularly publish reports on how people are using products like Claude and ChatGPT, but they only release the data they want us to see, AI researchers say. “There is no independent source to corroborate it,” says Anka Reuel, a computer science PhD candidate at the Stanford Trustworthy AI Research…
-
Google’s Pet Memory forgot who my cats are
One of the best things my smart home does is help me care for my pets, and security cameras are particularly useful for keeping track of my many critters. But the barrage of notifications they send often means I miss important ones. So, when Google announced its new Pet Memory feature for Gemini for Home, […]
-
Reading Zhipu’s GLM-5.3 results past the headline number
Zhipu’s release note for GLM-5.3 contains a sentence that did not make it into most of the coverage. Describing its own cybersecurity results, the Beijing company writes that capability “is growing fastest exactly where we are furthest behind.” Zhipu, which also trades as Z.ai, is one of a handful of Chinese labs releasing models that compete with […] The post Reading Zhipu’s GLM-5.3 results past the headline number appeared first on AI News.
-
Microsoft Copilot reveals secret input that allowed it to be hacked
Secret parameter allowed hackers to steal passwords when a target clicked on a link.
-
Strengthening democratic oversight in national security
OpenAI launches an initiative to strengthen democratic oversight of AI in national security, supporting government institutions with tools, training, and expertise.
-
AI’s recursive self-improvement might not come so quickly after all
The AI industry’s boldest promise right now is that AI will soon improve itself, with almost no need for human oversight. LLMs can already write code, generate synthetic data for training, and optimize the computer chips they run on. Forecasts of explosive AI progress predict that what researchers call recursive self-improvement is on the horizon. …
-
Alvys launches AI agents for freight TMS workflows
Freight software provider Alvys has launched an agentic AI platform that allows carriers and brokers to automate operational tasks directly within its transportation management system (TMS). Called Alvys Foundry, the platform supports pre-built and custom AI agents that work with freight data and workflows already held within the TMS. Foundry includes more than 20 pre-built […] The post Alvys launches AI agents for freight TMS workflows appeared first on AI News.
-
网易传媒发布"蜜蜂AI":从工具到伙伴,让AI更懂人
8月18日,网易传媒举办“蜜蜂AI媒体沟通会”,首次向外界系统介绍面向人工智能时代打造的统一AI能力底座——“蜜蜂AI”。目前,蜜蜂AI已率先在年轻化内容社区产品网易小蜜蜂中落地,通过AI搜索和AI助手、个人专属万能龙虾、互动小游戏等功能,进入用户的信息获取、日常互动与内容创作过程。一、网易传媒的选择:让AI先进入产品“我们做AI,不是为了做一个孤立的技术概念,而是要让AI真正进入产品场景和用户场景,成为用户可以感知、体验和消费的一部分。”网易传媒副总裁李淼说。网易传媒没有把重心放在另做一个通用大模型,而是希望把多年积累的AI能力推向C端,让它直接为用户创造价值。游戏是他举出的一个成熟样本。AI已经进入美术、策划、编程、动画和测试等研发环节,动态剧情、智能角色、自然语言交互和共创设计,也让玩家从消费内容走向参与和生产内容。李淼更看重后一种变化:AI不只是提效工具,还在改变着内容与人的关系。沿着这条思路,网易传媒将相关积累归纳为信息理解与任务辅助、个性化互动与持续服务、生成式创作与互动表达三个方向。蜜蜂AI由此成为承载这些方向的统一能力底座,网易小蜜蜂则成为率先落地和验证的平台。作为一款