AI 资讯 · 2026-07-31
-
Anthropic Says Claude Hacked Into 3 Organizations During Cybersecurity Tests
In a review triggered by OpenAI’s Hugging Face incident, Anthropic discovered three of its AI models had breached real-world organizations during third-party evaluations.
评分明细
重要性 6 新颖度 6 信源权威 6 技术深度 6 实体加权 ×1.60 -
1/8 参数,跑赢 80B 大模型:Boogu-Image 是黑马还是鸡肋?
(雷峰网)摘要:“跑分反超只是开胃菜,生产级交付才是真考场。”2026 年 6 月,HuggingFace 上一个名为 Boogu-Image-0.1 的开源模型,在上传以后迅速引爆了 AI 圈。这款模型最引人注目的地方,在于它以区区 10B 的参数规模,就在多项关键能力上超过了很多参数量更大的模型。更大就意味着更强,长期以来这在 AI 圈都是颠扑不破的真理,语言模型如此,图像模型亦然。但在 Qwen-Image-Bench 基准测试中,10B 的 Boogu-Image-0.1 以 53.58 的最终得分,领先于 20B 的 Qwen-Image-2512(52.06)和 80B 的 Hunyuan-Image-3.0(50.81)。以对手 1/8 甚至 1/2 的参数规模,却实现了性能反超,即使领先优势只有几分之差,也足以解释业内的重视。当然,评价一款模型,Benchmark 跑分只是一方面。相比 Benchmark 跑分,我们更关心的是这款以小博大的黑马模型在真实的内容生产流程里,到底能走到哪一步? 它的优势是否只在跑分中成立?它能否快速生成照片级素材、搭建海报构图、完成局部编辑
评分明细
重要性 7 新颖度 7 信源权威 7 技术深度 7 实体加权 ×1.30 -
长音频不丢词,行业词不用教,阿里发布Qwen-Audio-3.0-ASR-Flash
7月31日,阿里巴巴发布语音识别大模型Qwen-Audio-3.0-ASR-Flash,在上下文一致性、行业词识别和热词定制化三个维度系统性升级,同时具备语音润色能力,可直接输出结构化文本。目前,Qwen-Audio-ASR系列已在会议纪要整理、实时字幕、教育录播、智能客服等场景中获得广泛验证,离线版本曾在全球权威AI评测平台Artificial Analysis以1.7%的错字率位列全球第一。识准专业词汇,是ASR模型走向行业落地的最后一公里,也是本次升级的核心。全新升级的3.0版本,聚焦通用的语音识别能力,不止于把每个字听对,更要在复杂语境中持续听对、在专业领域中精准听对。在会议、访谈、课程、直播等长音频场景中,很多专业术语、英文词汇等并不能只靠当前几秒的语音准确判断。同一个发音可能对应十几个同音词,模型必须记住前面说过什么,才能输出正确的那一个。Qwen-Audio-3.0-ASR-Flash新增长音频Context能力:模型在转写当前语音片段时,可参考近期已识别的上下文,延续同一话题中的关键词与语义线索,从而减少同音词误判,提升术语和中英文混合表达的识别准确率。在一场长达数小时
评分明细
重要性 5 新颖度 5 信源权威 5 技术深度 5 实体加权 ×1.76 -
刚刚,DeepSeek V4 系列更新,架构没变,Agent 能力为何大涨
后训练正成为大模型能力提升的新变量。 作者丨郑佳美 编辑丨马晓宁 刚刚,DeepSeek 更新了 DeepSeek-V4-Flash。官方把它称为“正式版”,不过目前只是在 API 端上线公测。此次更新也只涉及 deepseek-v4-flash,V4-Pro API,以及 App 和网页端当前使用的模型,都没有随之更新。但比起“正式版”这个名字,这次更新更值得关注的是另一句话:DeepSeek-V4-Flash-0731 与此前的 Preview 版本采用相同的模型结构和参数规模,只重新进行了后训练。01没有换架构,为什么能力还能提升?大模型的训练其实可以被简单分成两个阶段。第一个阶段是预训练。模型通过大量文本和代码学习知识,形成基础能力。这个阶段决定了模型大致有多聪明、知道多少东西。第二个阶段是后训练。它更像是针对具体工作进行专项训练,让模型学会怎样回答问题、怎样调用工
评分明细
重要性 5 新颖度 5 信源权威 5 技术深度 5 实体加权 ×1.60 -
中层消失,Token狂热退潮,硅谷工程师眼里的「AI创业下半场」
所有人都在尝试建立关于AI的判断,但所有共识都在迅速过期。 访谈 | 巴芮 海风 文 | 海风 刘思洁 编辑 | 刘思洁 封面图源 | 受访者拍摄“野蛮生长的阶段已经过去了。” 这是身处硅谷AI创业一线的马培元最近最深的感受。 2021年12月,本科毕业后,他进入号称“美版知乎”的Quora,后来转到AI聊天机器人聚合平台Poe,担任资深AI工程师。2个月前,他又加入硅谷最热门的AI Agent创业公司之一Cognition。 2026年5月,这家成立不到三年的公司宣布完成超过10亿美元融资,估值升至260亿美元。8个月前,它的估值还是102亿美元。 除了工程师,马培元还有另一个身份——投资猎头(Venture Scout)。他替投资机构寻找值得下注的AI创业项目,每年拥有50万美元的投资额度。 毕业后的这四年多的时间里,他似乎始终行动得要比AI行业共识早,在“agent”这个词还没有被任何人讲清楚定义之前,他所在的团队已经悄悄立项。在Anthropic还是无名之辈时,他们就成了Claude最早的深度用户。他是团队里第一个AI认证工程师、第一个AI agent工程师,后
评分明细
重要性 6 新颖度 6 信源权威 6 技术深度 6 实体加权 ×1.30
-
谁在训练 Kimi K3 ? 深挖贡献者名单,这有一份最全档案
起底 K3 背后核心极客天团,人均扛起 7 亿估值! 作者丨高允毅 樊天骄 编辑丨马晓宁 7 月 27 日,月之暗面拿出全部诚意,直接把满血版 2.8T 模型 Kimi K3 全部开源了。在技术报告的最后,他们首次公布了Kimi K3背后的实际贡献者名单,我们细数了一下,有401位成员,可以说,这是月之暗面人才团队的一次全面亮相。从当初那个估值仅几亿美金的初创团队,到如今名副其实的“国产大模型之光”,月之暗面已然成为全球牌桌上,少数能与 Claude Fable 5 和 GPT-5.6 Sol 这样顶尖模型“掰手腕”的极客团队。伴随 K3 的发布,月之暗面最新估值飙升至 315 亿美元,约为 2100 亿元人民币,而撑起这 2100 亿估值的,是一个极度年轻的团队。据公开信息显示,月之暗面大概有 300 多人,平均年龄不到30岁,其中,80% 是 I 人。如果换算一下,基
-
谁在训练 Kimi K3 ? 深挖贡献者名单,这有一份最全档案
起底 K3 背后核心极客天团,人均扛起 7 亿估值! 作者丨高允毅 樊天骄 编辑丨马晓宁 7 月 27 日,月之暗面拿出全部诚意,直接把满血版 2.8T 模型 Kimi K3 全部开源了。在技术报告的最后,他们首次公布了Kimi K3背后的实际贡献者名单,我们细数了一下,有401位成员,可以说,这是月之暗面人才团队的一次全面亮相。从当初那个估值仅几亿美金的初创团队,到如今名副其实的“国产大模型之光”,月之暗面已然成为全球牌桌上,少数能与 Claude Fable 5 和 GPT-5.6 Sol 这样顶尖模型“掰手腕”的极客团队。雷峰网伴随 K3 的发布,月之暗面最新估值飙升至 315 亿美元,约为 2100 亿元人民币,而撑起这 2100 亿估值的,是一个极度年轻的团队。据公开信息显示,月之暗面大概有 300 多人,平均年龄不到30岁,其中,80% 是 I 人。如果换算一
-
视频后期,危!MiniMax H3手绘即特效,多模态的「Coding时刻」来了
尽显AGI黄金时代的奢华
-
Kimi K3 已提前亮相?神秘模型「Kivine」现身,百万上下文能力惊艳全球
如果传闻属实,Kimi K3 将成为国产模型的重要节点。 作者丨郑佳美、樊天骄 编辑丨马晓宁 7 月 15 日,一款名为 Kivine 的匿名模型突然出现在 LMArena。雷峰网按照正常流程,它本应该只是众多匿名测试模型中的一个,等待用户通过盲测判断能力高低。但这一次情况有些不同,在上线之后短短几个小时内,Kivine 就迅速成为全球 AI 社区关注的焦点。越来越多测试者开始怀疑,这个隐藏身份出现的模型,很可能就是月之暗面尚未正式发布的下一代旗舰模型——Kimi K3。目前,月之暗面并没有公开确认 Kivine 与 Kimi K3 的关系,也没有发布任何官方技术资料。但从已经曝光的信息来看,事情正在形成一条越来越完整的证据链。从 LMArena 上的模型表现,到用户测试反馈,再到 beta.kimi.link 后台出现的产品信息,以及提前泄露又迅速消失的充值活动页面,所有
-
字节跳动发布 Seedance 2.5,徐工、小鹏等企业官宣合作
7 月31日,字节跳动正式发布新一代视频生成模型 Seedance 2.5。该模型在生成时长、多模态理解、编辑精度等维度实现全面升级,目前已上线豆包、即梦、扣子、小云雀等字节旗下产品,并将于近期通过火山引擎面向企业用户开放。相较年初发布的Seedance 2.0,Seedance 2.5 在四大核心能力上均实现突破。单次生成视频时长提升至30 秒,并提供高保真时序延长能力,可在更长时长内保持人物、场景与镜头的一致性;支持最多50个多模态参考素材,同时新增白模、绿幕参考能力,复杂项目与工业化创作更加可控;增加了视频局部编辑能力,支持在维持整体画面节奏的前提下,对背景、商品、人物等局部元素进行精准修改;同时原生支持 10 余种语言,并加强了复杂指令控制,能够适配多语言、多版本的工业化生产需求。此次升级将视频生成从“能生成”推向“可修改、可迭代、可交付”的新阶段,其应用边界也正从内容创作向实体产业深度延伸,在智能驾驶、具身智能、实体制造、教育、电商出海等领域拥有广泛的应用空间。比如合成极端天气、罕见路况、各类突发事故等场景素材,帮助智能驾驶测试拓展覆盖面;辅助生成教学演示视频,让知识分享更加
-
比 Seedance 便宜七成的模型,宣布开源:视频生成行业变天了?
第一次,效果对标 Seedance 2.0 的视频旗舰模型交到了所有人手里。 作者丨吴海明 编辑丨李 娜 马晓宁 今天,MiniMax 发布了视频旗舰模型 H3。在模型效果得到一众创作者认可之余,引人注意的是价格:H3 的价格仅为 Seedance 2.0 的三分之一。更关键的是:即将开源了。这是第一个做到这个水平的开源视频模型。接下来的事,可能会改变整个行业的游戏规则。当一个旗舰能力的视频模型开始开放,视频生成会不会复制 Stable Diffusion 曾经在图像生成领域掀起的生态扩散?而 MiniMax,又能否借此在视频生成赛道中,走出一条不同的路?下面,我们从模型能力、行业位置和开源意义三个层面,拆解 H3 为什么值得关注。01AA 榜单:MiniMax H3 反超 Omni、SeedanceH3 的重点不仅是视频模型,而且是通用多模态。H3 把文本、图片、音
-
晶泰科技发布AI4S原生操作系统 XtalPi Science ,以多智能体矩阵开启自主科学发现新范式
7 月 29 日,晶泰科技正式发布 XtalPi Science 科学智能平台与 Genius Agents 科学智能体矩阵,并联合 26 家产业、高校及科研生态伙伴,共同发起成立 “科学智能开放生态联盟”。联盟将依托 XtalPi Science,为成员提供平台与自动化实验资源的调用、模型与工具接入、联合开发及私有化部署等多元合作模式,共同推动模型、数据、工具与实验能力之间高效协同。XtalPi Science 是全球首个整合大语言模型(LLM)、科学智能体与大规模自动化机器人实验的 AI for Science(AI4S,科学智能)综合平台。它将晶泰科技十年积累的模型、工具、智能体及实验资源封装为可按需调用的 Science Token,从服务单一项目的内部体系,全面跃升为可供全球科研组织按需调用的 AI4S 底层基础设施(Global Scientific Utility)。Genius Agents 作为整套系统的核心调度中枢与研发矩阵,构建了兼具全局规划与特定场景执行能力的多智能体体系。它能自主理解复杂科研目标、完成跨学科长程任务,且显著降低模型幻觉,可在数字世界调用专业模型
-
国内唯一做多模态长记忆的公司,融资数千万,押注主动智能|涌现新项目
文|王欣逸 编辑|张雨忻 一句话介绍 国内唯一做多模态长记忆的公司——丘脑智能,推出原生多模态记忆基座,押注AI从通用走向个性化,最终走向主动智能。 主动智能,指的是AI能在足够了解用户的基础上,在合适的时间、以恰当的方式主动跟用户交互。要实现主动智能,Memory是必须要跨过的门槛。 融资情况 近日,丘脑智能已完成数千万元种子轮融资,投资方包括深圳一线基金和产业资本,本轮融资主要用于技术研发以及人才队伍补充。 团队介绍 丘脑智能创立于2025年11月,创始人兼CEO张源毕业于北京大学,是电子与经济双学科背景,曾在一家自动驾驶公司担任COO,也有过创投行业、具身智能的工作经历。 团队平均年龄约26岁,核心人员主要来自阿里达摩院、腾讯、商汤、港中文、港中深、北大、西交大、KIT、复旦等企业和高校。 产品及业务 Memory领域的行业共识,最早于2025年底在学术界率先形成。这是一个非常新的领域,在面对投资人时,张源常常被问到一些问题,比如,基模会不会自己把记忆做了?Memory这一层到底会不会独立存在?基模和记忆企业之间应该怎么分工? 这些问题,张源有一个坚定的回答:记忆层一定会作为
-
36氪独家|曾爱玲入职B站担任AI视频生成业务负责人,向CEO陈睿汇报
文|王毓婵 兰杰 编辑|乔芊 36氪独家获悉,曾爱玲入职哔哩哔哩(下称“B站”),担任AI视频生成业务负责人,向CEO陈睿汇报。 36氪就此事向B站方面求证,对方暂无回应。 曾爱玲 B站此前已公开表示,AI投入主要聚焦视频理解、视频推荐和辅助视频创作等方向。曾爱玲入职后,或将参与相关业务。 曾爱玲的个人主页显示,她曾在腾讯混元&AI Lab团队和国际数字经济研究院(IDEA)工作三年,领导以人为中心的感知与生成研究团队。其后,她加入米哈游创始人蔡浩宇旗下AI公司Anuttacon,负责开发以人为中心的交互式多模态视频生成系统。这些模型使AI智能体能够感知、交互并生成实时、长时程的视频。 曾爱玲于香港中文大学计算机科学与工程系获得博士学位,并且曾是卡内基梅隆大学机器人研究所的访问学者。 B站一直在寻找一个能稳定下来的AI业务带头人。去年9月,前快手副总裁、可灵AI事业部技术部原负责人张迪,曾跳槽B站,并出任技术条线负责人。但仅仅两个月左右,张迪就再次出走,回归阿里,担任淘天集团未来生活实验室负责人。五个月后,张迪带领团队打造出HappyHorse-1.0。 2024年,B站上线了基础大
-
首家国产自研GPU厂商登陆ChinaJoy,砺算LX 7G100消费显卡零售版全面开售
2026年7月末,中国消费级GPU市场迎来重要时刻。在刚刚开幕的2026年中国国际数码互动娱乐展览会(2026 ChinaJoy)上,砺算科技作为首家国产自研GPU厂商亮相,打破此前从未有国产自研GPU原厂以独立展商身份参展的历史。与此同时,砺算首款全自研消费级显卡LX 7G100零售版已在砺算科技京东自营旗舰店正式开售。从今年5月LX 7G100创始版1000张秒罄、二手市场溢价超4000元,到如今零售版全面放量,砺算LX 7G100不仅终结了国产消费级显卡市场“无芯可用”的局面,更以完全自主自研的TrueGPU天图架构,向全球GPU格局发出强音。国产自研GPU厂商ChinaJoy首秀7月31日至8月3日,第二十三届中国国际数码互动娱乐展览会(ChinaJoy)在上海新国际博览中心盛大举办。作为全国最具人气的数字娱乐盛宴,2026 ChinaJoy以 “与AI同游” 为主题,总展览面积超14万平方米,汇聚全球近900家参展企业——千余款游戏线下试玩、人形机器人现场互动、AI大模型沉浸体验……本届ChinaJoy用空前的游戏试玩阵容与前沿AI技术,吸引了全球数字娱乐产业和爱好者的目光。
-
AI 正在变成一门制造业 | WAIC 2026 Agent 产品观察
国内 Agent 产品当前主要是供给侧繁荣,不是需求侧繁荣。 作者丨李 娜 编辑丨马晓宁 2026 年的 WAIC 真是太热闹了,人潮拥挤,在地铁站排着队进入 WAIC 场馆的时候, 我看见地铁站广告牌上的百度智能体“百度搭子”的广告,这场关于智能体没有硝烟的战争,从入口处就拉开了帷幕。(雷峰网雷峰网雷峰网)WAIC 主场馆世博中心附近地铁站“百度搭子”的大屏广告进入 WAIC 大会的场馆后,可以看到大厂的展台上铺满了各种命名的智能体,H4 馆的初创团队扎堆在垂直 Agent 场景里,H3 馆的具身智能机器人也被称为物理世界里的 Agent,可以说,Agent 几乎是无处不在。2026年,大模型明显从 C 位退了下来,聚光灯打在了 Agent 上。一个数据可以佐证我的感受:在 WAIC 2026 大会期间,IDC 发布的行业首份《DAA 研究报告》显示全球活跃 Agen
-
卡帕西力推的 LLM Wiki,会淘汰传统 RAG 吗?
看清 Agent Wiki ≠ AI 用户记忆,你的知识库落地就成功一半了。 作者丨樊天骄 编辑丨郑佳美 2026 年 4 月,AI 领域知名研究者 Andrej Karpathy 在 GitHub 发布了一篇技术 Gist,提出「LLM Wiki」的技术构想,迅速在行业内引发跟进热潮。雷峰网短短数月内,Cognition、Factory、LangChain、知名投资人 Garry Tan 四支团队几乎同步落地了同类产品,Agent Wiki 从一个个人想法快速成长为一条明确的技术赛道。近期 AI 记忆层项目 Mem0 发布了专栏文章《The State of Agent Wikis》,系统拆解了这一技术的原理、落地现状与能力边界。AI 科技评论就以卡帕西原始构想与这篇文章为蓝本,做通俗化的解读与梳理,在不改变文章原意的基础上,回答行业最关心的问题:LLM Wiki 到底是
-
欧盟8月2日起执行《人工智能法》相关规定,新增AI透明度要求
欧盟委员会7月31日宣布,自8月2日起,欧盟委员会人工智能办公室将与各成员国主管部门共同开始执行《人工智能法》相关规定。同时,新的人工智能透明度要求也将正式生效,要求部分人工智能系统明确告知用户其正在与人工智能互动,以及相关内容是否由人工智能生成或修改。根据新规,聊天机器人等交互式人工智能系统必须向用户明确表明其人工智能身份,而非真人。利用人工智能生成或编辑的深度伪造图片、视频和音频等内容必须进行标识,由人工智能生成或修改的内容还需添加机器可识别标记,以便识别和追踪。欧盟委员会表示,这些措施旨在减少欺骗和操纵行为,帮助公众作出更加知情的判断,同时为企业提供更加明确的合规要求和实施路径。(央视新闻)
-
Anthropic says Claude accidentally hacked real companies too
Anthropic just realized several of its Claude AI models hacked into the systems of three different organizations during testing, acting on their own and without the company noticing. The revelation comes days after rival OpenAI said one of its own models had breached developer platform Hugging Face, adding to growing unease over whether frontier AI […]
-
Anthropic says its own AI models breached three companies during security tests
After OpenAI's models broke into Hugging Face, Anthropic checked its own history and found three similar incidents.
-
OpenAI reportedly finds evidence that more of its agents ran amok
OpenAI has reportedly found evidence of additional agent misbehavior as it looks into the incident that occurred with Hugging Face.
-
It’s time to panic about AI safety
When the phrase "OpenAI hacked Hugging Face" has more or less entered mainstream culture, you know we have an AI problem. This week, we learned more about exactly how OpenAI's agent broke out of a sandbox and autonomously traversed the web, including a bunch of other supposedly secure web services, all in the name of […]
-
Disrupting a Criminal Scam Operation
OpenAI disrupted a Cambodia-based scam operation using ChatGPT to support investment, romance, gambling, and impersonation schemes.
-
Univé builds an AI-ready workforce
See how Univé built an AI-ready workforce with ChatGPT Enterprise by combining leadership, responsible governance, and employee-led innovation to transform work at scale.
-
AI labs want to pump the brakes, but Amazon and SpaceX are still blasting off
After years of pushing full speed ahead on AI, OpenAI CEO Sam Altman says maybe it’s time for the AI industry to “pace” itself. The comments came just days after one of OpenAI’s own models broke out of its test environment and got tangled up in a breach at Hugging Face — though as Equity’s hosts point out, sloppy security seems to have […]
-
Sam Altman isn’t the only one who wants to pump the brakes on AI
After years of pushing full speed ahead on AI, OpenAI CEO Sam Altman says maybe it’s time for the AI industry to “pace” itself. The comments came just days after one of OpenAI’s own models broke out of its test environment and got tangled up in a breach at Hugging Face — though as Equity’s hosts point out, sloppy security seems to have […]
-
Chinese AI Researchers Are Finding Their Voice on X
As OpenAI and Anthropic employees grow quieter online, researchers at Chinese AI labs are flocking to X to explain their work, recruit talent, and shape the global conversation on AI.
-
This AI Assistant Wants to Make Up for Your Boyfriend’s Incompetence
An ad for Orchid suggests the AI agent can fix relationship problems by simply doing everything for inconsiderate partners.