· 晨讯 Dispatch 2026-08-19

AI 资讯 · 2026-08-19

19 · 精选 5 · 关注 14 · 简讯 0 · 国内 11 / 海外 8
今日精选 · TOP 5 algorithmic top-5 by composite score
  1. #1 / 9.6 Anthropic / AI科技评论 /其他 /2026-08-19
    华尔街实测8款全球主流Agent:千问办公综合排名第一,超Claude Cowork、Codex

    8月19日消息,华尔街投行杰富瑞分析师近日对八款全球主流AI Agent 进行了真实办公任务实测,结果显示,通过模型和Harness的协同,阿里千问办公综合得分排名第一,超过美国的Claude Cowork和Codex等Agent工具。 此次测试共设置5项真实办公任务,包括基于多份文件完成公司年报摘要、联网查找并比较公司经营数据、操作真实桌面浏览器完成信息检索和文档生成、根据数据制作英文PPT,以及基于参考图片生成营销海报。测试结果显示,千问办公整体表现较为均衡,尤其在复杂办公任务、网页浏览器控制以及多模态内容生成等场景中表现突出,是唯一一个在所有测评维度中均获得90分以上的Agent产品。 报告进一步将Agent能力拆分为模型与Harness两部分进行分析。所谓Harness,是围绕模型运行的一整套工程机制,包括指令、上下文、工具调用、边界控制、反馈纠错和治理等。按照杰富瑞的测算,千问办公的“隐含Harness分”位居此次测试产品首位,高于Claude Cowork和Codex等七款国内外主流Agent产品。这也意味着,在底层模型之外,如何通过工程和产品能力将模型智能稳定转化为实际任

    评分明细
    重要性 6 新颖度 6 信源权威 6 技术深度 6 实体加权 ×1.60
  2. #2 / 7.8 Zhipu / AI科技评论 /模型发布 /2026-08-19
    以GLM-5为例,探究九章智算云强化学习系统如何落地“训推一致”

     过去几年,大模型竞争的主线很清晰:更大的模型、更多的数据和更强的GPU集群。但随着预训练边际收益递减,模型能力Scaling正从单纯的预训练堆叠向后训练强化学习(RL)转变,数学推理、代码生成、复杂决策、长时序Agent等高阶能力,越来越依赖后训练强化学习(RL)激发。RL通过生成、执行、反馈和奖励,让模型持续学习推理、规划与自我纠错的能力。由此,大模型发展从“一次性训练”进入“持续训练”,模型能力Scaling也从预训练延伸至生成、反馈和迭代全过程。SemiAnalysis指出,当RL成为模型能力持续Scaling的关键,竞争的就不只是算法,还有支撑模型持续生成、训练和更新的AI基础设施系统。问题也随之变成:当模型越依赖RL获得能力,谁来支撑这种能力持续低成本地生产。从“模型+算力”到算法与AI基础设施共同Scaling智谱近期的模型迭代,为观察后训练RL提供了一个窗口。智谱公告指出,GLM-5.3与GLM-5.2在相同基座上推进强化学习,通过后训练Scaling持续提升模型智能上界。以GLM-5.2为例,其在SWE-bench Pro取得62.1分、Terminal-Bench

    评分明细
    重要性 6 新颖度 6 信源权威 6 技术深度 6 实体加权 ×1.30
  3. #3 / 7.8 NVIDIA AI / AI科技评论 /行业政策 /2026-08-19
    英伟达 Cosmos 3 深度拆解:它想做具身智能时代的「安卓系统」| RSS 2026

    当 AGI 的大脑决定向边缘迁徙,英伟达拿出了统治机器人进化的“终极剧本”。    编辑丨岑峰                                                                                                       2026 年,大模型行业正经历一场前所未有的“体感位移”。那个在纯数字世界几乎无往不利的 Scaling Law,在试图跨越到物理世界时,正遭遇物理规律、空间约束和长尾数据的残酷审判。AI 行业最核心的矛盾正日趋明显:云端算力的指数级爆发,与机器人终端落地的步履蹒跚,构成了一种日益撕裂的鸿沟。这种割裂感,在 7 月悉尼 RSS 2026的最后一天,被推向了最高潮。在 “Robot World Models(机器人世界模型)” Workshop 上,传统机器人学界对物理因果的“敬畏”,正与 AI 工业界对规模效应的“迷信”正面交锋。就在这场范式撞击的火山口上,英伟达物理AI专家Max Li,为我们拆解了其新发布的重量级产品——Cosmos 3。这不再仅仅是一个更逼真的视频生成器:它是全球首个在

    评分明细
    重要性 5 新颖度 5 信源权威 5 技术深度 5 实体加权 ×1.30
  4. #4 / 6.5 Tencent HunyuanxAI / AI科技评论 /融资与收购 /2026-08-19
    宇树科技今日上市,多只港股已抱上这条「机器人大腿」;人均557万元!寒武纪124名员工股票激励将到账;入校即入企!格力技校开启首届招生

    要闻提示1.人均557万元!寒武纪124名员工股票激励“大红包”即将到账2.宇树科技今日上市,多只港股已抱上这条“机器人大腿”3.72岁董明珠任校长!格力技校开启首届招生,宣称“入校即入企,毕业即适岗”4.比亚迪回应收购上汽集团:愿与大家携手推动中国汽车走向世界5.叮咚买菜在江浙等部分区域试点收取包装费,上海暂不试行6.原xAI多模态理解负责人蔺旭东加入混元大模型团队7.上热搜!吉利称将“不再研发传统燃油车”!8.美国软件公司裁员,退出中国今日头条人均557万元!寒武纪124名员工股票激励“大红包”即将到账8月17日晚,寒武纪发布公告,公司2023年限制性股票激励计划预留授予部分第一个归属期的股份登记工作已完成,124名员工即将迎来人均价值约557万元的股权激励“红包” ,相关股票将于8月20日上市流通。根据公告,本次归属的激励对象共124人,合计分享59.76万股股票,其中56.1万股为定向发行股份,3.66万股来源于公司回购的A股普通股。以8月17日寒武纪收盘价1156元/股估算,该部分股票总价值约6.9亿元,对应人均股票价值达到557.15万元。回顾2023年底推出该激励计划时,

    评分明细
    重要性 5 新颖度 5 信源权威 5 技术深度 5 实体加权 ×1.30
  5. #5 / 6.0 / AI科技评论 /其他 /2026-08-19
    纳须弥,于芥子:大模型之后,中国厂商正在把大模型塞进复杂系统 | IJCAI 2026 前瞻

    小小模型容器和巨大的智能世界。    作者丨吴思梦    编辑丨岑   峰                                                                                                       1986年,MIT 教授,也是 MIT Artificial Intelligence Laboratory 的重要创始人之一的Marvin Minsky 出版《The Society of Mind》,提出了一个后来影响深远的想法:所谓“智能”,并不一定来自某一个无所不能的“大脑”,而可能来自许多不同的 agents,通过分工、连接和协作共同产生。四十年后的大模型已经拥有了工具调用、记忆、视觉理解和行动能力。产业界的热词从“涌现”变成“Agent”,从“对齐”走向“Computer Use”。但技术真正面对的问题并没有因此改变:当一个模型不再只是回答问题,而是需要规划任务、调用工具、获得反馈、调整策略,它最终还是要回答那个并不新鲜的问题——下一步做什么。只是今天,我们似乎终于有了一个足够强的“通用组件”,可以

    评分明细
    重要性 6 新颖度 6 信源权威 6 技术深度 6
值得关注 14 items