· 晨讯 Dispatch 2026-08-26

AI 资讯 · 2026-08-26

14 · 精选 3 · 关注 9 · 简讯 0 · 国内 7 / 海外 7
今日精选 · TOP 3 algorithmic top-5 by composite score
  1. #1 / 11.8 01.AIAnthropicGoogle DeepMind / IEEE Spectrum AI /其他 /2026-08-26 /3 源
    New Platform Peers Inside AI’s Black Box

    Prompt Claude, ChatGPT, Gemini, or any other popular large language model (LLM) with a question like “What is the best film ever made?” and the response will vary, and you (and most worryingly, the people who built the LLM) have little idea exactly how it came up with that specific answer.This mysterious behavior can be useful in some situations. But—as a recent incident where OpenAI could not explain why its advanced pre-release model hacked AI company Hugging Face highlighted—it can have negat

    评分明细
    重要性 7 新颖度 7 信源权威 7 技术深度 7 实体加权 ×1.30
    其他信源 (3)
  2. #2 / 10.6 AnthropicDeepSeekQwen / AI科技评论 /模型发布 /2026-08-26
    全新架构,极致性价比!阿里千问Qwen3.8-Flash发布并开源

    8月26日晚,阿里发布并同步开源千问最新模型 Qwen3.8-Flash。该模型采用全新下一代架构,千亿总参数仅激活60亿(6B)即可获得超越Claude Opus4.6的前沿性能,创下模型效率的全球新基准。得益于架构和训练的全面革新,Qwen3.8-Flash训练成本较Qwen3.7-Plus骤降近90%,推理成本同样大幅下降,每百万Tokens输入仅1元,输出3元,价格最低至DeepSeek-V4-Flash的1/3,将全球模型性价比“斩杀”至极致新水平。Qwen3.8-Flash今晚将首发上线“千问办公”,开发者和企业也可通过千问AI平台获取新模型API服务。  Qwen3.8-Flash是一个多模态混合专家(MoE)模型,采用了下一代(Next)模型架构,Transformer参数125B仅激活6B,性能表现超越Opus4.6、接近Opus4.8。仅完成预训练的Qwen3.8-Flash基座(Base)模型,在通用(SuperGPQA)、数学推理(GSM8K)、编程(SWEBench-Pretrain)等基础能力上超过了3倍其大小的Qwen3.7-Plus基座模型。经后训练后,

    评分明细
    重要性 6 新颖度 6 信源权威 6 技术深度 6 实体加权 ×1.76
  3. #3 / 7.8 DeepSeekNVIDIA AI / AI科技评论 /其他 /2026-08-26
    英伟达Vera Rubin的Agent吞吐暴涨最高提升30倍,却不只靠GPU | Hot Chips 2026

    在Agent推理上,英伟达又把性能往前推了一大步。Hot Chips 2026期间,英伟达披露了Vera Rubin NVL72最新Agent工作负载测试结果:在DeepSeek V4-Pro、单用户每秒160 Token的测试条件下,相比GB300 NVL72,每兆瓦吞吐最高提升30倍。 但比30倍更值得关注的是,英伟达这次提升Agent推理效率,已经不再只依赖一颗更快的GPU。 面对长上下文、低延迟Token生成、工具调用和数据交互同时出现的Agent工作负载,英伟达正在把一次推理拆成不同类型的计算任务:Vera Rubin NVL72承担大规模模型计算,Groq 3 LPX专攻低延迟Token生成,Vera CPU处理工具编排、代码执行和数据处理,Spectrum-X则负责把这些计算、数据和存储资源连接起来。 换句话说,Agent工作负载让性能问题不再停留在一次模型计算内部,而是沿着上下文、生成、工具执行和基础设施访问继续向外扩展。从GPU、CPU到专用推理芯片和网络,英伟达在Hot Chips展示的已经不只是一代芯片的性能提升,而是一套针对Agent工作负载重新划分计算边界的系

    评分明细
    重要性 6 新颖度 6 信源权威 6 技术深度 6 实体加权 ×1.30
值得关注 9 items