AI 资讯日报 · 2026-09-02
今日AI领域亮点频出:芯片设计领域迎来历史性突破,AI自主完成真实芯片的全流程设计,直接冲击传统硬件厂商的护城河;算法层面DeepMind再次刷新理论计算机科学40年纪录,吴恩达团队也提出新的推理加速方案;大模型产品迭代加速,谷歌、阿里、Anthropic等厂商纷纷推出性能更强、成本更低的新版本;同时行业生态合作持续深入,英伟达、Anthropic等巨头持续加码算力布局,全球AI产业格局正在加速演变。
今日概览
- CUDA 20年护城河被打破!0代码、0人类,AI 14天造出真芯片
- DeepMind AlphaEvolve再破纪录:矩阵乘法指数40年最低
- 龙虾还魂,OpenClaw 2.0发布实现多用户Agent协作
- 吴恩达新作:87%推理token用不着,丢掉反而快3倍
- 首篇多模态Agentic框架系统性前沿综述发布
- 谷歌一天连发2篇Agent Skill相关论文
- Anthropic发布Fable 5.1,性能大幅提升成本下降
- Anthropic与Lambda达成350亿美元云计算协议
- 谷歌新模型Gemini Omni 1.1 Flash全球登顶Arena文生视频榜首
- 最强3D生成团队推出世界生成模型WorldGen
- 2026《时代》全球AI百大人物公布
- Qwen3.8-Max升级0902版本,编程能力大幅提升
- 英伟达拟收购Hugging Face,或重塑开放AI生态格局
芯片与硬件突破
CUDA 20年护城河被打破!0代码、0人类,AI 14天造出真芯片
硅谷Architect Labs团队的最新研究打破了半导体行业的设计壁垒,仅凭两名工程师撰写的高层自然语言规格说明书,AI便实现了零人工介入、从零生成一颗可运行大模型的真实芯片硬件,整个流程仅耗时14天。这颗被命名为Redwood的AI加速器在FPGA上成功跑通开源大模型,实测能效比英伟达Jetson高出3.4倍;若修改架构规格,AI可在48小时内完成代码重构、重新验证与硬件部署全流程。更值得注意的是,运行在初代Redwood上的AI已经开始自主设计下一代芯片,这意味着芯片设计领域的“AI自迭代循环”已经形成。该成果直接挑战了英伟达CUDA生态维持了20年的技术护城河,有望彻底改变半导体行业的研发范式。 来源:https://mp.weixin.qq.com/s?__biz=MzI3MTA0MTk1MA==&mid=2652722026&idx=1&sn=7f5e7d4e3daf9f465de9dd017a032d00
大模型与算法进展
DeepMind AlphaEvolve再破纪录:矩阵乘法指数40年最低
谷歌DeepMind联合理论计算机科学家团队,借助Gemini驱动的编码智能体AlphaEvolve,将矩阵乘法的渐近复杂度指数ω的上界从2.371339刷新至2.371177,这是40年来该领域的最显著进步之一。矩阵乘法是现代计算的核心基础,驱动着图形渲染、大规模神经网络训练等几乎所有计算场景,其理论最优速度长期是理论计算机科学的经典开放问题。本次改进幅度虽仅为约1.62×10⁻⁴,但贡献与过去40年的多数进展相当,也是AI首次以实质性方式介入该领域的研究。该成果已于预印本平台发布,为计算效率的进一步突破提供了新的理论方向。 来源:https://mp.weixin.qq.com/s?__biz=MzI3MTA0MTk1MA==&mid=2652722026&idx=3&sn=cbbd3227761fa83f9396863d82dcc654
吴恩达新作:87%推理token用不着,丢掉反而快3倍
吴恩达团队最新开源的Prefix Sliding方法指出,大模型推理时注意力仅集中在前缀和最近生成的token上,因此可以丢弃中间已贬值的推理token,仅保留前缀+滑动窗口即可完成推理,无需额外训练即可实现最高3倍的提速。该方法针对长程Agent场景的上下文管理痛点提供了零额外生成成本的替代思路,解决了主流模型使用全注意力机制时,推理成本随已生成长度线性增长的问题。配合强化学习训练,该方法还可将推理轨迹扩展到10万token以上,在AIME25、GPQA Diamond、MATH500等基准测试上均验证了其高效性,为长推理场景的落地提供了新的技术路径。 来源:https://mp.weixin.qq.com/s?__biz=Mzk0MTYzMzMxMA==&mid=2247510745&idx=1&sn=413a4ff1480b263dfe33a6cc30f9d80f
谷歌新模型Gemini Omni 1.1 Flash全球登顶Arena文生视频榜首
谷歌更新的Gemini Omni 1.1 Flash模型一举冲上LMArena文生视频榜单全球第一,图生视频赛道位列全球第二,评分达1488分。该模型针对过去AI视频生成的痛点进行了全面优化:支持最长10秒的上下文回看,可累计生成40秒的连贯视频;支持首尾帧指定生成,中间连续运动由模型自主生成;还推出了成本仅为高清版三分之一的360p草稿模式,成片可升级至1080p或4K,最多支持3秒参考视频混入输入以统一动作、运镜和节奏。相比前代Veo模型1秒的上下文记忆,Omni 1.1 Flash将可参考的上下文时长延长了10倍,彻底解决了AI视频生成的“金鱼记忆”问题,显著提升了生成内容的连贯性和可控性。 来源:https://mp.weixin.qq.com/s?__biz=MzI3MTA0MTk1MA==&mid=2652721330&idx=2&sn=5aedf7d87244a4f83ed4d27dbe223484
Qwen3.8-Max升级0902版本,编程能力大幅提升
阿里千问团队今日发布Qwen3.8-Max的0902版本升级,针对编程(Coding)和专业办公(Cowork)场景进行了专项后训练,整体性能较1个月前发布的开源版本再度突破。在CodeArena前端编程总榜中,新版本得分提升22分至1691分,夺得榜单冠军,在多步推理、工具调用、端到端App生成等智能体编程能力上刷新了全球模型的上限。同时新版本的性价比表现突出,每百万Tokens综合平均成本仅5美元,远低于当前排名第二、第三模型的20美元和12美元。目前该版本已上线千问AI平台提供API服务,并同步接入千问办公、Qoder、千问APP等产品。 来源:https://mp.weixin.qq.com/s?__biz=MzIzOTU0NTQ0MA==&mid=2247562297&idx=1&sn=420b67c29646788c40605bb9445947b5
Anthropic发布Fable 5.1,性能大幅提升成本下降
Anthropic正式发布Fable 5.1版本,针对冗长复杂的计算机编程任务和科学工作场景进行了重点优化,在处理全代码库的软件项目、代码审查、实验方案设计、密集图表信息读取等任务上的表现均有提升。为应对来自中国低成本开放权重模型的竞争压力,Anthropic此次并未上调Fable 5.1的每token定价,但对模型重复调用已处理信息的流程降低了75%的价格,大幅降低了模型的总使用成本。该版本已面向企业用户开放,体现了Anthropic在模型性能和成本控制之间寻求平衡的策略。 来源:https://mp.weixin.qq.com/s?__biz=MzI4NTgxMDk1NA==&mid=2247517828&idx=2&sn=aaf351f94733a1b231e031f765a54789
AI产品与工具更新
龙虾还魂,OpenClaw 2.0发布实现多用户Agent协作
曾被视为“时代眼泪”的AI编程工具OpenClaw正式发布2.0版本(v2026.8.1),号称项目史上最大规模更新,核心变化是从单兵作战模式升级为支持多用户、多Agent协作的集群架构。新版本下,单个Gateway可承载多个用户、多条Session和多个人工智能智能体,Agent之间可以互相发送消息、分配任务,实验性的Swarm模式还支持一次性拉起多个子智能体并行执行。本次更新共有933名贡献者参与,合并PR超过16000个,改动量接近项目历史总PR量的一半,重新定义了开源AI编程工具的协作边界。 来源:https://mp.weixin.qq.com/s?__biz=MzkyNjU2ODM2NQ==&mid=2247632466&idx=3&sn=5980ad17351d7307c39c11248a51bcd1
谷歌一天连发2篇Agent Skill相关论文
8月27日谷歌同一天发布了两篇Agent Skill领域的研究论文,分别对应技能进化和技能执行两大方向,完整展现了其对Agent Skill技术的完整布局。其中WikiSkill受Karpathy提出的LLM Wiki概念启发,在原始经验和可执行技能之间插入了结构化知识层(Wiki),把零散的优化洞察编译为可复用的持久知识,在五个基准测试的平均准确率上稳定碾压无技能基线,也超过了EvoSkill、SkillOpt等现有进化方法,且模型能力越强,WikiSkill的优势越明显。另一篇发表在EMNLP的SKILL.state则聚焦技能执行的长程稳定性与成本优化,解决了Agent执行长任务时的可靠性问题。两篇论文分别从“学习”和“执行”两个维度补齐了Agent Skill的技术拼图。 来源:https://mp.weixin.qq.com/s?__biz=Mzk0MTYzMzMxMA==&mid=2247510689&idx=1&sn=14146cec8d4cb3d0bfbddae98b8f24ba
首篇多模态Agentic框架系统性前沿综述发布
这篇系统性综述首次以模态融合方式为主线,沿着智能体的感知、推理、规划、记忆、行动五大核心功能模块,全面梳理了多模态技术对智能体架构的重塑作用,并横跨四大应用领域从性能、效率、可扩展性、延迟、可靠性五个维度做了横向对比。综述提出了多模态智能体的明确定义:以大型多模态模型为核心骨干,能够跨多种模态同时感知、推理和规划,运行在完整的“感知-推理-记忆-规划-行动”认知闭环中。同时该研究还总结了感知融合策略的三分类框架,填补了当前多模态智能体领域缺乏系统性梳理的空白,为后续研究提供了清晰的参考框架。 来源:https://mp.weixin.qq.com/s?__biz=Mzk0MTYzMzMxMA==&mid=2247510645&idx=1&sn=fbe35886443a9fe8a4e48a7db10201f5
最强3D生成团队推出世界生成模型WorldGen
拿下SIGGRAPH最佳论文的AI 3D公司影眸Hyper3D正式发布世界生成模型WorldGen,实现了从单张图片到完整可交互3D场景的生成,全流程仅需数分钟。过去3D生成技术主要聚焦于单个资产的生成,而WorldGen突破了从“生成物体”到“生成世界”的瓶颈,生成的场景支持编辑、交互,可直接用于影视、游戏、机器人训练等生产场景。该模型基于影眸此前全球首个千万面级3D生成大模型Rodin Gen-2.5的能力迭代而来,解决了场景生成中物理一致性、物体遮挡关系等核心难题,大幅降低了专业3D场景的制作门槛和周期。 来源:https://mp.weixin.qq.com/s?__biz=MzI4NTgxMDk1NA==&mid=2247517818&idx=1&sn=24e388e273661a4b15d1a62a2b67271b
行业生态与人物
2026《时代》全球AI百大人物公布
8月27日美国《时代》杂志公布2026年全球AI领域最具影响力100人榜单,真格被投企业月之暗面Kimi联合创始人兼CEO杨植麟、Manus创始人肖弘入选“创新者”类别,与Cursor联合创始人Michael Truell、Suno联合创始人Mikey Shulman等全球前沿AI创业者同列。此外阿里巴巴CEO吴泳铭、字节跳动CEO梁汝波、华为董事何庭波等中国AI领域人物也入选该榜单,此次中国入选者数量达10人,创下历史新高。该榜单被视为全球AI产业格局变化的缩影,反映出中国AI产业正从追赶者成长为全球AI生态的重要参与者。 来源:https://mp.weixin.qq.com/s?__biz=MjM5NDk5MTA0MQ==&mid=2652332919&idx=1&sn=60c0d0fda7bca0ae434c4a6ab0d2ed57
Anthropic与Lambda达成350亿美元云计算协议
Anthropic已与英伟达旗下云服务商Lambda签署价值350亿美元的计算协议,用于快速扩展AI算力储备,相关数据中心由Hut 8在得克萨斯州开发。这是英伟达生态内最新的重磅算力合作,也反映出Anthropic作为全球算力需求大户的资源布局逻辑。近几个月来,Anthropic已先后与Nscale、FluidStack、SpaceX等多家算力服务商签署了总价值超千亿美元的算力协议,持续加码大模型训练与推理的基础设施建设,进一步巩固其在AI大模型领域的竞争地位。 来源:https://mp.weixin.qq.com/s?__biz=MzI4NTgxMDk1NA==&mid=2247517818&idx=3&sn=5f3a5ff4b036fbaf5b0492ac2a0e1d1e
英伟达拟收购Hugging Face,或重塑开放AI生态格局
据外媒报道,英伟达正就收购全球最大的开放模型社区Hugging Face进行洽谈,若交易落地将成为AI开源生态领域的重磅事件。Hugging Face作为当前全球开发者最常用的模型托管与分享平台,汇聚了海量开放权重模型、数据集和AI工具,是开放AI生态的核心枢纽。此次收购若成行,英伟达将进一步完善其从芯片到软件工具、再到开发者生态的完整布局,对全球开放AI生态的格局产生深远影响。 来源:https://www.fastcompany.com/91597304/nvidias-hugging-face-deal-could-reshape-the-open-ai-ecosystem?utm_source=postup&utm_medium=email&utm_campaign=artificial-intelligence&position=14&partner=newsletter&campaign_date=09022026
暂无评论。