AI与大模型新闻日报 | 2026-07-22

📅 2026/7/22 10:48:01 👁️ 阅读次数 📝 编程学习
AI与大模型新闻日报 | 2026-07-22

AI与大模型新闻日报20260722

大模型技术

共 21 条新闻


1. 小红书大模型 IMO 满分夺金,第三题解法让冠军选手直呼优雅

  • 来源: IT 之家

  • 时间: 2026-07-22 00:44

  • 摘要: 刚刚,IMO 2026 成绩新鲜出炉,大模型交卷今年卷到了新高度。经 IMO 官方评定,小红书大模型 dots-note-3.0,六道题全部答对,以满分成绩斩获金牌。含金量有多高呢?这么说吧,这是中国大模型首次获得 IMO 官方金牌水平认证,也是继谷歌 Gemini 模型之后,全球第二个达到该成绩的大模型。而且划重点!是满分!谷歌当年也只答对了 5/6……震惊了,这还是我印象中的小红书吗?首次登上世界级竞赛,就来了场开门红~再往下深扒,小红书大模型 dots-note-3.0 的解题方式也让人眼前一亮又一亮:它仅用自然语言就完成了从读题、解析到写证明的全过程,最终答案不仅全部正确,在部分题目上...

2. 智能体 AI 测试:英伟达 Vera CPU 比英特尔 Sapphire Rapids 快 2.2 倍

  • 来源: IT 之家

  • 时间: 2026-07-22 00:37

  • 摘要: IT之家 7 月 22 日消息,云端 AI 推理平台 DeepInfra 昨日(7 月 21 日)发布博文,报道称在生产环境下智能体 AI(Agentic AI)负载测试显示,英伟达 Vera CPU 速度是其它 CPU 的 2 倍多。英伟达在此前官方博文中指出,相比较 AMD 的 Turin 9755 处理器,Vera CPU 在处理智能体 AI 负载上的性能提升 80%。而在 DeepInfra 最新测试中,英伟达 Vera CPU 的 runc(基于 Linux 内核特性的“进程级”轻量化容器)延迟为 29ms,而英特尔 Sapphire Rapids 为 64ms,英伟达 Vera 快...

3. OpenAI 最强 AI 模型:GPT-6 测试文档曝光,达到通用人工智能水平

  • 来源: IT 之家

  • 时间: 2026-07-21 23:32

  • 摘要: IT之家 7 月 22 日消息,消息源 @daniel_mac8 昨日(7 月 21 日)发布博文,分享了一份未经证实的测试文档内容,预估关联 OpenAI 的 GPT-6 模型(内部代号 Spud)。消息源称 OpenAI 的 GPT-6 模型将会达到通用人工智能(AGI)水平,在内部计算充足的情况下,不需要使用 Lean,也不需要使用任何特殊测试框架,有 48% 的概率完全自主地、一击即中、解决单位距离问题。爆料未提及所需算力规模,但爆料人结合 Noam Brown 给出的基准规则(图表每个数据点对应 100 次尝试)推测,单次试验算力成本上限大概率不超过 5 万美元(IT之家注:现汇率约...

4. OpenAI 自曝 AI 模型“失控”越狱,突破沙盒环境入侵 Hugging Face

  • 来源: IT 之家

  • 时间: 2026-07-21 22:54

  • 摘要: IT之家 7 月 22 日消息,当地时间 7 月 21 日,OpenAI 在一篇官方博客文章中披露了一起“前所未有”的重大安全事件。该公司证实,其在进行内部网络安全能力评估时,参与测试的 AI 模型突破了高度隔离的沙盒测试环境,并入侵了开源 AI 平台 Hugging Face 的生产基础设施。OpenAI 表示,这起事件源于 OpenAI 对包括旗舰模型 GPT-5.6 Sol 以及一个“能力更强的预发布模型”在内的多个模型进行的评估。为了测试模型在网络安全攻防方面的潜在能力,OpenAI 在测试中移除了通常用于阻止高风险网络活动的大部分安全防护措施。

5. 华泰证券:国产模型能力快速提升,有望巩固产业链利好趋势

  • 来源: 36 氪

  • 时间: 2026-07-22 00:32

  • 摘要: 36氪获悉,华泰证券研报认为,7月Kimi和二季度GLM新模型的迭代,再次验证了国产模型的核心逻辑,迭代周期或进一步缩短。相较于海外闭源模型,目前国产技术差距缩短至3—4月,在高性价比优势基础上,不断提升能力上限和定价权。据华泰证券测评,K3表现仅小幅弱于GPT-5.6 Sol,GLM 5.2发布后对标Opus 4.7。从投资角度看,国产模型能力快速提升,有望巩固产业链利好趋势。短期看,尽管定价权有改善,但模型层面竞争明显加剧;长期看Agent渗透率持续改善,有望进一步提高潜在市场空间。

6. 中信证券:展望2026年下半年,红利资产有望进入估值修复区间

  • 来源: 36 氪

  • 时间: 2026-07-22 00:24

  • 摘要: 36氪获悉,中信证券研报称,2026年上半年受到地缘形势扰动、流动性收紧等多重因素冲击,大类资产呈现出显著的高分化、高波动特征。展望2026年下半年,红利资产有望进入估值修复区间;预计黄金短期震荡磨底而长期存在结构支撑;主动权益基金中的风格中性组合有望受益;量化基金超额收益或迎来改善;绝对收益型“固收+”基金在分化行情中的适应性更强;宏观配置策略受流动性扰动影响有望减弱;主观CTA策略预计更具优势。

7. AI算力需求驱动+产品涨价,半导体产业链上半年业绩大面积预增

  • 来源: 36 氪

  • 时间: 2026-07-22 00:02

  • 摘要: 最高预增743倍,半年度利润高达110亿元,以存储模组龙头江波龙为代表,A股半导体公司上半年业绩大面积预喜。半导体公司上半年业绩为何增长?AI算力需求爆发带动需求增长,叠加产品涨价,布局AI赛道的半导体企业依托产品“量价齐升”,实现营收与利润同步高增。展望下半年,有业内人士分析称,在北美四大云厂资本开支持续加码、头部大模型公司商业化持续落地的情况下,AI算力需求有望维持高增长态势,算力链条上的AI芯片、半导体设备与材料等细分环节,将持续保持较高景气度。(上证报)

8. WAIC重磅成果|仪电智算云在国家人工智能应用中试基地建设中展现全栈服务能力

  • 来源: 雷峰网

  • 时间: 2026-07-21 11:51

  • 摘要: 7月19日,上海仪电在2026世界人工智能大会(WAIC)上正式发布“智算云赋能·标杆应用场景成果”,系统展示了其自主研发的仪电智算云YiCloud在金融、制造、医疗三大国家人工智能应用中试基地的规模化落地成效,全方位呈现“算力+模型+场景”全栈服务能力。金融领域|深度支撑金融大模型生态构建助力普惠金融风控新标杆在中国银联承建的金融领域国家人工智能应用中试基地建设过程中,仪电智算云YiCloud凭借垂类模型训推一体化能力,为中国银联联合17家机构共建的百亿级金融语料及50万条微调数据提供稳定算力支撑。

9. 全链路研发智能体 —— 从 "体感能用" 到 "实际可用" 的工程实践

  • 来源: 开源中国

  • 时间: 2026-07-21 09:18

  • 摘要: AI Coding 已改变研发方式,但单点代码生成只占研发工时 10-32%,整体提效有限。本文从我们团队在项目的真实交付复盘出发,提出 Harness 全链路研发智能体:把大模型放进一套可控的研发流程,将需求分析、接口设计、代码生成、自动 CR、单测、冒烟验证、环境部署、问题排查串成带反馈控制的闭环,让 AI 从 "会写代码" 升...

10. 谷歌发布三款新的 Gemini 模型——但没有 3.5 Pro

  • 来源: TechCrunch AI

  • 时间: 2026-07-21 17:11

  • 摘要: 谷歌发布了 Gemini 3.6 Flash、3.5 Flash-Lite 和 Flash Cyber,但 Gemini 3.5 Pro 的持续缺席引发了关于其人工智能战略的新疑问。

11. OpenAI表示它用一个新的人工智能系统意外入侵了Hugging Face

  • 来源: The Verge AI

  • 时间: 2026-07-21 21:48

  • 摘要: OpenAI 表示,其人工智能模型在内部测试期间错误地侵入了开源人工智能平台 Hugging Face。在周二的一篇博客文章中,OpenAI 写道,GPT-5.6 Sol 和“一个更强大的预发布模型”在他们的沙箱测试环境中发现了漏洞,使它们能够接触到...

12. 人类公司 15 亿美元图书盗版和解案获法官批准

  • 来源: The Verge AI

  • 时间: 2026-07-21 16:53

  • 摘要: 一名联邦法官已批准Anthropic与指控该公司使用受版权保护图书训练其人工智能模型的作者达成的15亿美元集体诉讼和解协议,正如路透社早前报道的那样。在周一的一项命令中,法官Araceli Martinez-Olgun写道,该和解协议将提供...

13. 谷歌推出比 Mythos 等大型人工智能安全模型更便宜的替代方案

  • 来源: The Verge AI

  • 时间: 2026-07-21 15:00

  • 摘要: 谷歌正在推出 Gemini 3.6 Flash,同时配备一个新的安全模型,专门用于快速发现和修补安全漏洞。在周二的一篇博客文章中,谷歌将 Gemini 3.5 Flash Cyber 描述为“大型、更昂贵的 AI 系统的高性价比且功能强大的替代方案”,如……

14. LLM 垃圾邮件机器人比真实的人更喜欢我的 Show HN 帖子

  • 来源: Hacker News

  • 时间: 2026-07-21 11:22

  • 摘要: [13分] LLM 垃圾邮件机器人比真实人类更喜欢我的 Show HN 帖子

15. 展示 HN:threadfork – 在你的 Mac 上运行的 AI 会议记录

  • 来源: Hacker News

  • 时间: 2026-07-21 18:30

  • 摘要: [10分] 嗨 HN,我开发了 threadfork。这是一个 AI 记笔记工具,整个流程在 Apple Silicon 本地运行。你的麦克风和系统音频会被捕捉,无需会议机器人,最重要的是你的会议数据不会被发送或保存到任何地方。我一直在隐私 +...

16. 用 GPT-5.6、Claude、Gemini 和 Grok“绘制”蒙娜丽莎

  • 来源: Hacker News

  • 时间: 2026-07-21 21:13

  • 摘要: [90分] 使用 GPT-5.6、Claude、Gemini 和 Grok “绘制”蒙娜丽莎

17. 问 HN:你在 Pi 编码代理中使用哪个模型?

  • 来源: Hacker News

  • 时间: 2026-07-21 13:23

  • 摘要: [5分] 我使用 Pi 编码代理与 OpenAI GPT-5.6 Sol,但发现 GPT-5.6 比 Claude Code 慢。你使用其他模型吗,比如其中一个托管的开源模型?

18. 展示 HN:浏览器工具 SDK——用于代理的优化浏览器框架

  • 来源: Hacker News

  • 时间: 2026-07-21 21:01

  • 摘要: [7分] 我们正在开源 Browser Tools SDK:一个小型的 TypeScript 包,为任何 AI 代理提供可靠的方式来控制真实浏览器。只需几行代码,你就可以为任何代理提供一个生产就绪的浏览器工具包 import { createAiSdkBrowserTools } from "libretto-browser-tools/a...

19. 展示 HN:如何为雅可比猜想反驳获得一个 Fable CoT

  • 来源: Hacker News

  • 时间: 2026-07-21 01:10

  • 摘要: [5分] 自从雅可比猜想的反例发表以来,许多人要求发布一条思路链,以便他们能更好地理解导致反例的数学直觉。由于没有任何发布,我尝试进行“洁室逆向工程”:...

20. 展示 HN:一个用 Rust 和 Bevy 制作的自运行太空经济模拟器

  • 来源: Hacker News

  • 时间: 2026-07-21 18:29

  • 摘要: [82分] 我用Claude做了这个,因为我一直想尝试模拟经济,而且我喜欢太空主题。一个没有任何剧本的太空经济模拟。有几百艘自主飞船,每艘都有自己的计划器。有些追逐最佳贸易路线,接送货合同,加油,改装在……

21. 展示 HN:Inflexa – 生物学的开源智能

  • 来源: Hacker News

  • 时间: 2026-07-21 14:44

  • 摘要: [5分] 嘿 HN!Inflexa 是一个以开源为先的 TUI,用于可代理 AI 的可重复生物分析,每一步都会跟踪溯源。它是一个设计更好的 Claude Science(暂且不考虑 GUI)。在此之前,我们花了多年时间构建一个云端多组学分析平台,与研究团队合作...

AI 产品与应用

共 3 条新闻


1. 英伟达详解 Vera CPU:专为智能体 AI 构建,88 个 Olympus 核心、1.2 TB/s LPDDR5X 内存

  • 来源: IT 之家

  • 时间: 2026-07-22 00:20

  • 摘要: IT之家 7 月 22 日消息,英伟达昨日(7 月 21 日)发布博文,从技术角度详细介绍了 Vera CPU,专为智能体 AI(Agentic AI)场景设计。英伟达表示智能体 AI 将更多的关键执行路径转移到了 CPU 上。智能体(Agents)在沙箱中运行代码、调用工具、检索上下文、与数据库交互以及分析结果,然后再将信息返回给模型。IT之家援引博文介绍,智能体 AI 工作负载主要取决于以下几点:即使插槽完全负载,也需要强大的单线程性能。每个核心都有足够的内存带宽,以持续为许多活跃的执行上下文提供数据。并发下的延迟具有可预测性,以便智能体能够稳定完成预定步骤。

2. AI 智能体互联国标试点在京启动,美团、滴滴、联想等18家单位首批签约

  • 来源: IT 之家

  • 时间: 2026-07-21 23:02

  • 摘要: IT之家 7 月 22 日消息,《人工智能 智能体互联》系列标准应用推进专题会议 7 月 21 日在北京海淀区中关村展示中心召开。会议由全国信息技术标准化技术委员会人工智能分委会主办。此次会议标志着国内首个覆盖智能体全生命周期的互联标准体系正式进入试点应用阶段。此前IT之家曾报道,该系列标准(GB/Z 185.1—GB/Z 185.7—2026)于 2026 年 6 月由国家市场监督管理总局(国家标准化管理委员会)正式批准发布,是我国在人工智能智能体领域发布的首套国家级标准体系。

3. 独家丨腾讯整合Workbuddy与QClaw团队

  • 来源: 雷峰网

  • 时间: 2026-07-21 15:46

  • 摘要: 雷峰网独家获悉,7 月 20 日,腾讯发布内部组织调整通知,腾讯QClaw产品中心相关业务和部分团队,将调整至云产品六部。QClaw产品仍将持续运营。QClaw由腾讯电脑管家团队基于OpenClaw打造,今年3月开启内测。据媒体报道,上线一周后其用户量曾突破数百万。云产品六部是腾讯另一款AI办公智能体Workbuddy产品所属部门。过去半年Workbuddy异军突起,7月20日,易观分析最新发布的《2026年Q2中国办公智能体平台市场洞察报告》显示:腾讯WorkBuddy在国内PC端AI原生办公智能体市场6月单月访问量破2000万,保持市场第一领先优势,超过第二、第三位总和。

行业动态

共 10 条新闻


1. WAIC重磅成果|上海市教育算力专区正式开启试运行

  • 来源: 量子位

  • 时间: 2026-07-21 09:30

  • 摘要: WAIC重磅成果|上海市教育算力专区正式开启试运行。(点击链接查看原文获取详细内容)

2. 月之暗面 Kimi 将以投前 500 亿美元估值洽谈 IPO 前最后一轮融资,有望最快 6 个月内赴港上市

  • 来源: IT 之家

  • 时间: 2026-07-21 23:10

  • 摘要: IT之家 7 月 22 日消息,彭博社今日报道称,国内大模型独角兽月之暗面计划于 8 月启动上市前最后一轮融资谈判,目标投前估值 500 亿美元(IT之家注:现汇率约合 3389.04 亿元人民币)。该公司预计将在未来几天完成现一轮融资,本轮融资估值约投前 315 亿美元(现汇率约合 2135.1 亿元人民币)。融资完成后,月之暗面将立即启动新一轮融资洽谈,这将成为公司赴港上市前的最后一次私募股权融资。公司最快可能于 6 个月内登陆香港资本市场。月之暗面成立于 2023 年 4 月,创始人杨植麟本科毕业于清华大学计算机系,拥有卡内基梅隆大学计算机专业博士学位。

3. 纬创资通美国首家半导体工厂:投资 7 亿美元,生产英伟达最强 AI 计算产品

  • 来源: IT 之家

  • 时间: 2026-07-21 22:39

  • 摘要: IT之家 7 月 22 日消息,英伟达(NVIDIA)今天(7 月 22 日)发布博文,报道称纬创资通(Wistron)在美国得克萨斯州沃斯堡开设其首家美国制造工厂,将生产英伟达 GB300、Vera Rubin 等 AI 超级芯片,总投资达 7 亿美元。IT之家援引博文介绍,该工厂占地面积约为 32.4 万平方英尺(IT之家注:约 30101 平方米),将负责生产 NVIDIA Grace Blackwell Ultra、Vera Rubin Superchips 超级芯片。

4. 圆桌论坛:夏天周而复始·VC3.0| 36氪WAVES2026新浪潮

  • 来源: 36 氪

  • 时间: 2026-07-21 09:05

  • 摘要: “2026年,创投圈的浪潮再次翻涌:AI从技术概念走进产业深水区,硬科技创业从“小众赛道” 变成“主流共识”,年轻的创业者们正在用代码和双手,重新定义中国创新的未来坐标。 每一年,由36氪 · 暗涌主办的WAVES大会,都是中国创投圈的年度风向标。今年的 WAVES 2026以“今年盛夏”为主题,落地广州番禺良仓新造创意园,在两天的时间里,我们汇聚了顶级投资人、产业领袖、新锐创业者,用14场深度圆桌、数十场独立演讲,拆解 AI、硬科技、出海、医疗等核心赛道的底层逻辑,见证那些“少数人” 的坚持,如何汇聚成改变行业的浪潮。

5. 银河证券:算力需求高增,驱动光模块结构性升级与价值重构

  • 来源: 36 氪

  • 时间: 2026-07-22 00:36

  • 摘要: 36氪获悉,银河证券研报认为,当前光通信行业正经历由AI算力需求爆发驱动的深刻结构性变革,行业景气度已从传统的周期性波动转向由技术迭代与资本开支共振支撑的长期扩张通道。全球主要云厂商及AI企业持续上调算力基础设施投资预算,直接拉动高速光模块需求呈现非线性增长。研报认为2026年开始,高速产品在数通领域的渗透率正加速提升,1.6T产品已进入批量交付周期,需求端高增为产业链各环节的产能释放与盈利兑现提供了较坚实的基本面支撑;随着需求高增长确定性的不断提升,产能释放也从年初开始逐季改善,虽然当前上游原材料紧缺情况依旧存在,但随着国产替代等进程的不断加深,紧缺程度或将持续收窄。

6. 中信证券:继续全面看好国产算力产业链

  • 来源: 36 氪

  • 时间: 2026-07-22 00:09

  • 摘要: 36氪获悉,中信证券研报称,WAIC 2026维持高关注度,算力芯片领域天数智芯、东方算芯等发布新产品,加速对海外先进产品的性能追赶;超节点是大会核心聚焦,成为指引未来算力发展向系统级层面升维的重要方向;互联等AI Infra技术加速落地,国产底座进一步升维,行业从单卡算力竞争转向芯片、高速互联、整机架构与行业应用全链条生态协同竞争。继续全面看好国产算力产业链。

7. 算力超节点带火液冷,浸没式液冷崭露头角

  • 来源: 36 氪

  • 时间: 2026-07-21 23:58

  • 摘要: 随着算力新基建超节点的涌现,其背后的液冷技术引发了行业新一轮关注。记者近日在2026世界人工智能大会(WAIC 2026)采访发现,华为、中兴通讯、新华三、浪潮等知名服务器厂商超节点的热管理系统已全线向液冷升级,其中包括主流的冷板液冷,还有方兴未艾的浸没式液冷。中金公司预测,随着新技术的亮相,2026年迎来液冷放量元年,全球智算中心液冷市场将达1147亿元,同比增长273%,2027年仍有望保持高增长。受访人士普遍认为,受高算力提振,液冷新技术正在不断升级,并落地应用。伴随着氟化液价格走低,浸没式液冷将迎来工程化阶段,市场景气度可期。(上证报)

8. 【新闻稿】小鹏品牌日暨MONA L03上市发布会

  • 来源: 雷峰网

  • 时间: 2026-07-21 11:16

  • 摘要: 【2026年7月16日,德国慕尼黑】今日,小鹏集团在德国慕尼黑举办「XPENG LIVE:PHYSICAL AI FOR ALL」小鹏品牌日暨MONA L03全球上市发布会,正式推出MONA系列首款全球车型小鹏MONA L03,并于今年面向全球65个国家开启销售。小鹏MONA L03围绕全球年轻用户需求,在设计美学、智能座舱、AI智驾、一车双能和安全配置等方面皆以全球设计、全球研发、全球安全标准打造,为全球用户带来更智能、更高品质的出行体验。

9. 火山引擎与安永达成战略合作,助力企业迈向 AI 原生架构

  • 来源: 雷峰网

  • 时间: 2026-07-21 09:56

  • 摘要: 7月19日,全球领先的专业咨询服务机构——安永(EY)与火山引擎签署战略伙伴合作备忘录,双方将在人工智能技术落地、专业服务交付与企业 AI 转型等领域深化协同,携手助力企业客户以 AI 为核心重塑业务能力,推动运营模式向 AI 原生架构演进。在安永大中华区首席运营官兼金融服务主管合伙人忻怡、火山引擎总裁谭待见证下,安永大中华区咨询服务主管合伙人吴晓颖与火山引擎副总裁赵文婕代表双方签署协议。安永中国主席陈凯表示:“生成式AI正深刻重塑商业世界,安永始终致力于将前沿技术转化为客户价值。此次与火山引擎强强联合,是安永践行AI战略的关键一步,我们将携手助力客户在AI时代赢得先机。

10. 【钛晨报】IPv6技术创新和融合应用实施方案发布,部署10方面36项重点任务;证监会:持续加强市场基础制度建设,增强市场内在稳定性;北京:下半年将布局建设Token工厂,力争新增智能算力5万P

  • 来源: 钛媒体

  • 时间: 2026-07-21 23:20

  • 摘要: 智谱AI落地1GW国产算力中心,同步完成对中科加禾的收购;腾讯云:将大规模部署国产化算力和NPO(近封装光学)超级节点;小米上调手机出货目标;阿里千问发布 Qwen-Image-3.0;贝莱德集团拟发债募资超120亿美元,资本市场加码布局AI基础设施;丰田宣布向美国德州圣安东尼奥工厂投资36亿美元;中国将安排220亿元支持老旧营运货车报废更新;市场监管总局指导行业协会发布肉制品行业自律公约;多家央企宣布增持回购,传递积极信号;第十二架南航C919国产大飞机正式入列

学术论文

共 1 条新闻


1. 美国将改革科研资金分配:从大学转向 AI,影响 2000 亿美元预算

  • 来源: IT 之家

  • 时间: 2026-07-21 23:44

  • 摘要: 北京时间 7 月 22 日,据《华尔街日报》报道,特朗普政府计划通过加大对个人科学家和 AI 应用的支持,而非侧重大学,来加快联邦科研的改革。这是该政府加快技术升级以应对竞争的最新尝试。特朗普与克拉齐奥斯白宫科学与技术政策办公室 (OSTP) 周二发布的一份新报告和备忘录中表示,个人科学家能够帮助美国更快地利用 AI 开展科学研究。该办公室发布的这些指令,将影响特朗普第二任期剩余时间内联邦政府每年约 2000 亿美元(现汇率约合 1.36 万亿元人民币)的科研与开发预算分配方向。新的指导方针可能会进一步打击那些依赖联邦科研资金的大型大学。