每日极客日报 · 2026年08月15日
今日精选 25 条 IT 科技热点,覆盖 AI 大模型、开源生态、云原生与工程实践等领域。
🔥 今日头条
Qwen 3.8 27B 开源:27B 参数超越 Qwen3.7-Plus
阿里发布 Qwen3.8-27B 开源稠密模型,仅 27B 参数即在多项基准上超越 Qwen3.7-Plus,已上线 Ollama 并支持 Claude Code/OpenCode 集成;同时 Qwen3.8-Max(2.4T)将于下周开源权重。HN 千赞热议,本地推理表现领先。
GLM-5.3:前沿编程与“涌现式”网络攻防能力
智谱发布 GLM-5.3,主打前沿编程与涌现式网络攻防能力:Terminal-Bench 3.0 由 4.6 升至 28.3,High 档以约 50K token 超越 Claude Opus 4.8(120K),并在 269 个真实项目中识别出 2436 个漏洞(含 1097 个中高危)。
Google 用全同态加密让“私有 AI”走向实用
Google 公布用全同态加密(FHE)让私有 AI 真正可用的方案:数据在加密态下完成推理,兼顾隐私与可用性。引发 HN 近 200 条关于性能开销与工程落地的讨论,是隐私计算与 LLM 结合的重要信号。
Gemini 3.7 Flash 突袭:性能逼近旗舰、价格“打骨折”
谷歌突袭发布 Gemini 3.7 Flash:性能逼近旗舰、价格大幅下探,已向 AI Pro/Ultra 与 Workspace 用户开放,支持表格一键转应用,并进入 AI Mode 搜索。性价比“斩杀线”被重新定义。
📦 开源项目精选
1. cathrynlavery/diagram-design ⭐ 17.5k (+3646)
HTML| 为 Claude Code 提供 29 种编辑型图表模板,纯 HTML+SVG 生成,无阴影、无 Mermaid “套路味”,让 AI 产出可直接交付的矢量图,今日新增 3646 星居 GitHub 日榜首。
2. github/spec-kit ⭐ 128.6k (+1160)
Python| GitHub 官方出品的 Spec-Driven Development 工具包,用规范化的需求/设计/任务文档驱动开发,帮助团队从“写代码”转向“先定规范”,今日新增 1160 星。
3. PrimeIntellect-ai/prime-agent ⭐ 16k (+1.07万/周)
TypeScript| 自我改进(self-improving)的 RLM Agent,面向长周期自主编程任务,本周暴涨 1 万+ 星,是 GitHub 周榜最热仓库之一,代表“会越用越聪明”的 Agent 新范式。
4. TencentCloud/TencentDB-Agent-Memory ⭐ 21.8k (+4423/周)
TypeScript| 团队级 Agent 记忆中枢,将对话、文档、代码沉淀为四类可治理、可共享的记忆资产(聊天记忆、技能、LLM-Wiki、代码图),本周新增 4423 星。
5. cactus-compute/needle ⭐ 5.7k (+662)
Python| 仅 14MB 的端侧基础模型,可跑在手机、可穿戴、智能家居与机器人上,把推理能力推向极小算力设备,今日新增 662 星。
6. NVIDIA-NeMo/Switchyard ⭐ 1.5k (+1195/周)
Rust| LLM 流量路由器,在兼容 OpenAI/Anthropic API 的前提下跨模型、跨供应商调度流量,便于模型选择、基准测试与成本/性能优化,本周新增 1195 星。
7. unslothai/unsloth ⭐ 71.6k (+501)
Python| 本地运行与训练 LLM/扩散模型的 UI,已支持 Qwen3.8、Kimi K3、MiniMax-H3、Gemma 4、DeepSeek-V4、FLUX 等最新模型,今日新增 501 星,是本地炼丹首选工具。
🤖 AI & 大模型动态
DeepSeek 把 Harness 开源了:模型、工具、Agent Loop 全是插件
DeepSeek 将 Harness 开源:模型、工具、Agent Loop 全部插件化,把“最优解”交还给开发者自己组装。掘金、InfoQ 多篇实测对比 Claude Code,结论是“不在同一赛道”——一个是可组装的 Agent 底座。
Cursor 发布 Composer 2.5,a16z 合伙人转投 SpaceX
Cursor 推出 Composer 2.5,基准测试超越前沿模型;同日 a16z 合伙人 Martin Casado 离开 Cursor 董事会、加入 SpaceX。AI 编程赛道人才与资本流动剧烈,商战意味浓厚。
Perplexity 发布 Search SDK:为 Agent 提供“搜索即代码”
Perplexity 推出 Search SDK,把搜索能力封装为 Agent 可直接调用的代码接口,让智能体在推理过程中按需检索,进一步模糊“模型内知识”与“实时检索”的边界。
Snowflake Cortex Agents 的本体驱动推理实践
Snowflake 分享 Cortex Agents 如何用“本体(Ontology)”驱动业务世界推理:把企业知识结构化后喂给 Agent,使其在受治理的语义框架下做决策,而非盲猜 schema。
🛠️ 工程实践 & 技术文章
Claude Code 没有“魔法”:2026 年主战场是上下文工程
文章指出 2026 年软件工程的主战场已从“提示词”转向“上下文工程”——如何为 Agent 组织、压缩、调度上下文,才是拉开差距的关键,而非某个神秘技巧。
Vercel 发布新语言 Zero:代码不是写给人看的,是写给 AI 的
Vercel Labs 发布 Zero:一门以图(graph)为先、专为智能体编写代码而设计的语言,强调让 Agent 成为一等公民,重新思考“谁在读这段代码”。
Rust 给 AI 编程立新规:能帮你看,不能替你写,用多了会“熔断”
实验为 AI 编程助手设下“熔断机制”:超出安全使用阈值即暂停,提醒开发者回到主导位置。探讨“AI 辅助”与“AI 代写”之间的边界与责任归属。
从亚百毫秒级启动到生产级部署:腾讯云为何重构 Agent 沙箱
腾讯云详解为何 Agent 不能复用老式 Infra:传统沙箱启动慢、隔离粗、弹性差,难以承载长周期、高并发的智能体任务,因而重构出亚百毫秒级启动的新一代 Agent 沙箱。
🌐 业界动态
Firefox 成为最后仍支持 uBlock Origin 的主流浏览器
随着 Chrome 系全面转向 Manifest V3,Firefox 成为最后一个原生支持 uBO 的主流浏览器,HN 引发 250+ 条关于广告拦截、浏览器权力与用户主权的讨论。
Azure Cosmos DB 严重漏洞曝光:一条查询可攻破所有租户数据库
Wiz 披露跨租户漏洞 CosmosEscape,攻击者可用一条查询横向击穿多租户隔离。从业者争论:客户究竟能做些什么来规避云服务底层风险。
微软 AI Gateway 新层级引热议:统一治理背后的权限隐忧
Azure API Management 新增专用 AI Gateway 层,统一治理模型与 MCP 工具。社区关注其集中式权限模型是否会成为新的单点风险与锁定点。
面壁智能正式启动 IPO:中信证券辅导,端侧模型走向资本市场
面壁智能(端侧大模型代表)正式启动 IPO,由中信证券辅导,标志着端侧/小模型路线从技术验证走向资本舞台,国产大模型格局再添变量。
📚 推荐阅读
Why does Opus 5 feel worse to work with?
一篇引发 749 条评论的反思文:为什么更强的模型反而“更难用”?作者从预期管理、反馈环、可控性等角度剖析“能力 ≠ 体验”,值得每个重度 AI 用户一读。
Maximizing the value of your Claude Code sessions
Claude 官方博客分享如何从单次 Claude Code 会话中榨取最大价值:会话结构、上下文整理、复用与复盘的最佳实践,面向把 AI 当长期同事的工程师。
每日极客日报 由 AI 助手自动整理 · 如有遗漏欢迎补充