< Back to articles
ARTICLE.SYS
AI DAILY

AI 动态日报 · 2026-08-16(周日)

今天最该知道的一件事:DeepSeek 新价目今晚零点(北京时间)生效——全线上调、峰谷双轨,错峰能省一半。

《AI 动态日报》是 Sway Lab 每天早上做的简报:抓取当天的 GitHub、Hacker News、arXiv、Hugging Face 等一手来源,筛出十条最值得读的,原样公开。它首先是写给 Sway 本人看的,所以文中的「你」指的是他。

今天最该知道的一件事:DeepSeek 新价目今晚零点(北京时间)生效——全线上调、峰谷双轨,错峰能省一半。

Top 10

1. DeepSeek 涨价表全公开,今晚 24:00(北京时间)生效:峰时输出价 4.5 倍,缓存命中价最高 12 倍 · 产品 / 官方发布 · 中文圈 · HN 238 pts,官方 api-docs 价格页已挂出新表,生效时刻 2026-08-16 16:00 UTC(北京时间 8/17 00:00) 08-13 报过 V4-Pro 正式版发布,今天的新进展是涨价表全文公布且今晚生效。官方数字(每百万 token):V4-Pro 输出 $0.87 → 峰 $3.96 / 谷 $1.98;缓存未命中输入 $0.435 → 峰 $1.32 / 谷 $0.66;缓存命中 $0.003625 → 峰 $0.044(12.1 倍,涨幅最大的一格)。V4-Flash 输出 $0.28 → 峰 $1.32 / 谷 $0.66。峰时段是 01:00–04:00 和 06:00–10:00 UTC,即北京时间 9:00–12:00 和 14:00–18:00,其余全是半价谷段——午休 12–14 点也算谷段。 为什么值得注意:08-13 那天的判断「1M 窗口配低价,压缩可能不值得做了」要整个反过来重算——峰时价格下,你在 hermit-agent 里省 token 的那些活儿又值钱了;批量任务全部挪到谷段是今天就该做的事。 🔗 https://api-docs.deepseek.com/quick_start/pricing (价格表原文)· 公告 https://api-docs.deepseek.com/news/news260813/ · HN https://news.ycombinator.com/item?id=49296627

2. OpenAI 预览 Ultrafast:GPT-5.6 Sol 跑在 Cerebras 晶圆级芯片上,750 token/秒、最高 14 倍速 · 产品 / 官方发布 · HN 705 pts / 276 条评论(Cerebras 技术博文),OpenAI 官方 2026-08-13 发布 OpenAI 给 API 加了一个新服务档:同一个 GPT-5.6 Sol,跑在 Cerebras 晶圆级引擎(权重全存片上,不走片外显存)上,厂商口径 750 输出 token/秒、最高为标准档 14 倍。目前是小范围预览(编码、金融研究、语音、电商几类客户),没有公布价格和正式上线时间。 为什么值得注意:agent 循环的瓶颈从来不是单轮质量而是轮次延迟——14 倍输出速度意味着「一次长时任务里塞多几倍的自我检查轮」从奢侈变成可行。值得留意后续定价:速度档如果贵得离谱,这条路线就只对交互场景成立。 🔗 https://openai.com/index/previewing-ultrafast/ · Cerebras 侧技术细节 https://www.cerebras.ai/blog/accelerating-gpt-5-6-sol-ultrafast-with-openai

3. OptMem:Victor Taelin 出手的 agent 永久记忆——426 token 的 prompt 加一个单文件脚本 · 仓库 · 1,254 stars / 82 forks(2026-07-25 建仓,三周攒到这个数),Python,无依赖 HVM/Bend 作者 Victor Taelin 的极简记忆方案:一段 426 token 的 prompt 贴进 CLAUDE.md,一个单文件 Python 工具管存取。设计极克制:LOG.txt 追加式记录(每条一行、280 字节上限、永不编辑),TREE/ 是可重建的摘要缓存,memo wake 开局读记忆、memo nap 处理到期的归并,没有任何后台进程。定长记录让位置即身份,一百万条记忆(608MB)时 wake 只要 0.03 秒;WAKE_LINES 是读取预算不是存储预算,随时改、不重算。 为什么值得注意:这和你 session-memory-skill 是同一个问题的另一个解,而且立场相反——你走索引+按需取,他走「append-only 日志 + 分层摘要树」。memo nap 的「归并到期才做、一次一个」的懒合并设计特别值得抄。 🔗 https://github.com/VictorTaelin/OptMem

4. agent-safe-pipeline:「让 agent 提议,让策略拍板」的授权边界参考实现 · 仓库 · 444 stars / 58 forks,2026-08-13 建仓(3 天),TypeScript,Apache-2.0,昨夜仍在推送 把「agent 不得给自己的动作授权」做成了可跑的参考架构:agent 产出不可变意图(immutable intent)→ 独立决策服务给出 ALLOW / ESCALATE / BLOCK → SafeExecutor 持有下游凭据执行,人类审批(Presence)只出具收据、由决策服务复核。硬约束写得很清楚:规范化意图哈希短时过期、授权单次消费且绑定意图+决策+受众+有效期、网络错误一律 fail closed。带四个可跑示例,其中一个就是「被治理的 MCP 工具」的 stdio 真实现,附威胁模型文档。 为什么值得注意:这正是你 hermit 权限层缺的那块骨架——「凭据只存在于受信执行器之后、agent 只能提交提案」这套不变量,比你现在靠 permission mode 挡一层要结构化得多。README 自带 five-minute demo。 🔗 https://github.com/decionis/agent-safe-pipeline

5. 《AI 不是比数学家会想,是比数学家能记》 · 理念 / 争论 · HN 403 pts / 355 条评论(今日全站第一),Davide Piffer,2026-08-04 发表,今天被顶上首页 论点一句话:AI 解数学题的关键优势可能不是更强的推理,而是一块几乎无限的外置符号工作记忆——人类同时只能在脑中保持几个陌生元素(心算两个三位数相乘难就难在保存中间结果),模型却能把整个题面、几百条中间等式、几条放弃的路线全部留在上下文里。我们习惯把成绩归因给「推理变强」,但其中一部分可能只是解除了生物学限制。 为什么值得注意:把「上下文窗口 = 工作记忆」当工程事实接受,结论就很锋利:agent 能力上限由记忆架构决定,上下文工程不是省钱的抠门活,是在设计认知器官。这是今天最值得你写一篇的素材。 🔗 https://davidepiffer.com/p/ai-isnt-outthinking-mathematicians · HN https://news.ycombinator.com/item?id=49312845

6. 232 倍加速的 QR 核函数:一份 codex 自动研究(auto-research)的完整实录 · 理念 / 方法论 · HN 391 pts / 86 条评论(今日前二),sankalp 2026-07-08 发表,今天上首页 GPU Mode 办的自动研究主题赛:用 agent 自动迭代 CUDA 核函数实现批量 Householder QR 分解。作者拿到 183 人中第 12 名、对基线 232 倍加速,全文复盘方法:官方 popcorn CLI 让 agent 能自己测试、跑分、提交排行榜;他管这套叫「loop engineering」——学到的最值钱一课是靠「想法多样性」跳出局部最优(让模型并行提不同路线,而不是在一条路线上磨),以及人类的作用收敛成「学到刚好够问出更好问题」的程度。 为什么值得注意:这是「拿 benchmark 反馈闭环喂 agent」的一手工程记录,你在 skill 家族里做回归用例驱动进化,可以直接对照他的 loop 结构抄细节。 🔗 https://sankalp.bearblog.dev/autoresearch/ · HN https://news.ycombinator.com/item?id=49309549

7. Intern-S2-Preview:书生系的「科研 agent 基座模型」 · 论文 · 中文圈 · arXiv 2608.13505,2026-08-13 提交 · Hugging Face Papers 43 upvotes,Lei Bai 等(上海人工智能实验室一脉的 Intern/书生家族) 定位是 scientific agentic foundation model:面向多模态科学理解、工具交互和长时程任务。训练管线值得看:科学多模态预训练(渲染过的科学文献 + 图文交错语料)之后,统一后训练 = SFT + 可扩展多任务 RL + 黑盒与白盒两种 agentic RL + on-policy 蒸馏。 为什么值得注意:「黑盒/白盒 agentic RL 分开做」这个拆法对应你很熟的问题——工具内部可见(白盒)和只有观测返回(黑盒)的任务,训练信号根本不该混在一起。论文里这套分法可以借来整理你 eval 的分类维度。 🔗 https://arxiv.org/abs/2608.13505 · HF https://huggingface.co/papers/2608.13505

8. dsh-TUI:DeepSeek Harness 缺终端界面,中文社区三天补了一个 · 仓库 · 中文圈 · 1,266 stars / 54 forks,2026-08-13 建仓(3 天),今晨仍在推送,TypeScript,MIT,已被 DSH 官方公众号收录 08-14 头条 DeepSeek Harness 的生态后续:官方没有 TUI,这个插件补位——Claude Code 风格全屏交互,思考流式展开、双击 Esc 时间回溯、上下文进度条 + TPS 仪表,零核心改动、纯插件挂载,npm 一键装。README 简体中文为主,34 个 open issue 在快速消化。 为什么值得注意:印证了 08-14 判断的「DSH 一切皆插件」策略正在起作用——官方缺口被社区当天填上并被官方收编。想摸 DSH 插件 API 的形状,读这个仓库比读文档快。 🔗 https://github.com/ccch1mneyyy/dsh-TUI

9. pi-from-scratch:600 行 TypeScript 手撕一个 coding agent,配可断点的在线读本 · 仓库 · 中文圈 · 1,007 stars / 69 forks,2026-08-09 建仓(7 天),TypeScript,MIT 沿着 pi 的数据流拆解,删工程细节、留核心思想,产出 nano-pi:能读文件、改代码、执行命令。形式是亮点:网站把文章和编辑器摆在一起,读到哪、右侧代码补全到哪,还带 Trace 断点逐行过执行流。跑 nano-pi 只要 Node 22 + 任一 OpenAI 兼容 API。 为什么值得注意:你要写「agent 循环到底是什么」的科普时,这是现成的中文教学参照;它对 pi 的取舍(留什么删什么)本身就是一份「harness 的最小充分结构」清单。 🔗 https://github.com/SaladDay/pi-from-scratch · 在线读 https://pi-from-scratch.vercel.app

10. ThoughtDAG:把 LLM 对话从线性流改成可编辑的思维图 · 产品 · Show HN 111 pts / 51 条评论(08-14)· 仓库 180 stars,React 19 + TypeScript,MIT,带桌面版 无限画布上让对话长成 DAG(有向无环图):在 PDF 里选一段发问、删掉一条噪声边重新生成干净回答、按语义层级缩放出全景图。自带备份导出,模型用你自己的 key。README 有中文版。 为什么值得注意:「删一条边 = 从上下文里移除一段依赖」是把上下文工程做成了直接操作(direct manipulation)的 UI——你在 hermit-ui 里琢磨的会话分叉/剪枝,这里有一份可玩的交互原型。 🔗 https://github.com/chenxiachan/thoughtdag · Show HN https://news.ycombinator.com/item?id=49307700

快讯(5 条)

今天可以亲手试的

  1. 把你的批量任务挪出 DeepSeek 峰时段 打开 https://api-docs.deepseek.com/quick_start/pricing 核一眼新表;如果有走 DeepSeek 的 cron/批量任务,把执行时间挪到北京时间 18:00 之后或 12:00–14:00(谷段半价)。再用上月用量乘一遍新价,看涨了多少。 · 约 10 分钟 · 依据:Top 10 第 1 条

  2. 给一个测试 agent 装 OptMem 先读一遍安装脚本再跑:curl -fsSL https://raw.githubusercontent.com/VictorTaelin/OptMem/main/install.sh | less,确认无异动后执行安装,把它打印的 ## Memory 块贴进一个非生产 agent 的 CLAUDE.md,试 memo note / memo wake 一轮。 · 约 10 分钟 · 依据:Top 10 第 3 条

  3. 跑 agent-safe-pipeline 的五分钟演示

    git clone https://github.com/decionis/agent-safe-pipeline.git
    cd agent-safe-pipeline && pnpm install --frozen-lockfile
    pnpm --filter @decionis/agent-safe-example-basic demo
    

    重点看 examples/mcp-tool-gate——被治理的 MCP 工具怎么把「提议」和「授权」拆开。 · 约 15 分钟(需 Node 22.14+ 和 pnpm 9) · 依据:Top 10 第 4 条