码农早餐 · 2026-08-13
今日头菜:SQLite 16年潜伏bug撂倒Tailscale,数据库直接损坏。另有 6 条快讯:DeepSeek V4 Pro 0813 低调上线,OpenRouter 热度冲到 667;Qwen 发布 2.4T 参数 MoE 模型,激活仅 95B;等。
早安。今天数据库圈子动静不小:SQLite 那个潜伏16年的bug直接把Tailscale干趴了,提醒我们底层稳定比什么都重要;另一边pg_clickhouse把TPC-H提速千倍,倒是值得一试。
SQLite 16年潜伏bug撂倒Tailscale,数据库直接损坏
Tailscale 这周把数据库损坏的锅甩给了一个 16 年前的 SQLite 老 bug。问题出在 WAL(预写日志)重置机制上——在特定条件下,SQLite 会把 WAL 文件重置到错误的位置,导致已提交的数据凭空消失,数据库直接损坏。这不是新引入的缺陷,而是从 SQLite 3.7.0 时代就存在的历史遗留问题,一直潜伏到现在才被触发。
对写代码的人来说,这事的冲击力在于:你用了几十年的数据库,可能藏着你根本不知道的雷。SQLite 是全球部署最广的嵌入式数据库,手机、浏览器、嵌入式设备都在跑。这次触发条件极其刁钻——需要特定版本、特定文件系统、特定崩溃时机叠加才能命中。大部分项目一辈子碰不上,但一旦碰上就是数据丢失级别的灾难,不是报个错重启就能糊弄过去的。
历史上有个几乎一模一样的对照:2018 年 PostgreSQL 也发现过一个隐藏了 15 年的 WAL 相关 bug,同样只在极端崩溃恢复场景下触发。两次事件都说明同一件事——数据库的可靠性承诺,永远建立在「你还没踩到那个特定路径」的假设上。Tailscale 这次能定位到根因,靠的是严谨的崩溃复现和二分排查,这活儿没有捷径。
16 年没人发现的 bug,不代表不存在,只代表还没人踩中触发条件。 对普通开发者,最实际的启示是:即使你信任 SQLite 的稳定性,也要定期做恢复演练,别等数据真丢了才想起备份策略。Tailscale 给出的修复方案是升级到修复版 SQLite 并重刷 WAL,但前提是你得先知道自己中招了——这本身就是个难题。
💡 主厨说:翻翻你项目的 SQLite 版本,如果落在受影响区间,先升级再等触发;顺便检查下备份恢复流程,别让「应该没事」变成「早知道」。
来源:
DeepSeek V4 Pro 0813 低调上线,OpenRouter 热度冲到 667
DeepSeek 在 8 月 13 日悄悄发布了 V4 Pro 0813 版本,没有发布会、没有公告,只在 API 文档里更新了模型标识。OpenRouter 上该模型的讨论热度冲到 667,Hacker News 上也有 78 条跟帖,说明开发者已经注意到了。目前官方文档只给了模型名称和接入方式,没有公布性能基准或价格调整。对写代码的人来说,这更像一次常规迭代——如果手头项目在用 DeepSeek API,可以切到新版本跑一遍现有测试,观察输出质量和延迟变化;如果没在用,暂时不需要专门跟进。真正的看点在于,DeepSeek 选择静默更新而非高调宣传,这种节奏本身值得留意。
💡 主厨说:把现有 prompt 集跑一遍新旧版本对比,比追任何发布会都实在。
来源:
Qwen 发布 2.4T 参数 MoE 模型,激活仅 95B
Qwen 在 Hugging Face 上发布了 Qwen3.8-2.4T-A95B,总参数量 2.4 万亿,采用 MoE 架构,每次推理只激活 95B 参数,同时放出 FP8 量化版。对开发者来说,这意味着在消费级显卡上跑超大模型又多了一个选择——95B 激活量配合 FP8,单卡 24GB 显存有机会跑起来,但 2.4T 的总权重文件体积巨大,下载和存储成本得先掂量。目前模型卡已上线,权重可用,具体 benchmark 和许可证细节还没铺开,想尝鲜的可以先去 Hugging Face 看一眼。
💡 主厨说:先查许可证再决定要不要集成,Qwen 系列商用条款不同版本差异不小,别等上线了才发现白干。
来源:
pg_clickhouse 0.10 发布:子查询下推,TPC-H 提速千倍
pg_clickhouse 发布 v0.10 版本,核心更新是子查询下推(subquery pushdown),官方称 TPC-H 基准查询速度提升达 1000 倍。对于在 PostgreSQL 里跑分析型查询、或者想把 ClickHouse 当加速引擎接进来的开发者,这个版本值得关注——子查询下推意味着更多复杂查询能直接下推到 ClickHouse 执行,不用在 PG 侧做笨重的中间处理。不过 1000 倍是特定基准下的峰值,实际收益取决于你的查询模式和数据集规模,建议拿自己的慢查询先跑个对比测试。
💡 主厨说:拿你线上最慢的三条分析查询,在 pg_clickhouse 0.10 上跑一遍对比,比看任何 benchmark 都实在。
来源:
Grok 4.6 上线,马斯克称性价比惊人,评测 61 分
xAI 今天发布 Grok 4.6,马斯克连发火箭表情,强调“聪明、快、性价比惊人”。Artificial Analysis 的智能指数给它打了 61 分,这个分数放在当前第一梯队里不算拔尖——Claude、GPT 系列头部模型都在 70 分上下。对写代码的人来说,61 分意味着它能处理常规任务,但复杂架构设计、长链路调试别指望它一步到位。宣传口径说“amazing bang for buck”,实际值不值,得等 API 定价出来再算账,别被首发热度带着走。
💡 主厨说:等 API 价格公布后,拿你项目里最头疼的一段重构试试它,别用现成 benchmark 下结论。
来源:
14MB 模型跑进手机手表,cactus-compute 开源 needle
GitHub 趋势榜上冒出个 cactus-compute/needle,号称 14MB 的基础模型,目标设备是手机、穿戴、智能家居和机器人。14MB 什么概念?比一张高清头像还小,常规大模型动辄几个 GB,这体积差了上百倍。对写嵌入式和端侧代码的人来说,这可能是把模型塞进单片机或低功耗芯片的一条新路。但注意,仓库热度 346 star,还处于早期,宣传里没给 benchmark 或精度对比,别急着当生产方案用,先看它跑什么任务、效果如何再说。
💡 主厨说:想尝鲜的话,拉下来跑个 demo 不亏,但别指望它替代正经模型,先摸清它擅长啥。
来源:
deep_think 工具被曝泄露隐藏思维链,OpenAI 与 Anthropic 双双中招
一条来自安全研究员 can1357 的推文称,给 OpenAI 和 Anthropic 的模型提供 deep_think 工具时,会触发隐藏的 CoT(思维链)泄露。这意味着模型内部推理过程可能被外部工具诱导输出,对依赖 API 做敏感推理的开发者是个提醒:别假设供应商的思维链保护万无一失,关键逻辑校验得放在自己这边。目前只是单条推文爆料,具体复现条件和影响范围还没公开,先别急着下结论,但值得跟进。
💡 主厨说:想验证的开发者可以拿自己的 API key 试一下 deep_think 工具,但注意别在生产环境里跑敏感数据。
来源:
今天最该记住的是:别迷信版本号,动手跑一遍自己的场景,比任何宣传都靠谱。明早见。
本期从过去 24h 的 X / Hacker News / GitHub Trending 共 67 条信息中挑出 7 条。内容由 LLM 辅助生成,每条均附原始来源链接,重要决策请交叉验证。
喜欢这篇?订阅每日推送
每天 8:00 帮你挑好 AI 圈最重要的 5-10 条,说人话、看得懂、不浪费时间。
本页内容由 LLM 自动聚合 + 解读生成,每条均有原始来源链接,建议交叉验证。