码农早餐 · 2026-08-25
今日头菜:28家免费层叠成一个API,月供4B token的野路子。另有 6 条快讯:CUDA 登陆 RISC-V 路线图确认,Hot Chips 2026 见真章;一次 JIT 编译压进 5 微秒,代价是放弃通用性;等。
早安。今天最值得盯的是 Claude 插件市场正式开张,Agent 技能库破千,生态一下子热闹起来了。另外 GPT-5.6 官宣降价到 11 月 21 日,想省钱的可以盘算盘算。
28家免费层叠成一个API,月供4B token的野路子
GitHub上出现一个叫freellmapi的开源项目:把28家LLM提供商的免费额度(合计约每月40亿token)堆到同一个OpenAI兼容的/v1接口后面,自带智能路由、自动故障切换和密钥加密。作者明说仅供个人实验。对写代码的人来说,这玩意儿适合做原型验证或跑批量测试,省下真金白银;但免费层通常限速限流,别指望它扛生产流量,也别把敏感数据喂进去——密钥加密不代表服务商不看你的请求。
💡 主厨说:想省API钱,先拿它跑几天批量任务,摸清各家免费层的真实速率和稳定性,再决定要不要接进自己的工具链。
来源:
CUDA 登陆 RISC-V 路线图确认,Hot Chips 2026 见真章
Hot Chips 2026 的议程里出现了一个让架构圈坐不住的消息:CUDA 将正式瞄准 RISC-V。Chips and Cheese 的 Chester Lam 撰文确认了这一路线。对写代码的人来说,这事短期内不用改你的编译命令,但长期值得盯——如果 CUDA 生态真能在 RISC-V 上跑通,意味着未来做异构计算时,你手里的硬件选择不再被 x86 和 Arm 锁死。不过目前公开信息只有这一条议程确认,具体支持到哪个 CUDA 版本、性能如何,都得等 2026 年大会上的实际演示。
💡 主厨说:先别急着给 RISC-V 板子装 CUDA 工具链,但可以开始留意 RISC-V 向量扩展的生态动态,明年评估新硬件时多一个参考维度。
来源:
一次 JIT 编译压进 5 微秒,代价是放弃通用性
malisper.me 上这篇技术文章展示了如何把 JIT 编译耗时压到 5 微秒。这个数字比常见 JIT 启动时间快了几个数量级,但关键在于它的实现路径:针对特定场景做极致优化,而不是通用方案。对写编译器、搞性能优化的开发者来说,值得点开看作者怎么在预热、缓存和代码生成上做取舍;对普通业务开发者,这属于知道有这么回事即可,别指望直接套用。
💡 主厨说:读这类极限优化文章,先问一句它牺牲了什么——往往比它省下的时间更有价值。
来源:
Anthropics 官宣 Claude 插件市场,Agent 技能库破千
Anthropics 在 GitHub 上线了 Claude 插件社区市场,定位是 Claude Cowork 和 Claude Code 的插件分发渠道,目前是只读镜像,提交插件需走 clau.de/plugin-directory-submission。同期 VoltAgent 整理了一份超 1000 条 Agent 技能的合集,兼容 Claude Code、Codex、Gemini CLI、Cursor 等主流工具。对写代码的人来说,插件市场意味着 Claude Code 的扩展生态开始正规化,以后找工具不用再翻散落的 GitHub 仓库;技能库则像一本现成的操作手册,能直接抄作业。但注意市场还是只读的,别指望马上能一键安装。
💡 主厨说:翻翻那份技能库,挑三个最贴近你日常工作的,明天写代码时各试一次,比收藏一百个强。
来源:
GPT-5.6 官宣降价,至少优惠到 11 月 21 日
OpenAI 在官方定价页更新:GPT-5.6(代号 Sol)价格下调,优惠期至少持续到 11 月 21 日。具体降幅未在公告中写明,但既然官方主动挂出"price reduction"并给了明确截止日,大概率不是象征性调整。手头有批量调用 GPT-5.6 的脚本或服务的,现在去查一下账单模型单价,趁优惠窗口把缓存策略、批量任务排期重新算一遍,能省一笔是一笔。优惠结束后价格是否回调,官方没说,别把预算模型建立在永久降价上。
💡 主厨说:翻一下这个月的 API 账单,把跑得最勤的那个 GPT-5.6 任务挪到 11 月 21 日前批量执行,省下的钱够买两杯好咖啡。
来源:
IPFS维护者陆续退场,分布式存储的船要沉了?
IPFS Shipyard 发布公告,称维护者正逐步退出项目。这个曾被视为颠覆 HTTP 的分布式存储协议,如今核心团队开始收缩战线。对普通开发者来说,短期影响有限——IPFS 的公共网络还在跑,但长期依赖 IPFS 做存储底座的团队该评估迁移成本了。公告没给具体时间表,但维护者流失通常意味着迭代放缓、安全补丁变慢。如果你正在用 IPFS 存 NFT 元数据或静态资源,建议关注官方后续的维护计划,提前想好备用方案。
💡 主厨说:别急着迁移,先查一下你的项目依赖 IPFS 的哪些具体功能,把可替代方案列个清单,等真出问题时不用慌。
来源:
SpaceX联手英伟达,太空AI算力明年Q4入轨
马斯克在X上宣布,SpaceX与英伟达合作设计了一款针对太空优化的Vera Rubin NVL72系统,计划明年第四季度发射入轨,2028年大规模部署。这套系统本质上是把英伟达下一代AI服务器搬进卫星,解决太空环境下的散热、辐射和功耗问题。对写代码的人来说,这意味着未来太空边缘计算会跑主流AI框架,但当前没有公开API或开发套件,短期不用改代码,可以留意后续是否开放模拟环境或测试平台。
💡 主厨说:想尝鲜的可以盯着英伟达的太空计算SDK,但别急着为太空场景重构模型,等硬件真上天再说。
来源:
今天不妨挑一件顺手的事试试,比如把那个免费 API 叠层用起来,或者给 Claude 装个插件。明早见。
本期从过去 24h 的 X / Hacker News / GitHub Trending 共 69 条信息中挑出 7 条(全天逐小时采写、经事实校对后于晨间选编)。内容由 LLM 辅助生成,每条均附原始来源链接,重要决策请交叉验证。
喜欢这篇?订阅每日推送
每天 8:00 帮你挑好 AI 圈最重要的 5-10 条,说人话、看得懂、不浪费时间。
本页内容由 LLM 自动聚合 + 解读生成,每条均有原始来源链接,建议交叉验证。