节俭代币:编码代理账单最终获得仪表板
A Show HN 工具用于比较不同编码代理的令牌成本和缓存未命中影响,与 Meta 的 Mosseri 提出的按工程师令牌上限的提议同期推出——令牌预算上限话题自此有了衡量维度。
Aug 19, 2026 at 22:31 11 14
A Show HN 工具用于比较不同编码代理的令牌成本和缓存未命中影响,与 Meta 的 Mosseri 提出的按工程师令牌上限的提议同期推出——令牌预算上限话题自此有了衡量维度。
Aug 19, 2026 at 22:31 11 14
信息流架构演讲指出,上下文质量已成为新的延迟瓶颈——大多数团队过度关注窗口大小,而忽视了信号密度。
Aug 14, 2026 at 18:59 9 11
一项针对约23,000个Kubernetes集群(AWS/Azure/GCP)的CAST AI研究显示,平均GPU利用率为5%。三家韩国厂商在同一天做出回应。结构性杠杆不仅仅是更多的计算能力,而是更好的计算能力。
Jul 31, 2026 at 12:51 13 10
在Fowler的探索生成式AI系列中,Giles Edwards-Alexander进行了一个小实验:分解一个大函数,并观察AI辅助修改的代币成本变化。现在,你可以用美元来衡量重构带来的杠杆效应。
Jul 30, 2026 at 19:40 16 18
一份指南认为,嵌入式SQLite可以承载真实的生产负载 - 如果你了解WAL/mmap/VFS的调整参数。底层机制以及它无法解决的权衡。
Jul 29, 2026 at 12:46 14 13
Agent Swarm 发布了迄今为止最干净的生产测量:Code Mode 实现了与经典工具循环相比的模型不变 ~99.2% 美元成本降低。Cloudflare(99.9% 代币削减)和 Anthropic(Drive→Salesforce 98.7%)曾承诺过;现在已在真实工作负载上复现。
Jul 23, 2026 at 18:39 6 6
在Reddit上,一位用户报告称已经使用GPT-5.6填补了凸优化领域已知的30年空白。需要认真对待,但也要保持适度。
Jul 19, 2026 at 00:39 12 12
一个稀疏注意力内核,使长上下文训练终于变得经济高效——如果基准测试能够在实验室外保持。
Jul 13, 2026 at 02:20 3 11
一篇病毒式文章质疑微基准测试的可靠性:相同的代码根据符号的顺序、内存位置或用户名的不同,可能会有30%的差异。这对编程有什么影响?
Jul 11, 2026 at 17:14 5 7