用价值27美元的智能手表测试Claude:一个周末项目揭示了AI辅助嵌入式开发的真相
一名开发者使用Claude逆向工程并修改了一款售价27美元的智能手表——并记录了整个过程。这一练习是对AI编码辅助在硬件/软件边界处的有效压力测试,在该边界上,幻觉可能产生实实在在的后果。
Aug 20, 2026 at 22:32 9 10
一名开发者使用Claude逆向工程并修改了一款售价27美元的智能手表——并记录了整个过程。这一练习是对AI编码辅助在硬件/软件边界处的有效压力测试,在该边界上,幻觉可能产生实实在在的后果。
Aug 20, 2026 at 22:32 9 10
A Show HN 工具用于比较不同编码代理的令牌成本和缓存未命中影响,与 Meta 的 Mosseri 提出的按工程师令牌上限的提议同期推出——令牌预算上限话题自此有了衡量维度。
Aug 19, 2026 at 22:31 11 14
GLM-5.3由中国实验室智谱AI推出,专注于编程和网络安全垂直领域,声称在SWE-Marathon基准测试中提升2倍,并在CyberGym评估中位列榜首。垂直专业化竞争正在加速。
Aug 14, 2026 at 18:58 6 7
Meta 的开放权重策略又迈出实质一步:推出了一个 300 亿参数的本地模型,能执行多步代理任务,且无需将代码路由至第三方 API。
Aug 10, 2026 at 16:29 13 13
OpenAI 的一场 QCon 性能工程演讲揭示了 ChatGPT 延迟目标背后的基础设施决策——以及产品从聊天转向智能体如何颠覆了所有假设。
Aug 9, 2026 at 00:59 11 10
Wallfacer 是一个开源的终端会话管理器,它封装了 Claude Code 和其他编码代理,让开发者能够从一个界面中编排多个代理会话、持久化上下文并管理并行工作流。
Aug 6, 2026 at 11:00 11 8
TechCrunch测试了OpenAI的新AI键盘。评论者称它对一些程序员来说很有趣,但对其他人来说则有些神秘。OpenAI的硬件推动仍在寻找一个大众市场的形状。
Jul 25, 2026 at 10:27 8 6
Ars Technica 总结了代码代理从业者的观察:上下文策略已经成为真正的杠杆——而不是底层模型。
Jul 20, 2026 at 16:42 9 12
自从几周前开始,代码代理的用户发现他们的每周配额被“随机”重置。这不是一个错误——这是代币配给成为真正产品杠杆的第一个信号。
Jul 19, 2026 at 00:39 10 10
Google区分Gemini 3.5 Pro以提升编码能力。阻止发布前沿版本的指标不再是知识,而是工具使用。
Jul 17, 2026 at 09:19 25 11
OpenAI Codex编码工具开始对提示进行加密,并直接使用密文进行推理。这一变化引发了关于开发者输入的可重复性、可观察性和隐私的问题。
Jul 14, 2026 at 15:44 6 8
一篇文章在HN上广泛传播:到2026年编程,越来越少是生产代码行,越来越多的是在上下文、数据和结构之间进行仲裁。这个学科正在转移。
Jul 12, 2026 at 11:15 4 7