Kimi K3 正式发布:Moonshot 的 2.8T 参数模型从基准测试炒作进入生产阶段
经过数周的基准测试视频后,Kimi K3正式发布。现在真正的考验开始了。
Aug 19, 2026 at 09:34 12 13
经过数周的基准测试视频后,Kimi K3正式发布。现在真正的考验开始了。
Aug 19, 2026 at 09:34 12 13
信息流架构演讲指出,上下文质量已成为新的延迟瓶颈——大多数团队过度关注窗口大小,而忽视了信号密度。
Aug 14, 2026 at 18:59 9 11
GLM-5.3由中国实验室智谱AI推出,专注于编程和网络安全垂直领域,声称在SWE-Marathon基准测试中提升2倍,并在CyberGym评估中位列榜首。垂直专业化竞争正在加速。
Aug 14, 2026 at 18:58 6 7
InfoQ 的一项分析质疑将事件数量作为可靠性代理的惯性思维。那些拥有最佳正常运行时间的团队往往具有最高的事件频率——因为他们正在统计那些真正重要的事件。
Aug 14, 2026 at 18:58 6 6
许多开发者在使用Claude Opus 5时经历主观退步,尽管基准测试保持或提升,这一广泛传播的帖子揭示了这种现象。测量能力与实际感受能力之间的差距正在扩大。
Aug 14, 2026 at 18:58 8 5
一家初创公司正在利用人工智能搜索可能的半导体和散热材料空间。在每芯片1000W的功耗下,热管理正成为数据中心密度的限制因素。
Aug 10, 2026 at 16:30 10 11
OpenAI 的一场 QCon 性能工程演讲揭示了 ChatGPT 延迟目标背后的基础设施决策——以及产品从聊天转向智能体如何颠覆了所有假设。
Aug 9, 2026 at 00:59 11 10
一家针对生产环境中AI模型漂移的初创公司拥有一个简单的前提:模型会变化,工作流程会中断,而这一切直到出现问题时才会被发现。这是当前工具链未能解决的维护问题。
Aug 5, 2026 at 16:40 14 10
中国的光模块制造商和PCB生产商正在报告强劲需求,因为国内AI芯片集群正在扩大规模。正是这层不起眼的基础设施使得华为昇腾集群在无需英伟达的情况下可行——供应链正在形成。
Aug 5, 2026 at 16:39 11 9
中国的CUA首次在OSWorld上超过90%。与美国前沿实验室的差距现在是一个工具差距,而非模型差距。
Aug 3, 2026 at 13:20 13 12
一份指南认为,嵌入式SQLite可以承载真实的生产负载 - 如果你了解WAL/mmap/VFS的调整参数。底层机制以及它无法解决的权衡。
Jul 29, 2026 at 12:46 14 13
Anthropic 官方发布 Claude Opus 5,这是「Fable 5」周期的终极成果——宣布其能力几乎相当,但价格降低了一半。战斗转向定价方面。
Jul 26, 2026 at 18:36 6 8