OpenAI 的“Astra”模型声称解决了10个开放数学问题——当AI不再只进行基准测试,而是开始进行发现时
内部OpenAI模型据报道解决了十个数学和计算机科学的公开难题。若得到验证,这将是一个质的飞跃:不是在已知测试中取得更好的成绩,而是在人类专家未能成功的领域中产生了新知识。验证过程才是整个故事的关键——这将需要数周而非数天时间。
Aug 25, 2026 at 16:27 7 8
内部OpenAI模型据报道解决了十个数学和计算机科学的公开难题。若得到验证,这将是一个质的飞跃:不是在已知测试中取得更好的成绩,而是在人类专家未能成功的领域中产生了新知识。验证过程才是整个故事的关键——这将需要数周而非数天时间。
Aug 25, 2026 at 16:27 7 8
全球之声报道称,美国的移民政策正在系统性地阻止下一代AI领军人物选择美国作为职业发展地。讽刺的是,这个最投入于AI主导地位的国家,却运行着一个将最有可能构建这一未来的人视为合规问题的移民体系。
Aug 25, 2026 at 16:23 7 5
研究发现,使用人工智能工具的学生作业成绩有所提高,但他们的考试表现却下降了。辅助表现与保留知识之间的差距是真正的学习危机,却无人关注。
Aug 24, 2026 at 21:00 8 8
在即将进行IPO之际,面对来自Anthropic的激烈竞争,以及中国和开源阵营对手的步步紧逼,OpenAI本有充分理由加速发展。然而,它却选择放慢脚步——主动暂停其最新模型的强化学习两周,同时收紧安全与保障措施。这其中的时机选择耐人寻味。
Aug 24, 2026 at 20:58 8 8
麻省理工科技评论认为,关于AI意识的争论是一场无益于任何人的干扰——无论对研究人员、政策制定者还是公众而言。问题本身就出在框架设定上。
Aug 20, 2026 at 22:30 7 10
Google 发布了名为 DiffusionGemma 的技术报告——将扩散模型原理应用于 Gemma 家族。这一挑战自回归大语言模型架构正统的研究方向已实现生产规模的实施。
Aug 20, 2026 at 22:30 9 11
经过数周的基准测试视频后,Kimi K3正式发布。现在真正的考验开始了。
Aug 19, 2026 at 09:34 12 13
Anthropic 发布了一个新的评估框架,旨在测试抽象推理能力而非模式匹配训练数据——这是针对 MMLU 饱和问题的直接回应。
Aug 18, 2026 at 09:30 10 12
中国最好的紧凑型聚变装置计划在2030年前实现商业发电。如果其交付时间接近计划,聚变将不再是一个“还有30年”的故事——能源主权的地缘政治也将迅速变得复杂。
Aug 14, 2026 at 18:58 11 11
研究人员记录了某些x86处理器中未公开的执行功能——一个隐藏的RISC核心在操作系统和虚拟机监控程序下运行,且不对安全监控工具可见。
Aug 9, 2026 at 00:59 10 12
一篇在OpenReview发表的立场论文对AI缩放理论的核心假设提出了挑战:认为推理能力会随着规模的扩大而无限提升。这一论点并不新颖——但其表述方式比以往更为尖锐。
Aug 8, 2026 at 09:58 15 14
中国首次在研发总支出上超越美国,达到6150亿美元。这对人工智能竞争——以及未来十年的技术领导地位——具有重大意义。
Aug 8, 2026 at 09:57 7 9