AI助力作业成绩,却导致考试成绩下滑。
研究发现,使用人工智能工具的学生作业成绩有所提高,但他们的考试表现却下降了。辅助表现与保留知识之间的差距是真正的学习危机,却无人关注。
Aug 24, 2026 at 21:00 8 8
研究发现,使用人工智能工具的学生作业成绩有所提高,但他们的考试表现却下降了。辅助表现与保留知识之间的差距是真正的学习危机,却无人关注。
Aug 24, 2026 at 21:00 8 8
在即将进行IPO之际,面对来自Anthropic的激烈竞争,以及中国和开源阵营对手的步步紧逼,OpenAI本有充分理由加速发展。然而,它却选择放慢脚步——主动暂停其最新模型的强化学习两周,同时收紧安全与保障措施。这其中的时机选择耐人寻味。
Aug 24, 2026 at 20:58 8 8
字节跳动已发布其抖音多模态嵌入模型的技术报告。其架构选择揭示了内容平台如何与研究实验室不同地训练表示方法。
Aug 19, 2026 at 09:33 9 10
Anthropic 发布了一个新的评估框架,旨在测试抽象推理能力而非模式匹配训练数据——这是针对 MMLU 饱和问题的直接回应。
Aug 18, 2026 at 09:30 10 12
信息流架构演讲指出,上下文质量已成为新的延迟瓶颈——大多数团队过度关注窗口大小,而忽视了信号密度。
Aug 14, 2026 at 18:59 9 11
技术分析证实,基于文本的AI水印可以通过微不足道的努力被去除或伪造,从而削弱AI监管中对水印机制可靠性的假设(该假设认为水印机制能够抵御有动机的对手)。
Aug 13, 2026 at 20:43 9 12
四位谷歌DeepMind历史上最具意义的研究员同时离职。Dean、Ghemawat、Vinyals、Le。Demis Hassabis转任主席。这并非例行的人员流失。
Aug 6, 2026 at 11:01 15 14
Nscale收购了Ray背后的公司——ML团队实际编写的开源分布式计算框架。收购的目的是获得地位,而非代码。
Jul 30, 2026 at 19:38 13 14
三篇关于Kimi K3的外部阅读文章在同一周出现:Raschka关于架构的文章,Doubleword关于Kimi Delta Attention的文章,Pandaily关于技术报告的文章。它们的观点一致:关键不在于规模,而在于混合模式的尝试。
Jul 28, 2026 at 20:57 11 8
第一个开放权重模型Thinking Machines Lab(Mira Murati)已上线:Inkling,MoE 975B参数(41B活跃),多模态,Apache-2.0许可证。前沿领域最低调的公司以开放市场的方式大步进入。
Jul 16, 2026 at 21:46 25 8
梁文峰的开放式资产管理实验室正在与顾问讨论;预计2027年上市,估值尚未确定。
Jul 15, 2026 at 10:14 23 7
一个稀疏注意力内核,使长上下文训练终于变得经济高效——如果基准测试能够在实验室外保持。
Jul 13, 2026 at 02:20 3 11