重置
前沿
中国X方音频在图形AI基准测试中领先45%:中国类人压缩再次登顶排行榜
中国X方音频在图形AI基准测试中领先45%:中国类人压缩再次登顶排行榜

X Square特意针对Figure AI发布的机器人操作任务基准进行测试,并声称在该基准上超出45%。结合Wall-B在硬件成本降低70%的情况下实现的排序能力、LimX Dynamics与Figure能力相当,以及Tiangong Omni在工作任务中获得满分,这一模式清晰地表明:中国类人机器人实验室正在进行一场能力-成本压缩竞赛,这与DeepSeek对GPT-4所做的如出一辙。

Aug 25, 2026 at 16:27 8 8

模型与工具
OpenAI 的“Astra”模型声称解决了10个开放数学问题——当AI不再只进行基准测试,而是开始进行发现时
OpenAI 的“Astra”模型声称解决了10个开放数学问题——当AI不再只进行基准测试,而是开始进行发现时

内部OpenAI模型据报道解决了十个数学和计算机科学的公开难题。若得到验证,这将是一个质的飞跃:不是在已知测试中取得更好的成绩,而是在人类专家未能成功的领域中产生了新知识。验证过程才是整个故事的关键——这将需要数周而非数天时间。

Aug 25, 2026 at 16:27 7 8

Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
主题
浏览
信息