数学专业,危:菲尔兹奖得主亲测ChatGPT 5.5 Pro,17分钟出论文级成果
他丢给AI的问题大概是这样的:
给定一个整数集合A,已知它有k个元素(|A|=k),也知道它的二重求和集(简单说就是集合里所有元素两两相加得到的新集合,记为2A)有多少个元素,那A的直径最小能是多少?
这种集合的直径是二次的(简单说就是k个元素的话,直径大概是k²级别),比指数级(2^k)小了不止一个数量级,相当于用精致的小积木精准搭房,空间利用率直接拉满。
https://www.36kr.com/p/3804493080272389
就在刚刚,Claude Mythos把评测干「失效」了:METR第一次测不准,AI攻防拐点到了!AI进化已成「外星文明」降临,超越指数增长,2027 AGI奇点正加速撞向人类。
https://www.36kr.com/p/3804517800959747
==========================
现在的AI已经不是我们普通人认为的擅长聊天的小聪明话痨,它已经是真正的大神了,人类非但教不了它,还没能力考核它,它的能力对人类来说就是深不见底。
之所以大众对AI的能力认识不足,缺乏危机感。那是因为我们用的AI都是免费体验版,和真正的全能力付费版是有天壤之别的。而且最高级的AI是一般人付费也用不了的,它们只对关键要害部门,或核心人员开放,比如文中的菲尔兹奖得主。这就像顶级的藏书楼或博物馆藏物会向傻有钱的暴发户们开放吗?