网易首页 > 网易号 > 正文 申请入驻

代码碾压一切!OpenAI神秘模型o3-alpha一夜刷屏,却遭41岁大神绝地反杀

0
分享至

新智元报道

编辑:定慧 好困

【新智元导读】OpenAI的神秘模型o3-alpha意外曝光,其强大的代码能力碾压众多AI。该模型疑似在东京AtCoder世界编程大赛2025中夺得亚军,最终不敌人类选手Psyho。

OpenAI果然藏了一手。

昨天夜里,一个名为「o3-alpha-responses-2025-07-17」的神秘模型被爆出。

网友们疯狂测试后,得出一致结论,这个模型强得离谱

WebDev Arena网页的源码

甚至有网友在实测后,大赞o3-alpha,将它称为目前「最佳编码和物理模型」

每次新模型出来后,小球的碰撞实验已经成为一种「传统」,这次「o3 Alpha」不仅完美的展示了物理碰撞,并且还能随时改变小球的大小。

在WebDev Arena上,「o3-alpha-responses-2025-07-17」以「Anonymous-Chatbot」的名称出现。

根据网友的猜测,它很有可能是在编码能力上得到了「史诗级」加强的o3升级版。

毕竟目前在WebDev Arena Leaderboard中,OpenAI只有一款专门编程的GPT-4.1-2025-04-14上榜。

不过,目前想要捕捉到这个匿名模型,需要在竞技场中多次尝试(我们在WebDev Arena多次尝试未能捕捉到这个匿名模型)。

Peter Gostev在竞技场中使用如下提示词「幸运的」捕捉到了o3-alpha,感兴趣的话你也可以试试。

还有网友爆出,OpenAI可能「派出」了这个模型去参加世界最难编程竞赛:东京举行的AtCoder世界巡回赛2025决赛。(需要OpenAI确定)

OpenAI的这个o3-alpha模型最终获得了第二,第一名是人类Psyho。

虽然o3-alpha可能已经被OpenAI下架,但网友们还是保留了丰富的实测案例。

从实测来看,「o3-alpha」在前端代码能力达到了领先水平——远胜于Claude Sonnet、o3、Gemini 2.5 Pro。

实测效果惊人

网友Peter Gostev发现该模型后,使用提示词「要求模型使用Three.js创建一个程序生成的星球」。

测试后,他很难相信,但是依然认为o3-alpha的编码水平达到一个全新的高度。

以下是完整的测试对比视频,可以看出o3-alpha的效果整体最好。

OpenAI模型在前端能力方面一直表现平平,Peter表示这次的模型似乎终于在这方面超越了其他所有模型。

有网友用经典的「骑自行车的鹈鹕」进行了测试,表示o3 alpha完全打败了o3 pro。

以下是o3 alpha生成的动画版的效果,你觉得这个效果如何。

o3-alpha还能一句话就生成的「我的世界」模拟器。

超mini版GTA的复刻,o3-alpha也能一句话搞定。

还能一键生成高度可定制的SVG应用。

有网友用o3-alpha造了一个魔方模拟器,甚至可以输入「魔方算法」来直接操控,确实太强大了。

仅仅靠着文字提示就可以实现。

网友还用o3-alpha创建了一个太空入侵模拟游戏,再次体现了OpenAI这个新模型的前端代码能力。

网友Mahi用只有2-3个单词的提示对比了o3-alpha和Gemini 2.5 Pro。

o3-alpha生成的网页效果要好于Gemini 2.5 Pro。

除了以上神秘的o3-alpha模型和OpenAI派出AI选手参与顶尖编程大赛外。

刚刚发布的ChatGPT Agent也实力惊人。

OpenAI的研究院Zhiqing Sun,表示ChatGPT Agent通过了ARC-AGI-3的第一关。

41岁大神击败AI

守住人类最后防线

o3-alpha被爆出的时机非常的「巧合」。

因为前两天在东京举行的AtCoder世界巡回赛2025决赛中,同样是OpenAI的一款匿名模型,获得了第二名。

根据网友爆料,这个模型很大概率就是o3-alpha。

我们推测OpenAI本来应该是打算「一鸣惊人」,但有一个名叫Psyho的人类戏剧性的打败了AI获得了第一名。

是的,这位来自波兰的编程大神——Przemysław Dębiak(aka Psyho),用一场惊心动魄的胜利告诉世界:人类,还没输!

地点是东京,AtCoder世界编程大赛的决赛现场。

空气中弥漫着紧张的气息,因为这次的对手非同寻常——一个由OpenAI亲自下场派出的AI模型。

在这里,人类和AI选手需要在10小时内,不断优化墙壁的设置以及机器人的分组,让它们能够在30x30的网格内以最少的步数回家。

从华沙一路飞到东京的「Psyho」,本来就已经身心俱疲。

而这场堪称马拉松的比赛,更是让他愈发感觉自己已经濒临极限。

「我累到爆炸,真的,有好几次我都想直接放弃算了,」他回忆道。

三天里,「Psyho」只睡了10个小时。

而他的对手,那个「不知疲倦」的AI,早已能够在诸如算法实现、代码优化等纯粹的工程任务中,凭借着更快地速度碾压人类。

不过,这次的比赛,是人类的主场。

原因在于,比赛时间越长,就越考验从零到一的创造性,AI就会越吃力。

  • 比赛一开始,AI很快就以绝对优势实现领先;

  • 直到第7小时,一步步稳扎稳打的大神「Psyho」才实现反超,而AI却陷入了困境;

  • 第8小时,AI突然发现了一个全新的思路,并一举超越了「Psyho」——新方法不仅实现了更好的墙体设计,还带来了更好的资源调度;

  • 即将进入倒计时阶段,剧情再次反转。「Psyho」灵感乍现,对AI完成了绝地反杀!虽然AI还在不断调整,但差距却越来越大。

最终,这个41岁的男人,成功在长达10小时鏖战的最后关头,凭借着血肉之躯和人类独有的创造力,战胜了冰冷的机器!

对于这场胜利,奥特曼亲自发文祝贺道:「干得好,Psyho。」

与此同时,OpenAI官方也发文表示:「我们的模型拿了第二。恭喜冠军,这次你成功地阻击了我们!」

更有趣的是,比赛的组织者都惊呆了。

他们坦言:「我们本来就觉得人类会赢,但说实话,我们被AI能拿到第二名给吓到了!」

他们一针见血地指出:「在代码优化的硬实力上,AI已经超越了人类,但它唯独缺少了人类那神来之笔的创造力。」

没错!「Psyho」赢得不靠蛮力,而是靠一个「完全不同的解题思路」。

当所有人都和AI在同一条赛道上狂奔时,他另辟蹊径,找到了AI视野之外的「最优解」。

而他用的武器也很简单,就是最常规的编程软件,连AI辅助工具都没用。

当然,这只是一场战役的胜利,远非「人·机」大战的结束。

从IBM「深蓝」到谷歌「AlphaGo」,AI战胜人类的传奇早已上演。奥特曼也预言,AI很快就会在编程竞赛中全面超越人类。

但至少在东京的那个不眠之夜,一位名叫「Psyho」的孤胆英雄,为人类赢得了一丝喘息。

参考资料:

https://x.com/chetaslua/status/1946154816691966227

https://x.com/chetaslua/status/1946165458048291091

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
央视春晚第三次联排!近十年最强阵容,网友:今年春晚总算有救了

央视春晚第三次联排!近十年最强阵容,网友:今年春晚总算有救了

杨仔述
2026-01-31 18:16:31
天助阿森纳:0-1,英超第3遭10人英超第8掀翻,3连胜终结,差榜首7分

天助阿森纳:0-1,英超第3遭10人英超第8掀翻,3连胜终结,差榜首7分

侧身凌空斩
2026-02-02 00:11:44
4377亿市场洗牌!又一户外巨头跌落神坛被抛弃了?中产:新欢来了

4377亿市场洗牌!又一户外巨头跌落神坛被抛弃了?中产:新欢来了

品牌观察官
2026-01-30 17:59:31
杨旭:里皮率恒大拿捏日本?他们好球员都出国了 日本足球没到头

杨旭:里皮率恒大拿捏日本?他们好球员都出国了 日本足球没到头

风过乡
2026-02-01 21:23:28
数名医生提醒:只要做过肠息肉切除手术,术后患者一定关注这6点

数名医生提醒:只要做过肠息肉切除手术,术后患者一定关注这6点

健康科普365
2026-01-31 15:08:00
什么是性成瘾?患者自述:比烟瘾、酒瘾厉害多了,比戒毒还难

什么是性成瘾?患者自述:比烟瘾、酒瘾厉害多了,比戒毒还难

泠泠说史
2025-10-30 15:20:45
出大事了?中国突然收到“求救”信号,外交部火速回应,信号强烈

出大事了?中国突然收到“求救”信号,外交部火速回应,信号强烈

通鉴史智
2026-01-31 19:18:29
杭州土皇帝虞关荣:一顿饭40万,四年敛财40亿

杭州土皇帝虞关荣:一顿饭40万,四年敛财40亿

让生活充满温暖
2026-02-01 04:42:05
山西一演唱会取消!

山西一演唱会取消!

朔州那些事儿
2026-02-01 18:07:34
北京阿姨通透,把十几年来买的金条全卖了,称:涨了不卖留着干啥

北京阿姨通透,把十几年来买的金条全卖了,称:涨了不卖留着干啥

我心纵横天地间
2026-02-01 13:18:57
起风了,军权刚到手,委代总统就收命令,立即驱逐中方外交官?

起风了,军权刚到手,委代总统就收命令,立即驱逐中方外交官?

吴欣纯Deborah
2026-01-31 18:15:06
山东可以包分配的4所大学,学生毕业就有工作,完全不用担心就业

山东可以包分配的4所大学,学生毕业就有工作,完全不用担心就业

高三倒计时
2026-02-01 17:31:15
人民日报:坚持八个好习惯,越活越年轻不是难事

人民日报:坚持八个好习惯,越活越年轻不是难事

洞见
2026-01-29 20:31:40
万人求出处的网红正式下海!

万人求出处的网红正式下海!

吃瓜党二号头目
2026-01-31 10:43:31
45岁宋佳官宣领证,男方身份公开后,网友震惊:居然是他!

45岁宋佳官宣领证,男方身份公开后,网友震惊:居然是他!

黎兜兜
2026-01-30 12:11:39
刘维伟宣!NBA总冠军中锋加盟CBA球队?

刘维伟宣!NBA总冠军中锋加盟CBA球队?

刺猬篮球
2026-02-01 17:06:23
500万奖金,230万年收入!陈幸同用坚持证明:天才+汗水=破局之力

500万奖金,230万年收入!陈幸同用坚持证明:天才+汗水=破局之力

叶赫那拉菲菲
2026-02-01 07:02:23
陈百强自杀真相曝光!王晶揭穿32年豪门谎言:他根本不是为情所困

陈百强自杀真相曝光!王晶揭穿32年豪门谎言:他根本不是为情所困

八斗小先生
2025-12-08 11:07:02
曼联无惧争议判罚!点球取消仍破门,胖虎又建功,1数据仅次枪手

曼联无惧争议判罚!点球取消仍破门,胖虎又建功,1数据仅次枪手

奥拜尔
2026-02-01 22:34:02
痛心!河南30岁男子上厕所去世,为省钱胸痛没治疗,家有三个孩子

痛心!河南30岁男子上厕所去世,为省钱胸痛没治疗,家有三个孩子

观察鉴娱
2026-02-01 15:13:07
2026-02-02 05:56:49
新智元 incentive-icons
新智元
AI产业主平台领航智能+时代
14457文章数 66560关注度
往期回顾 全部

科技要闻

10亿元宝红包突袭 复刻微信支付还是微视?

头条要闻

特朗普又有疯狂想法:白宫格斗赛 首都飙赛车

头条要闻

特朗普又有疯狂想法:白宫格斗赛 首都飙赛车

体育要闻

德约大度祝贺阿卡 幽默互动逗笑纳达尔

娱乐要闻

春晚第三次联排阵容曝光:全是实力派

财经要闻

黄仁勋台北"夜宴":汇聚近40位台企高管

汽车要闻

岚图汽车1月交付10515辆 同比增长31%

态度原创

时尚
艺术
旅游
亲子
本地

“多巴胺风”又又又火了!这样穿时髦又减龄

艺术要闻

上海“高技派”地标:华润中心竣工,LV总部入驻!

旅游要闻

春节必打卡10大榜单聚焦“京味年味”

亲子要闻

兰姐带玥儿看北京新学校,玥儿一待俩小时,筱梅的话终于有人信了

本地新闻

云游中国|拨开云雾,巫山每帧都是航拍大片

无障碍浏览 进入关怀版