网易首页 > 网易号 > 正文 申请入驻

实测GPT-5 Pro:别被普通版骗了!Pro才是OpenAI真正的顶级模型

0
分享至

文章转载于新智元

GPT-5终于来了,全世界的眼睛都盯着它。

但是目前的评价嘛,却是毁誉参半。我们也赶紧上手深度实测了一波。

发现GPT-5这家伙,表现还真有点「飘忽不定」,猜测可能和那个叫「路由」功能有关。

但是,一旦切换到GPT-5 Pro模式,强制使用最强能力时。天呐!感觉是真的有点强。

废话不多说。我们直接上案例,看看它到底有多牛。以下所有实测Demo均由GPT-5 Pro出品。

1

GPT-5 Pro实测展示

1. 首先就是喜闻乐见的「前端能力」展示

我们让GPT-5 Pro制作了一个黑客帝国的风格的可调参数城市,附带一个控制面板。

不得不说,编程能力确实提升巨大。

在完整视频中,你能看到GPT-5的参数面板非常丰富,可以调节很多细节,这个直观上就比我们以前测试的所有例子都要好。

2. 看图求解数独

只需要1分钟10s中,完美解决数独问题。

3. 比大小变体

比较9.9和9.11已经有了变体形式,通过求解方程来进一步测试模型的推理和计算能力。

4. 时钟难题

GPT-5 Pro一开始也是认错的,但是只要提示词强调「短的是时针,长的是分针」,然后Bingo!

6个钟表5个完全正确,只有黄色时钟识别错误。

不过,红色钟表由于时针和分针里的太近,被认为是12点(实际11点55,非常接近)

作为对比,Gemini 2.5 Pro的识别错误率就非常的高,几乎全错,多次询问正确率依然不高。

5. IMO数学问题

IMO的问题虽然都是OpenAI和谷歌都解出来了1-5题,但是他们是用的都是特调参赛用模型。

使用GPT-5 Pro求解第一道题目,在近16分钟的思考后,也得出了正确答案。

并且给出了非常详细的答案。

6. GeoGuessr看图猜地址挑战

将GeoGuessr上的挑战,交给GPT-5 Pro。

GPT-5 Pro根据砖墙颜色、房屋风格、交通标志、植被等全方位的分析,2min判断这是南非。

可以进一步要求深入分析,具体经纬度在哪里。

这是最终的结果,确实就是南非。

1

网友已玩儿嗨

网友们也都玩出了花!

有人在实测后认为GPT-5 Pro确实是一个顶级模型,是最优秀的。

OpenAI在Pro版本上取得了巨大的进步!

Peter进行了12次测试。

结论是:没有任何其他模型能够匹敌,无论是OpenAI、Google、xAI还是Anthropic的模型。

所有这些测试都只用了 1-3 次尝试,输出结果确实非常出色。

沃顿商学院CS教授EthanMollick惊叹道,自己全程没有输出一行代码,就让GPT-5做出一个建筑生成器。

只需要重复一句话——改进它,就实现了如下的效果。

一个提示,可以单次生成「我的世界」克隆版。

类似奥特曼制作的鼓点音乐,网友也尝试了GPT-5创建旋律和可视化效果。

GPT-5氛围编程,直出一个社交模拟器。

在SVG图生成方面,GPT-5可以说达到了全新高度。

OpenAI科学家SebastienBubeck表示,「在OpenAI,团队已前后攻克了预训练和推理两大技术难题。

现在正在全力探索一套,能最大限度发挥两者协同效应的新技术体系。GPT-5仅仅是这个方向的第一步」。

GPT-5还能看图精准定位,网友将童年一张照片扔给ChatGPT,没想到它直接定位到一英里范围内。

硅谷爆红经济学家TylerCowen认为,GPT-5在专业领域表现远超o3,并称这是自己用过最出色的学习工具。

同样,在编程方面,OpenAI研究员SuvanshSanjeev表示,「GPT-5重新定义并拓展了不同规模模型的成本和智能边界」。

可以说。正如METR最新报告所指出的,AI的指数级增长仍未放缓。

GPT-5完成任务时长延伸了52%

1

GPT-5提示指南

各路大神都进行了实测,但是要想自己玩得好,还要看官方指南。

OpenAI自己出了官方指导手册「GPT-5 prompting guide」。

指南基于官方团队与早期测试者(如Cursor)的实践经验,总结了在不同场景下提升GPT-5输出质量的提示策略,涵盖智能体主动性调控、上下文收集优化、Responses API 的高效利用,以及在前端/全栈开发中的最佳实践。

OpenAI表示他们从规划到执行,尽可能的最大化编码性能。

比如前端开发,GPT-5 在训练中具备了出色的基准审美品味,同时拥有严谨的实现能力。

对于新应用,OpenAI建议使用以下框架和包,以最大程度地发挥该模型在前端方面的能力:

  • 框架:Next.js(TypeScript)、React、HTML

  • 样式/UI:Tailwind CSS,shadcn/ui,Radix 主题

  • 图标:Material Symbols、Heroicons、Lucide

  • 动画: Motion

  • 字体:San Serif、Inter、Geist、Mona Sans、IBM Plex Sans、Manrope

并且网友们也整了一套GPT-5的提示词范例。比如

1.深度推理与问题解决(Deep Reasoning & Problem-Solving)

先把问题拆解成清晰步骤,再输出答案,减少推理错误。

2.先批评再定稿模式(Critique Before Final Mode)

先完成初稿,再让GPT-5批评并修改,提升质量。

3.角色+目标+约束(Role + Objective + Constraints)

设定身份、目标和严格约束,让输出更贴合需求。

4.逐步加深(Progressive Deepening)

先给高层概述,再逐步深入细节,避免一次性信息过载。

1

彩蛋

被网友催的狠了,现在OpenAI已经把GPT-5之前的所有模型都放了出来。

快去看看你的ChatGPT里是否已经有了。

方法是进入设置并打开「显示传统模型」,就能在下拉菜单中看到之前的模型了。

同时,你也可以选择将颜色设置尊贵的「黑色」

参考资料:

https://cookbook.openai.com/examples/gpt-5/gpt-5_prompting_guide-coding-in-production-cursors-gpt-5-prompt-tuning

点个爱心,再走 吧

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
大唐名将李靖,陈塘关李靖,托塔天王李靖,到底是不是同一个人?

大唐名将李靖,陈塘关李靖,托塔天王李靖,到底是不是同一个人?

铭记历史呀
2026-03-26 11:16:18
最大的访问团,国王携家族三百多名成员访问中国,在中国生活至今

最大的访问团,国王携家族三百多名成员访问中国,在中国生活至今

丞丞故事汇
2026-03-26 11:34:08
越南5年免签新政策4.1开始实施

越南5年免签新政策4.1开始实施

创作者_cLg1
2026-03-26 09:42:32
美军中央司令部:美军“亚伯拉罕·林肯”号航空母舰“在区域海域航行期间,继续针对伊朗境内的军事目标开展作战行动”

美军中央司令部:美军“亚伯拉罕·林肯”号航空母舰“在区域海域航行期间,继续针对伊朗境内的军事目标开展作战行动”

潇湘晨报
2026-03-26 10:55:27
一审重判整整17年,柯文哲当庭最后一搏,藏着赖清德最担心的结局

一审重判整整17年,柯文哲当庭最后一搏,藏着赖清德最担心的结局

李健政观察
2026-03-26 18:16:56
事情闹大了,日本内阁连发公告,中国的态度,告诉了世界一个事实

事情闹大了,日本内阁连发公告,中国的态度,告诉了世界一个事实

荣亭小吏
2026-03-26 11:23:02
重磅官宣!伦敦世乒赛国乒再添1人直通,8人名单正式出炉

重磅官宣!伦敦世乒赛国乒再添1人直通,8人名单正式出炉

宝哥精彩赛事
2026-03-26 18:04:15
五代最弱小的政权,全国仅3万兵甲,靠着打家劫舍度过40年和平

五代最弱小的政权,全国仅3万兵甲,靠着打家劫舍度过40年和平

疯狂的小历史
2026-03-26 13:06:45
46岁童蕾近况曝光,带女儿回农村住平房,亲自种菜日子十分勤俭

46岁童蕾近况曝光,带女儿回农村住平房,亲自种菜日子十分勤俭

科学发掘
2026-03-26 17:46:48
延寿9年,心脏病风险降60%!悉尼大学最新:饮食、睡眠、运动最佳组合出炉,小改变也大有益

延寿9年,心脏病风险降60%!悉尼大学最新:饮食、睡眠、运动最佳组合出炉,小改变也大有益

医诺维
2026-03-24 17:02:18
女人偷吃后晚上跟丈夫同房是什么体验?这位46岁出轨女人说出答案

女人偷吃后晚上跟丈夫同房是什么体验?这位46岁出轨女人说出答案

混音情感
2026-03-26 14:25:07
没护照没签证,这只叫LV的猫天天跨国走私老鼠,两国海关都拿它没辙!

没护照没签证,这只叫LV的猫天天跨国走私老鼠,两国海关都拿它没辙!

英国那些事儿
2026-03-24 23:16:58
中国电信:全面转向token经营!

中国电信:全面转向token经营!

最通信
2026-03-25 20:45:14
余承东:问界M6 24小时订单突破60000台 展车已到店

余承东:问界M6 24小时订单突破60000台 展车已到店

CNMO科技
2026-03-24 17:14:29
伊朗微松口:特朗普女婿库什纳无法信任,但跟副总统万斯或许能谈

伊朗微松口:特朗普女婿库什纳无法信任,但跟副总统万斯或许能谈

阿龙聊军事
2026-03-26 20:41:08
又内讧,泰山队内部又出问题,惨败原因找到了,内部矛盾曝光

又内讧,泰山队内部又出问题,惨败原因找到了,内部矛盾曝光

体坛风之子
2026-03-26 04:30:03
张雪峰说得对!深圳社保就是淘汰本末倒置的!直接封神!

张雪峰说得对!深圳社保就是淘汰本末倒置的!直接封神!

烟浔渺渺
2026-03-26 17:07:45
赖昌星前妻近状曝光:拒绝政府安置,独居3000平老宅,只做一件事

赖昌星前妻近状曝光:拒绝政府安置,独居3000平老宅,只做一件事

芳芳历史烩
2026-03-23 03:53:23
笑掉大牙!伊朗高层当众互撕,吹破天的强硬,连军饷都发不出来

笑掉大牙!伊朗高层当众互撕,吹破天的强硬,连军饷都发不出来

老马拉车莫少装
2026-03-25 19:39:00
伊朗首都德黑兰遭空袭,多地传出爆炸声!伊朗武装部队向以色列发射新一轮导弹

伊朗首都德黑兰遭空袭,多地传出爆炸声!伊朗武装部队向以色列发射新一轮导弹

大象新闻
2026-03-26 20:45:02
2026-03-26 21:24:49
硅星人 incentive-icons
硅星人
硅(Si)是创造未来的基础,欢迎来到这个星球。
2960文章数 10473关注度
往期回顾 全部

科技要闻

Meta高管狂分百亿期权,700名员工却下岗

头条要闻

张雪峰留巨额遗产:二婚妻子或拿50% 剩下的女儿占1/3

头条要闻

张雪峰留巨额遗产:二婚妻子或拿50% 剩下的女儿占1/3

体育要闻

申京努力了,然而杜兰特啊

娱乐要闻

刘晓庆妹妹发声!称姐姐受身边人挑拨

财经要闻

油价"驯服"特朗普?一到100美元就TACO

汽车要闻

一汽奥迪A6L e-tron开启预售 CLTC最大续航815km

态度原创

本地
艺术
手机
公开课
军事航空

本地新闻

救命,这只酱板鸭已经在我手机复仇了一万遍

艺术要闻

哪一座桥不是风景?

手机要闻

OPPO K15 Pro系列突然官宣:天玑9500s+主动散热,4月1日发布

公开课

李玫瑾:为什么性格比能力更重要?

军事要闻

担心特朗普突然停战 以总理下令48小时尽力摧毁伊设施

无障碍浏览 进入关怀版