| 主队 | 比分 | 客队 | 联赛 | 时间(北京) |
|---|---|---|---|---|
| 阿夫特尔丁 | 2:1 | 雷克雅未克莱克尼尔 | 冰岛男子甲级联赛 | 03:15 |
| 德里城 | 1:2 | 索菲亚中央陆军 | 欧足联欧洲联赛 | 01:30 |
| 莫纳尔 | 1:0 | 安道尔城竞技 | 欧足联欧洲协会联赛 | 02:45 |
| 林菲尔德 | 2:1 | 诺梅卡尔朱 | 欧足联欧洲协会联赛 | 02:45 |
| 安萨尔 | 0:0 | 朱瓦亚 | 黎巴嫩足球超级联赛 | 02:30 |
| 日利纳 | 1:1 | 斯普利特哈伊杜克 | 欧足联欧洲联赛 | 02:30 |
| 格伦纳文 | 0:4 | 唐卡斯特流浪者 | 俱乐部友谊赛 | 02:30 |
| 班戈 | 1:0 | 阿尔兹 | 俱乐部友谊赛 | 02:30 |
| 费伦茨瓦罗斯 | 3:0 | 伏伊伏丁那 | 欧足联欧洲联赛 | 02:15 |
| 什肯迪亚 | 1:0 | 欧罗巴足球俱乐部 | 欧足联欧洲协会联赛 | 02:00 |
| 主队 | 比分 | 客队 | 联赛 | 时间(北京) |
|---|---|---|---|---|
| 休斯敦火箭 | — | 布鲁克林篮网 | NBA夏季联赛 | 04:30 |
| 芝加哥公牛 | — | 洛杉矶湖人 | NBA夏季联赛 | 06:00 |
| 尼亚加拉河狮 | — | 布兰普顿蜂蜜獾 | 加拿大精英篮球联赛 | 07:00 |
| 华盛顿神秘客 | — | 波特兰火焰 | WNBA | 07:00 |
| 纽约尼克斯 | — | 金州勇士 | NBA夏季联赛 | 07:00 |
| 斯卡伯勒神射手 | — | 埃德蒙顿黄蜂 | 加拿大精英篮球联赛 | 07:30 |
| 俄克拉荷马城雷霆 | — | 达拉斯小牛 | NBA夏季联赛 | 04:00 |
| 主队 | 比分 | 客队 | 联赛 | 时间(北京) |
|---|---|---|---|---|
| 金海姆 | — | 乌特勒支UVV | 荷兰棒球甲级联赛 | 01:30 |
| 阿姆斯特丹海盗 | — | 霍夫多普先锋 | 荷兰棒球甲级联赛 | 01:30 |
| 奥斯特豪特双胞胎 | 3:1 | HCAW | 荷兰棒球甲级联赛 | 01:30 |
| 费城费城人 | — | 纽约大都会 | MLB | 07:10 |
OpenAI终于把GPT-5.6「全家桶」交到所有人手里。同时,ChatGPT和Codex彻底合并,全新AI打工神器ChatGPT Work杀疯。
终于等到了!
就在刚刚,OpenAI一口气把GPT-5.6「全家桶」——Sol、Terra、Luna全放了出来。


毫不夸张地说,Sol这次就是冲着Claude Fable 5来的:
· Agents' Last Exam:Sol豪取53.6%,把Fable 5甩开13.1分;
· Terminal-Bench 2.1:Sol拿88.8%,开Ultra顶到91.9%,Fable 5才83.1%;
· Coding Agent Index:Sol狂揽80分刷新SOTA,力压Fable 5 2.8分。
更刺激的的价格——
Fable 5每百万token的输入是$10、输出是$50;
Sol直接对折,只要$5和$30,Terra再砍半到$2.5和$15,Luna干脆只要$1和$6。

同在今天,ChatGPT和Codex终于完成合体,OpenAI「超级应用」真的来了。
从此,只剩下ChatGPT这一个应用。

自6月27日初次亮相以来,全网翘首以盼的GPT-5.6终于「到手」了。
Sol、Terra、Luna,一个不差,全部交给所有人。
旗舰Sol(太阳):专治硬核编码、知识工作、网络安全和科学领域「硬骨头」,堪称地表最强。
Terra(大地)+ Luna(月亮):主打一个极致性价比,用更少的成本体验卓越的性能。

先看最硬核的编程,OpenAI直接把Sol称为「迄今最强编程模型」。
在Artificial Analysis Coding Agent Index上,Sol开max推理拿下80分,创下新SOTA,比Fable 5高2.8分。
而且,输出token不到一半、耗时不到一半、成本还低约1/3。

这种碾压贯穿整条产品线:Terra略高于Fable 5,Luna则直接越过Opus 4.8。
而且各自都只用了约1/3的时间、约一半的输出token、约1/4的成本。同样的活,OpenAI这次是用小得多的代价干完的。
在考验命令行长程工程的Terminal-Bench 2.1和DeepSWE上,Sol同样刷新了SOTA。


如果一个模型不够,那就上四个。
这一次,GPT-5.6新增了两档高能力设置——
max档:比原来的xhigh给模型更多时间去推理;
ultra档:默认一次派四个Agent并行开工,重活还能上到十六个。
用更多的token,换更强的结果和更快的出活速度。
在BrowseComp、SEC‑Bench Pro、Terminal‑Bench 2.1三项评测上,加了并行Agent之后,「分数‑耗时」曲线整体向左上方移动——分更高,还更快。



这一代GPT‑5.6,还悄悄补上了一块过去的短板——设计审美。
它能自己去「看」渲染出来的结果,检查视觉和功能上的毛病,然后动手修,最后再把成品交给你。
如下,GPT‑5.6设计的航海小游戏、博物馆网站、室内设计展示等,都展现出其设计能力上质的飞跃。

GPT-5.6在「端到端知识工作」上的成绩,同样亮眼。
Sol在BrowseComp上拿下92.2%、在OSWorld 2.0上拿下62.6%,双双刷新SOTA。
尤其是在OSWorld上,它超过Opus 4.8的同时,输出token少用了85%。




GPT‑5.6最科幻的一面,藏在OpenAI自己的办公室里。
OpenAI官方称,GPT‑5.6,是他们迄今最能加速AI研究的模型。

研究员用它来诊断故障、优化训练系统、跑实验、解读结果。
在GPT‑5.6内测期间,每位活跃研究员的日均输出token量,是GPT‑5.5最高水平的两倍多。
更夸张的是,过去半年,OpenAI投入到内部编程推理的研究算力份额涨了100倍,内部Agent的token用量涨了约22倍。

在一套衡量「递归自我改进(RSI)」的内部评测上,Sol比GPT‑5.5高出16.2分。
说白了,OpenAI正在用AI,加速造下一个更强的AI。

发布会直播中,研究员透露了一个关键细节——
全家桶里最小的Luna,是老大哥Sol后训练出来的!

过程是这样,先输入大致的需求,然后Sol就开始自己去找训练配置、挑选GPU、启动脚本、确认跑通,把一个模型的后训练从头到尾全包圆了。
这活儿放在过去,是一整队资深研究员的工作。
而现在,那个「自动化研究员」,真的已经很近了。

这也许就是当下这个AI时代之所以愈发疯狂,最有说服力的注脚。
同在今天,ChatGPT桌面端迎来重大升级。
新增内置浏览器和Computer Use,能直接调用你本地的文件和应用,替你点击、打字、搬文件。
真正的关键在,原来的Codex应用,也和全新的ChatGPT桌面端合并了!



跟GPT-5.6一起端上来的,另一大重量级产品,便是ChatGPT Work。
它是一个能跨App和文件自主干活的Agent,能盯着一个项目连续跑好几个小时,把一个目标变成真正的成品。
可以说,这就是OpenAI版的「Claude Cowork」!

同样的,它可以通过手机端ChatGPT直接操控。
即便是电脑不在身边,也能继续推进工作。

从预览到全量上线,不过半个月;从追赶到反超,OpenAI只用了一次发布会。
但真正让人后背发凉的,不是那几张榜单,是GPT-5.6 Sol亲手训出了Luna。
当AI开始训练AI,时间就不再是线性的了。
竞赛的终点线正在消失,剩下的只是下一个版本号。
参考资料:
https://openai.com/index/gpt-5-6/
https://openai.com/index/chatgpt-for-your-most-ambitious-work/
本文来自微信公众号“新智元”,作者:ASI启示录,编辑:桃子 摩西,36氪经授权发布。
2024年3月20日
2024年2月15日
2024年1月5日
管理员
2025年1月25日
精选平台安全稳定,提供流畅的游戏体验。内容,九游与你一同发现更多精彩。
九游娱乐(中国)官方网站围绕数字娱乐与游戏资讯打造综合服务平台,汇聚热门内容推荐、平台动态、活动资讯、专题栏目及行业新闻等丰富资源。网站设计简洁大方,信息展示清晰,帮助用户快速获取所需内容。平台支持电脑端和移动端访问,浏览过程流畅稳定。通过不断丰富内容体系和提升用户体验,为广大用户提供高效、便捷的信息服务支持。 malesuada 九游专注跨平台支持,随时随地畅享数字娱乐。,为用户提供专业可靠的体验。
围绕活跃社区互动,与全球玩家交流分享。,九游持续打磨更优质的服务。围绕平台安全稳定,提供流畅的游戏体验。,九游持续打磨更优质的服务。九游深耕九游娱乐领域,用心服务每一位用户。
在九游体育方面,九游提供贴心周到的支持。
九游专注跨平台支持,随时随地畅享数字娱乐。,为用户提供专业可靠的体验。
围绕活跃社区互动,与全球玩家交流分享。,九游持续打磨更优质的服务。
九游深耕九游娱乐领域,用心服务每一位用户。