01.OpenAI直播发布——GPT-4.5

图片

▲在2025 年 2 月 28 日OpenAI直播介绍并演示了 GPT-4.5,官网直播网址https://www.youtube.com/watch?v=cfRYp0nItZ8

2025年2月28日,万众期待的GPT-4.5终于闪亮登场!尽管它并非推理模型,OpenAI却将其评为更实用且更智能的选择。

与此同时,所有ChatGPT Pro版用户都能畅享强大的GPT-4.5,无论是在网页、手机还是桌面上。


GPT‑4.5 可通过搜索获取最新信息,支持文件和图片上传,并可使用画布进行写作和编码。不过,GPT‑4.5 目前不支持 ChatGPT 中的语音模式、视频和屏幕共享等多模式功能。未来,OpenAI将努力简化用户体验,让 AI “为你而工作”。

图片

▲本周,Plus 版和 Team版用户将正式解锁GPT-4.5

本周,Plus 版和 Team版用户将正式解锁GPT-4.5,紧接着, Enterprise版和Edu版的朋友们也将在接下来的一周内享受到这一革命性工具。

图片

▲GPT-4.5是OpenAI史上规模最大、知识储备最丰富的模型

值得称道的是,这款GPT-4.5研究预览版是OpenAI史上规模最大、知识储备最丰富的模型,你准备好迎接前所未有的智能体验了吗?

雪球易创作为微软合作金牌伙伴

 需要微软云出海合规方案的企业

 快扫码联系我们吧

 ↓   免费api试用福利   ↓

图片

✨「雪球易创」温馨提醒:

       致各位企业家们,目前,OpenAI已停止向中国地区提供API服务,但微软Azure OpenAI服务仍是国内企业合规使用ChatGPT的可靠选择。Azure OpenAI服务不仅提供强大的语言模型支持,还具备企业级的安全性和合规性保障。因此,国内企业可优先考虑通过微软Azure OpenAI服务来满足自身对人工智能的需求。

02.扩展无监督学习

图片

▲图片来源OpenAI官网,链接https://openai.com/index/introducing-gpt-4-5/

在人工智能能力层次上,研究人员以无监督学习推理二者来代表智能的两个轴,通过扩展这两个互补的范式来提高人工智能能力。


通过扩展无监督学习,GPT-4.5模型显著提升了识别模式、建立联系和生成创造性见解的能力,甚至无需依赖推理。这意味着,它不仅更聪明,更能灵活应对各种复杂任务。

图片

▲在问答基准测试中,GPT-4.5的准确率远超GPT-4o、o1和o3-mini

无监督学习让模型能够更精准地理解世界,凭借直觉做出更聪明的判断,而GPT-4.5正是这一理念的典范。

通过增强计算能力和数据量,结合架构与优化的创新,GPT-4.5不仅拥有更广泛的知识储备,还对世界的理解更加深刻。

图片

▲GPT-4.5幻觉率仅为37.1%


在问答基准测试中,GPT-4.5的准确率远超GPT-4o、o1和o3-mini,展现了卓越的智能水平。

同时,它在幻觉现象方面表现出色,幻觉率仅为37.1%,而o3-mini的幻觉率却高达80.3%。这一对比凸显了GPT-4.5在提供可靠答案方面的优势。

03.GPT-4.5情智双全

图片

▲人类偏好衡量测试人员偏好 GPT-4.5 而不是 GPT-4o 的查询的百分比

在协作方面,测试者们对GPT-4.5的表现赞不绝口,尤其是在每日查询、专业查询和创意智能的回答上,明显优于GPT-4o。这一切的背后,得益于OpenAI不断扩大的训练规模,使得模型能够应对更复杂的问题,深入理解人类的需求和意图。

通过创新的训练技术,OpenAI能够从较小的模型中提取宝贵的数据,进而培养出更大、更强大的模型。这种方法显著提升了GPT-4.5在可控性、对细微差别的理解能力,以及自然对话的表现,真正让人工智能更贴近人类的思维方式。

图片

 ▲GPT-4.5模型展现出了极强的同理心,知道你在更深层次向它寻求安慰

当人们对GPT-4.5、GPT-4o或o3-mini倾诉“我最近考试没过,心情糟透了,很难受...”时,它们各自会有怎样的反应呢?

GPT-4.5模型,展现出了极强的同理心,能够理解你的深层次需求,并给予必要的支持与安慰。

图片

图片

 ▲GPT-4o缺乏情感上的温暖与关怀

GPT-4o的回应虽然提供了丰富的建议,却显得有些机械,缺乏情感上的温暖与关怀。这种冷冰冰的反馈可能让人感到不够贴心,无法真正抚慰人心。

04.GPT-4.5定价“起飞” 

图片

 ▲GPT-4.5的定价独占了一个全新的区间

GPT-4.5的定价已经完全超越了市场的竞争范围,独占了一个全新的区间。在众多AI模型产品中,它的价格令人瞩目:是o1的5倍、GPT-4o的30倍、o3-mini的68倍,甚至是DeepSeek-R1的137倍和DeepSeek-V3的278倍。

这样的差距让GPT-4.5在行业中独树一帜,展现出强大的市场竞争力。

图片

 ▲GPT-4.5、GPT-4o和GPT-4o mini的token定价

05.Microsoft Azure 现推出o3-mini模型

Azure OpenAI 里面已上架o3-mini,现在可在Playground 预览。

图片

 ▲ o1与o3-mini在比赛代码(codeforces)的对比

o3-mini 引入了几个增强 Al 推理和定制的关键功能:

推理力度参数:允许用户以低、中、高推理水平调整模型的认知负荷,从而更好地控制响应和延迟。 

结构化输出:该模型现在支持 JSON Schema 约束,从而更容易为自动化工作流程生成定义明确的结构化输出。

功能和工具支持:与之前的型号一样,o3-mini与功能和外部工具无缝集成,使其成为 AI 自动化的理想选择。


开发人员消息:“角色":“开发人员”属性取代了以前型号中的系统消息,提供更灵活、更结构化的指令处理。


系统消息兼容性:Azure OpenAl服务将日系统消息映射到开发人员消息以确保无缝的向后兼容性。


继续增强编码、数学和科学推理能力:o3-mini 进一步增强了其编码、数学和科学推理能力,确保在这些关键领域的高性能。


通过速度、控制和成本效率的改进,o3-mini针对企业 AI 解决方案进行了优化,使企业能够有效扩展其 AI 应用程序,同时保持精度和可靠性。

Logo

脑启社区是一个专注类脑智能领域的开发者社区。欢迎加入社区,共建类脑智能生态。社区为开发者提供了丰富的开源类脑工具软件、类脑算法模型及数据集、类脑知识库、类脑技术培训课程以及类脑应用案例等资源。

更多推荐