专栏名称: 玩转VSCode
编程开发,业界资讯,以及 VS Code 的热门文章、使用技巧、插件推荐、插件开发攻略等,全部都可以在这里找到。带你玩转 VS Code!
51好读  ›  专栏  ›  玩转VSCode

刚刚,OpenAI上线Deep Research!人类终极考试远超DeepSeek R1

玩转VSCode  · 公众号  ·  · 2025-02-03 12:35

正文

梦晨 西风 发自 凹非寺
量子位 | 公众号 QbitAI

真香!在 VS Code 中免费使用 DeepSeek-R1!

就在开源的DeepSeek-R1被整合进各路AI搜索工具之际, OpenAI临时举行小型发布会。

4点27通知,8点开始直播。

ChatGPT上新 “Deep Research” ,把推理大模型的思考能力用于联网搜索。

据介绍,Deep Research功能可在数十分钟完成人类专家需要几个小时的复杂研究任务。

“人类最后的考试” 上,Deep Research刷新了最高分,比o3-mini高推理设置分数高出一倍。

该测试包括3000多个多选和简答题,涵盖从语言学、火箭科学到生态学的100多个主题。

与o1相比,Deep Research最突出的地方在化学,人文和社会科学以及数学中,表现出类似人类的“在必要时寻找专业信息”的能力。

另一项测试GAIA,在现实世界问题上评估AI的公开基准测试,Deep Research在3个级别的难度上均刷新记录。

出于保护基准测试的目的,OpenAI只展示了Deep Research在完成这些任务时的搜索过程,隐去了最终答案。

Deep Research功能接下来将对Pro、Plus和Team用户开放。

奥特曼后面补充,目前版本基于o3构建,Plus用户(20美元/月)每个月能用约10次,且正在构建一个更高效的版本。

此外,免费用户也能获得非常少量的使用额度。

推理Agent的第一步

OpenAI表示,Deep Research专门为在金融/科学/工程等领域从事高强度知识工作、需要深入精确且可靠研究的人群而设计。

它由OpenAI o3驱动,通过基于真实任务 (涉及浏览器和Python工具的使用) 的训练,采用了与o1相同的强化学习方法。

只需一个提示,它就会查找分析并整合数百个在线资源,生成一份达到研究分析师水平的综合报告。

Deep Research对于OpenAI的重要性,官方原话是:

Deep Research标志着我们在开发AGI的宏伟目标上迈出了重要一步。我们长期以来一直设想AGI能够进行新颖的科学研究,而Deep Research正是这一愿景的重要进展。

使用方法,点击输入框下方的Deep Research按钮即可,支持上传文件添加额外资料。

例如prompt:

Compile a research report on how the retail industry has changed in the past 3 years. Use bullets and tables where necessary for clarity.(写一份关于过去三年零售业变化的研究报告,并运用项目符号和表格来提升内容的清晰度)

ChatGPT线会确认一下问题细节信息,比如“您能具体说明您最感兴趣的零售业方面吗?”“您需要全球视角还是特定地区的分析?”

然后,它就开始分析+挖掘信息了:

侧边栏会显示所采取的步骤摘要和使用的信息来源。

完成任务的时间大概是5-30分钟,最终结果将以报告的形式输出。

OpenAI表示,接下来几周内,还将为这些报告添加嵌入式图片、数据可视化和其它分析输出。







请到「今天看啥」查看全文