专栏名称: 量子位
վ'ᴗ' ի 追踪AI行业和技术动态,这里更快一步!关注我们,回复“今天”,更多大新闻等你来发现
目录
相关文章推荐
爱可可-爱生活  ·  《爱可可微博热门分享(12.19)》 ... ·  昨天  
爱可可-爱生活  ·  【Markdown To ... ·  3 天前  
爱可可-爱生活  ·  晚安~ #晚安# -20241217224439 ·  3 天前  
机器之心  ·  AI大模型时代,人才的需求已经变了 ·  3 天前  
爱可可-爱生活  ·  《爱可可微博热门分享(12.16)》 ... ·  4 天前  
51好读  ›  专栏  ›  量子位

谷歌版o1突发即屠榜!思考速度比所有模型快5倍,能解摩斯代码,数学物理秒秒钟解决

量子位  · 公众号  · AI  · 2024-12-20 04:05

主要观点总结

文章介绍了谷歌新推出的AI实验模型Gemini 2.0 Flash Thinking的特点和性能。该模型能迅速解决复杂问题并展示思考过程,包括物理问题、视觉和文本线索的谜题等。它在综合类别指标中排名第一,目前可免费在谷歌AI Studio使用。该模型有两种明显的使用类型:纯文本型和视觉类谜题。它还可以解决概率问题、解析摩斯代码等。虽然目前有一些限制,但主创表示将在未来进行更新和改进。

关键观点总结

关键观点1: Gemini 2.0 Flash Thinking实验模型的特点

能闪电般速度解决复杂问题并展示思考过程,包括物理问题、视觉和文本线索的谜题等

关键观点2: Gemini 2.0 Flash Thinking的性能

在综合类别指标中排名第一,可解决包括数学、代码、指令跟随、长QA、创意写作等各方面的任务

关键观点3: Gemini 2.0 Flash Thinking的使用和限制

目前在谷歌AI Studio可免费使用,分为纯文本型和视觉类谜题两种使用类型。目前仅支持32k上下文窗口,不支持联网,但主创表示将未来进行改进和更新

关键观点4: 网友对Gemini 2.0 Flash Thinking的反馈

有部分网友反馈其解决物理问题的速度和能力惊人,但也有网友指出其存在一些局限性,如不考虑某些物理因素和存在bug等。


正文

白小交 一水 发自 凹非寺
量子位 | 公众号 QbitAI

谷歌版o1来了!在奥特曼“双十二”倒数第二天——

他们发布Gemini 2.0 Flash Thinking,顾名思义,以闪电般的速度解决复杂问题并展示其思考过程的实验模型。

从姐夫哥展示出的Demo来看,它能在几秒钟之内解决一个物理问题,并且给出思考过程。

还可以给一张图,同时涉及视觉和文本线索的谜题。

如何用其中三个数字加起来等于30?

结果同样也是短短几秒,思考了好几种方案,最终确定是需要将9号球翻转为6号球,以实现6+13+11等于30这样一个结果。

所有综合类别指标中显示,目前Gemini 2.0 Flash Thinking排名第一,包括数学、代码、指令跟随、长QA、创意写作等等各方面。

目前在谷歌AI Studio就可以免费使用。

谷歌版o1第一波实测

从众多网友实测中,主要分为两大“派系”,一种是纯文本型,另一种是视觉类谜题。

最明显感知的就是一个快字。

它还可以解决像抛硬币这样的概率问题:如果我一直抛硬币,直到得到HHH或HTH,那么得到这两个几率之比是多少?

甚至它还可以解析摩斯代码,让网友直呼:怪吓人的。

有解决这种视觉类谜题的,比如找出这里面的字母和数字,并且说明出现了多少次。

结果它都一一指出来了。

DeepMind首席科学家拿出了他当年面试时遇到第一个问题,是用笔和纸写下的一道关于数论的问题。

结果它也秒秒钟回答了出来。

目前仅支持32k上下文窗口,也不支持联网。不过主创表示接下来会在新的一年里快速跟进,提供更长的token、更多的工具支持等。

今天之所以推出这个实验版,主要是为了接受大家的反馈意见。

也有网友反馈,它没有考虑到一些关键的物理因素。

没有考虑到河流流动所暗示的海拔

不过也有不少网友反应,有个bug是,它似乎还是搞不清楚Strawberry有多少个r。

但如果进一步「仔细思考一下」,它就能回答出来。

姐夫哥还透露,未来还会有更多功能,可以在这里期待一下子。

好了,感兴趣的小伙伴可以前往去试试。

体验链接:
https://aistudio.google.com/prompts/new_chat
参考链接:
[1]https://x.com/OfficialLoganK/status/1869789820308074837
[2]https://x.com/JeffDean/status/1869789813232341267
[3]https://x.com/lmarena_ai/status/1869793847548817563
[4]https://x.com/drjwrae/status/1869806621024772096/video/2
[5]https://x.com/catebligh/status/1869823074809647589

—  —

点这里👇关注我,记得标星哦~

一键三连「分享」、「点赞」和「在看」

科技前沿进展日日相见 ~