谷歌版o1突发即屠榜！思考速度比所有模型快5倍，能解摩斯代码，数学物理秒秒钟解决

愤怒的蜗牛

2024-12-14 385阅读 0评论

谷歌版o1来了！在奥特曼“双十二”倒数第二天——

他们发布Gemini 2.0 Flash Thinking，顾名思义，以闪电般的速度解决复杂问题并展示其思考过程的实验模型。

谷歌版o1突发即屠榜！思考速度比所有模型快5倍，能解摩斯代码，数学物理秒秒钟解决

从姐夫哥展示出的Demo来看，它能在几秒钟之内解决一个物理问题，并且给出思考过程。

，时长01:24

还可以给一张图，同时涉及视觉和文本线索的谜题。

如何用其中三个数字加起来等于30？

谷歌版o1突发即屠榜！思考速度比所有模型快5倍，能解摩斯代码，数学物理秒秒钟解决

结果同样也是短短几秒，思考了好几种方案，最终确定是需要将9号球翻转为6号球，以实现6+13+11等于30这样一个结果。

谷歌版o1突发即屠榜！思考速度比所有模型快5倍，能解摩斯代码，数学物理秒秒钟解决

所有综合类别指标中显示，目前Gemini 2.0 Flash Thinking排名第一，包括数学、代码、指令跟随、长QA、创意写作等等各方面。

谷歌版o1突发即屠榜！思考速度比所有模型快5倍，能解摩斯代码，数学物理秒秒钟解决

目前在谷歌AI Studio就可以免费使用。

谷歌版o1突发即屠榜！思考速度比所有模型快5倍，能解摩斯代码，数学物理秒秒钟解决

谷歌版o1第一波实测

从众多网友实测中，主要分为两大“派系”，一种是纯文本型，另一种是视觉类谜题。

最明显感知的就是一个快字。

谷歌版o1突发即屠榜！思考速度比所有模型快5倍，能解摩斯代码，数学物理秒秒钟解决

它还可以解决像抛硬币这样的概率问题：如果我一直抛硬币，直到得到HHH或HTH，那么得到这两个几率之比是多少？

谷歌版o1突发即屠榜！思考速度比所有模型快5倍，能解摩斯代码，数学物理秒秒钟解决

甚至它还可以解析摩斯代码，让网友直呼：怪吓人的。

谷歌版o1突发即屠榜！思考速度比所有模型快5倍，能解摩斯代码，数学物理秒秒钟解决

有解决这种视觉类谜题的，比如找出这里面的字母和数字，并且说明出现了多少次。

谷歌版o1突发即屠榜！思考速度比所有模型快5倍，能解摩斯代码，数学物理秒秒钟解决

结果它都一一指出来了。

谷歌版o1突发即屠榜！思考速度比所有模型快5倍，能解摩斯代码，数学物理秒秒钟解决

DeepMind首席科学家拿出了他当年面试时遇到第一个问题，是用笔和纸写下的一道关于数论的问题。

谷歌版o1突发即屠榜！思考速度比所有模型快5倍，能解摩斯代码，数学物理秒秒钟解决

结果它也秒秒钟回答了出来。

谷歌版o1突发即屠榜！思考速度比所有模型快5倍，能解摩斯代码，数学物理秒秒钟解决

目前仅支持32k上下文窗口，也不支持联网。不过主创表示接下来会在新的一年里快速跟进，提供更长的token、更多的工具支持等。

今天之所以推出这个实验版，主要是为了接受大家的反馈意见。

谷歌版o1突发即屠榜！思考速度比所有模型快5倍，能解摩斯代码，数学物理秒秒钟解决

也有网友反馈，它没有考虑到一些关键的物理因素。

谷歌版o1突发即屠榜！思考速度比所有模型快5倍，能解摩斯代码，数学物理秒秒钟解决

△没有考虑到河流流动所暗示的海拔

不过也有不少网友反应，有个bug是，它似乎还是搞不清楚Strawberry有多少个r。

谷歌版o1突发即屠榜！思考速度比所有模型快5倍，能解摩斯代码，数学物理秒秒钟解决

但如果进一步「仔细思考一下」，它就能回答出来。

谷歌版o1突发即屠榜！思考速度比所有模型快5倍，能解摩斯代码，数学物理秒秒钟解决

姐夫哥还透露，未来还会有更多功能，可以在这里期待一下子。

好了，感兴趣的小伙伴可以前往去试试。

体验链接：
https://aistudio.google.com/prompts/new_chat。
参考链接：
[1]https://x.com/OfficialLoganK/status/1869789820308074837。
[2]https://x.com/JeffDean/status/1869789813232341267。
[3]https://x.com/lmarena_ai/status/1869793847548817563。
[4]https://x.com/drjwrae/status/1869806621024772096/video/2。
[5]https://x.com/catebligh/status/1869823074809647589。

李飞飞：World Labs这样实现「空间智能」

Meta AI的COCONUT：无需语言即可思考的AI方法译文精选

相关阅读

ACL 2025 | 基于Token预算感知的大模型高效推理技术

OpenAI久违发了篇「正经」论文：线性布局实现高效张量计算

被疯传的“恶趣味”：看Copilot这款“熊孩子”把微软工程师逼疯！Agent 刚上线就翻车？网友：微软工程师成了“人肉保姆” 译文

1步碾压250步！何恺明新作祭出MeanFlow，一行公式让 FID 狂降近 70%

奥特曼：Codex 让我感到 AGI！最新谈话罕见透露下一代“完美模型”，大胆预测 Agent 明年突破边界！

OpenAI深夜宣布ChatGPT支持MCP、会议记录，万物互联时代来了！

使用Claude 4提升程序员生产力的五种高级方式译文

AI+数字经济的核心三要素

您需要登录账户后才能发表评论

发表评论取消回复

评论列表（暂无评论，385人围观）

还没有评论，来说两句吧...

目录[+]

微信二维码

微信二维码

支付宝二维码