微信扫码
添加专属顾问
我要投稿
谷歌版o1来了!在奥特曼“双十二”倒数第二天——
他们发布Gemini 2.0 Flash Thinking,顾名思义,以闪电般的速度解决复杂问题并展示其思考过程的实验模型。
从姐夫哥展示出的Demo来看,它能在几秒钟之内解决一个物理问题,并且给出思考过程。
还可以给一张图,同时涉及视觉和文本线索的谜题。
如何用其中三个数字加起来等于30?
结果同样也是短短几秒,思考了好几种方案,最终确定是需要将9号球翻转为6号球,以实现6+13+11等于30这样一个结果。
所有综合类别指标中显示,目前Gemini 2.0 Flash Thinking排名第一,包括数学、代码、指令跟随、长QA、创意写作等等各方面。
目前在谷歌AI Studio就可以免费使用。
从众多网友实测中,主要分为两大“派系”,一种是纯文本型,另一种是视觉类谜题。
最明显感知的就是一个快字。
它还可以解决像抛硬币这样的概率问题:如果我一直抛硬币,直到得到HHH或HTH,那么得到这两个几率之比是多少?
甚至它还可以解析摩斯代码,让网友直呼:怪吓人的。
有解决这种视觉类谜题的,比如找出这里面的字母和数字,并且说明出现了多少次。
结果它都一一指出来了。
DeepMind首席科学家拿出了他当年面试时遇到第一个问题,是用笔和纸写下的一道关于数论的问题。
结果它也秒秒钟回答了出来。
目前仅支持32k上下文窗口,也不支持联网。不过主创表示接下来会在新的一年里快速跟进,提供更长的token、更多的工具支持等。
今天之所以推出这个实验版,主要是为了接受大家的反馈意见。
也有网友反馈,它没有考虑到一些关键的物理因素。
不过也有不少网友反应,有个bug是,它似乎还是搞不清楚Strawberry有多少个r。
但如果进一步「仔细思考一下」,它就能回答出来。
姐夫哥还透露,未来还会有更多功能,可以在这里期待一下子。
好了,感兴趣的小伙伴可以前往去试试。
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费场景POC验证,效果验证后签署服务协议。零风险落地应用大模型,已交付160+中大型企业
2025-03-12
我不许你还不知道Qwen Chat
2025-03-12
大模型 Token 的消耗可能是一笔糊涂账
2025-03-12
一位投资人的硬核观察:被DeepSeek和Manus改写的AI投资范式
2025-03-12
从DeepSeek MoE专家负载均衡谈起
2025-03-12
Manus爆火的背后,Agentic AI产品如何构筑持久的竞争优势?
2025-03-12
老板格局不大,但编码能力不错的Claude 3.7正式发布
2025-03-12
一文让你彻底了解「AI互联互通的标准MCP」
2025-03-12
OpenAI深夜发布全新Agent工具:两大杀器登场,感觉可以手搓Manus了
2024-08-13
2024-06-13
2024-09-23
2024-08-21
2024-05-28
2024-07-31
2024-08-04
2024-04-26
2024-07-09
2024-09-17
2025-03-12
2025-03-12
2025-03-10
2025-03-10
2025-03-10
2025-03-10
2025-03-08
2025-03-08