AI知识库

53AI知识库

学习大模型的前沿技术与行业应用场景


OpenAI发布L3 级智能体!

发布日期:2025-01-24 11:57:04 浏览次数: 2006 来源:NLP前沿
推荐语

OpenAI 发布新智能体,引发关注!这是一次具有突破意义的尝试。

核心内容:
1. 与 Anthropic 同类产品对比及评测提升
2. 用户初体验及存在的问题
3. karpathy 大佬的高度评价

杨芳贤
53A创始人/腾讯云(TVP)最具价值专家

OpenAI 在 Anthropic 的同类产品发布 3 个月后,昨晚推出了他们的计算机使用Agent。

在OSWorld/WebArena 上评测获得了比较大的提升,说明还是存实际意义的模型进步,而不仅仅是 ui/product 包装。

原理也很常规,端到端。

@SullyOmarr 发表了关于operator的初印象。

初次使用 operator 的感受:

  1. 对演示用例来说还算不错(不过我个人大概不会用它订机票);
  2. 在点按按钮时经常发生误触,只差几像素,不确定是不是视窗问题;
  3. “接管”这个功能挺笨拙的,让我觉得流程被破坏了(主要是在两个界面之间来回切换上);
  4. 对我很多使用场景来说,它依然很慢。用光标或脚本比看 operator 点来点去要快上 10 倍。

总体而言,我对于他们能在第一天就上线这么多用户感到惊讶,这可不容易。浏览器很复杂,搭建这样的基础设施难度很大,必须给团队点赞。

但现在还谈不上“魔法般”的效果。模型本身在后续六个月里应该还要优化,变得更快一些。

对我来说,现在可能只能把它放在“sora”那一堆里:用了一次就没再用。说实话,目前我还没发现特别适合它的场景。

karpathy大佬的评价很高,operator项目对于数字世界来说,就像类人机器人对物理世界。

53AI,企业落地大模型首选服务商

产品:场景落地咨询+大模型应用平台+行业解决方案

承诺:免费场景POC验证,效果验证后签署服务协议。零风险落地应用大模型,已交付160+中大型企业

联系我们

售前咨询
186 6662 7370
预约演示
185 8882 0121

微信扫码

添加专属顾问

回到顶部

加载中...

扫码咨询