当前位置: 首页 > news >正文

OpenAI 发布首个 AI 智能体

OpenAI 发布首个 AI 智能体

当地时间 1 月 23 日,OpenAI 发布了首个 AI 智能体 Operator124。以下是关于它的详细介绍2:

功能用途

  • 操作网页:可模拟人类操作网页浏览器,能进行点击、滚动、输入等操作,例如在 OpenTable 上预订餐厅座位、在 Instacart 上购物、在 StubHub 上搜索选购比赛门票、通过 DoorDash 点餐等。
  • 多任务并行:系统支持多任务并行处理,可同时执行多个任务,运行效率高,且能保持登录状态。

技术原理

  • CUA 模型支持:由 Computer-Using Agent(CUA)模型提供支持,CUA 融合了 GPT-4o 的视觉识别能力和基于强化学习的高级推理功能,通过训练掌握了与图形用户界面(GUI)交互的能力,能像人类一样操作屏幕上的按钮、菜单和文本框,无需依赖特定的操作系统或网络 API。
  • “观察 - 计划 - 执行” 闭环:采用远程云端浏览器执行任务,通过截图识别界面元素,规划后续动作,形成 “观察 - 计划 - 执行” 的闭环,直至完成任务。

安全措施

  • 接管模式:在浏览器中输入敏感信息时要求用户接管,此时不收集或截图用户输入的信息。
  • 用户确认:完成重大操作前请求用户批准。
  • 任务限制:经过培训可拒绝某些敏感任务,如银行交易或需要高风险决策的任务。
  • 监视模式:在电子邮件或金融服务等敏感网站,对其行为进行密切监督。

性能表现

  • 基础任务出色:在基础网页操作和重复性任务方面表现出色,如搜索筛选、创建购物清单和音乐播放列表等任务成功率较高,在电商网站搜索商品时也能保持较高成功率。
  • 复杂任务待提升:处理复杂的房产搜索等任务时成功率相对较低,在处理不熟悉的 UI 界面和文本编辑时表现欠佳,常出现试错和低效操作。

开放计划

  • 首批用户:率先向订阅 200 美元 Pro 计划的美国用户开放,随后逐步扩展至 Plus、Team 和 Enterprise 级别用户。
  • 后续规划:计划后续将其整合到 ChatGPT,API 预计在数周内推出。
http://www.lryc.cn/news/527145.html

相关文章:

  • 【Python】导入类
  • Deepseek实现本地电影文件批量重命名为infuse格式,可匹配IMDB
  • Nginx部署的前端项目刷新404问题
  • Boot 系统选择U启动
  • XSLT 编辑 XML:深度解析与实际应用
  • 项目文章 | PNAS 斑马鱼转录因子ChIP-seq助力解析GATA6突变相关的肝脏疾病机制
  • easyexcel-导入(读取)(read)-示例及核心部件
  • 作业day3
  • 第五节 MATLAB命令
  • Oracle 普通用户连接hang住处理方法
  • 理解C++中的右值引用
  • 02-机器学习-核心概念
  • 1.26 实现文件拷贝的功能
  • ES6+新特性,var、let 和 const 的区别
  • HarmonyOS简介:HarmonyOS核心技术理念
  • 嵌入式C语言:结构体对齐
  • 【Rust自学】15.5. Rc<T>:引用计数智能指针与共享所有权
  • 谈谈RTMP|RTSP播放器视频view垂直|水平反转和旋转设计
  • decison tree 决策树
  • GO语言 链表(单向链表
  • Java:初识Java
  • Spring WebSocket 与 STOMP 协议结合实现私聊私信功能
  • 从0到1:C++ 开启游戏开发奇幻之旅(一)
  • 基于Flask的哔哩哔哩综合指数UP榜单数据分析系统的设计与实现
  • 在php中怎么打开OpenSSL
  • oracle 分区表介绍
  • wxwidgets直接获取系统图标,效果类似QFileIconProvider
  • Arduino大师练成手册 -- 控制 PN532 NFC 模块
  • 解决日志中 `NOT NULL constraint failed` 异常的完整指南
  • C动态库的生成与在Python和QT中的调用方法