智能日报
业界资讯 智能手机 电脑硬件 平板电脑 智能手表 智能家电 耳机音频 笔记本 热点资讯

OpenAI发布新工具:助力企业打造自主AI代理,能否跨越技术挑战?

2025-03-12来源:ITBEAR编辑:瑞雪

在科技界万众瞩目的瞩目下,OpenAI于本周二震撼发布了全新工具套件,旨在赋能开发者与企业,利用OpenAI的尖端AI模型和框架,打造能够自主执行任务的智能代理系统。这些创新工具作为OpenAI新推出的Responses API的核心组成部分,预示着AI代理技术迈入了一个全新的发展阶段。

Responses API的推出,标志着OpenAI正逐步取代其原有的Assistants API,计划在2026年上半年全面完成这一过渡。通过该API,企业得以开发定制化的AI代理,这些代理能够执行诸如网络搜索、公司内部文档检索以及网页浏览等复杂任务,其功能与OpenAI的Operator产品不相上下。

尽管近年来科技界对于AI代理的炒作声浪此起彼伏,但真正能够清晰定义并展示AI代理实际应用价值的案例却寥寥无几。例如,中国初创公司Butterfly Effect近期推出的Manus AI代理平台,虽然在网络上引发了广泛关注,但很快便因未能兑现诸多承诺而遭到用户的质疑。

面对这一挑战,OpenAI深知让AI代理稳定运行并广泛应用的难度之大。OpenAI的API产品负责人Olivier Godement在接受采访时坦言:“展示AI代理的功能或许轻而易举,但要想将其规模化应用,并让用户频繁使用,却是难上加难。”

为了破解这一难题,OpenAI在今年早些时候通过ChatGPT引入了Operator和Deep Research两款AI代理工具,它们分别能够代表用户浏览网页和编制研究报告。尽管这两款工具初步展示了AI代理的潜力,但在自主性方面仍有待提升。如今,借助Responses API,OpenAI希望向开发者开放构建自主AI代理所需的组件,推动开发者创造出比现有应用更加智能的代理程序。

Responses API还内置了文件搜索工具,能够迅速扫描公司数据库中的文件以检索信息,同时保证不会在这些文件上训练模型。更重要的是,开发者可以利用OpenAI的计算机使用代理(CUA)模型,该模型为Operator提供了强大的支持,能够生成鼠标和键盘操作,自动化执行数据输入、应用程序工作流等任务。

然而,值得注意的是,Responses API并不能一蹴而就地解决当前AI代理面临的所有技术难题。尽管AI搜索工具在准确性方面相较于传统AI模型有所提升,但仍存在10%的事实问题错误率。同时,AI搜索工具在处理简短导航查询时也面临挑战,且ChatGPT的引用可靠性也备受争议。

OpenAI在官方博客中指出,CUA模型在操作系统上自动执行任务时仍不够可靠,且容易犯下“无意”错误。尽管如此,OpenAI强调这些仅是代理工具的早期版本,并承诺将持续努力进行改进。

除了Responses API外,OpenAI还推出了名为Agents SDK的开源工具包,为开发者提供了将模型与内部系统集成、实施保护措施以及监控AI代理活动所需的免费工具。这一工具包是OpenAI Swarm的升级版,后者是该公司去年年底发布的多代理编排框架。

Godement表示,他期望OpenAI能够在今年内缩小AI代理演示与实际产品之间的差距,并坚信代理将成为未来最具影响力的AI应用之一。这一观点与OpenAI首席执行官Sam Altman一月份的宣言不谋而合,Altman曾预言2025年将是AI代理进入劳动力市场的一年。

无论2025年是否真正迎来AI代理的爆发之年,OpenAI的最新发布都彰显了其从华而不实的演示转向打造具有实际影响力的工具的决心。随着技术的不断进步和应用场景的不断拓展,AI代理或将逐步成为推动社会进步的重要力量。

荣耀500 Pro规格揭晓:骁龙8 Elite加持 2亿主摄配8000mAh大电池
IT之家 11 月 14 日消息,博主 @数码闲聊站 今日曝光了荣耀 500 Pro 手机的核心规格,这款新机将于近期上市。 IT之家整理如下:6.55 英寸 2736*1264p 120Hz 中屏 骁龙…

2025-11-15

Apple Store应用6.6版焕新登场:液态玻璃设计带来视觉与交互新体验
2025-11-14 08:20:29 作者:狼叫兽 今日,iPhone与iPad平台的AppleStore应用迎来6.6版本更新,此次更新引入了全新设计的应用图标,并对界面进行了视觉升级,以适配iOS 2…

2025-11-14

中芯国际三季度业绩亮眼:月产能破百万,全年收入或创新高
赵海军指出,中国区收入的显著增长主要受益于国内产业链自主化进程加快,为应对客户紧急需求,公司及时优化了产能分配策略。赵海军补充表示,在当前国内企业加速替代海外供应链的背景下,公司长期合作的客户成功把握了市场机…

2025-11-14

华为Mate70 Air深度体验:打破常规,超大屏“Air”的另类演绎
可以确定,华为Mate70 Air的影像没有因为“Air”的定义做妥协,在同价位机型中是能打的,硬件配置方面也是这个思路。这也符合华为Mate70 Air的技术路径,虽然重量不可避免地来到208g,但是保…

2025-11-14

iPhone17系列销售势头猛 本周国内激活量或冲破1000万台大关
【CNMO科技消息】11月14日,据数码博主爆料称,iPhone17系列国内激活量将于本周突破1000万台。截至11月2日,该系列在国内的激活数量已突破825万台,其中iPhone 17 Pro Max约3…

2025-11-14

京东11.11平板教育品类齐发力 办公游戏平板热销 智能学习设备受青睐
直播渠道同样表现抢眼,联想小新Pro GT、荣誉平板GT2 Pro、小米平板7 Pro获得观众最多青睐。在新兴的闺蜜机品类中,海信、小度添添、小米占据品牌领先地位,海信大白闺蜜机X8 Pro、小度添添闺蜜机…

2025-11-13

iQOO Neo11深度评测:骁龙8至尊版搭配Q2芯片,2K屏+7500mAh续航再掀性能风暴
去年的iQOO Neo10 依靠骁龙8 Gen3与1.5K屏,可谓是在2K价位段打出了一记漂亮的性能铁拳。在《王者荣耀》中,Neo11能稳定144Hz超满帧运行,帧率曲线几乎是一条直线。无论是《王者荣耀》1…

2025-11-13

谷歌入局私有AI计算:融合云端与端侧AI,隐私保护或成行业新标杆
该平台的核心目标是服务 Pixel 10 及后续手机,在严格保障用户隐私的前提下,为 Magic Cue 等功能注入更强大的云端 AI能力,该媒体认为这标志着谷歌在端侧 AI 与云端 AI 的融合上迈出了…

2025-11-12

摩托罗拉Edge 70 Ultra现身跑分平台,处理器型号成谜引猜测
IT之家 11 月 11 日消息,据科技媒体 NoteBook Check 今天报道,摩托罗拉上周刚刚推出 Edge 70 手机(对应国行版联想moto X70 Air),如今种种蛛丝马迹证明这家公司计划进…

2025-11-12

Viwoods AiPaper Reader电纸书来袭:AI互动阅读 6.13英寸墨水屏新体验
IT之家 11 月 11 日消息,据科技媒体 NoteBook Check 今天报道,Viwoods 现已推出 AiPaper Reader电纸书,运行 Android 16 操作系统,机身配备专用 AI …

2025-11-12