OpenAI强势更新!增加函数调用能力,更便宜,更快,允许更长文本

AI权益加码!Claude Code、Cursor等20+工具免费用! 购周边限时加赠Coding Plan Lite,畅享主流AI工具!学习进阶高效! 阅读详情

6月13日,OpenAI官网宣布“更新更可调的API模型、函数调用功能(Function calling)、更长的上下文和更低的价格”,发布更高效更低成本的版本。

我也是第一时间接入了gpt-3.5-turbo-16k
有想要体验的小伙伴可进公众号:AI研究工厂
或者进:https:www.ggchat.com.cn
小程序:GG智能问答机器人

主要更新如下:

1、新功能:在Chat Completions API中添加了新的函数调用能力,能让模型在需要的时候调用函数并生成对应的JSON对象作为输出。这使开发人员能更准确地从模型获取结构化数据,实现从自然语言到API调用或数据库查询的转换,也可以用于从文本中提取结构化数据。

(也就是经过OpenAI的微调后,你跟它说人话,它就能识别后给你转换成函数,进一步不需要编程也能实现编程的能力了,并且还能更方便从混乱结构里获取结构化数据)

2、模型更新:更新了更可控制的gpt-4和gpt-3.5-turbo版本,以及gpt-3.5-turbo的新16k上下文版本,相比标准的4k版本能处理更长的文本。

(可以支持20页文本了!)

3、模型弃用:公布了gpt-3.5-turbo-0301和gpt-4-0314模型的弃用时间线。这些模型的用户可以在特定时间之前选择升级到新的模型,过了这个时间后,旧模型将不再可用。

4、价格调整:最先进的嵌入模型的价格降低了75%,gpt-3.5-turbo的输入代币价格降低了25%。

(Sam Altman最近在巡游里到处说会继续降价,这不就来了。而且要降就是最强模型脚踝斩式的降价。最新价格,每1k token,0.0001美金)

OpenAI还强调了一下,所有的这些模型都继续保持在3月1日推出的数据隐私和安全保证 —— 客户拥有他们请求生成的所有输出,他们的API数据不会被用于训练。通过这些更新,我们将邀请更多的等待名单上的人尝试GPT-4,我们期待看到你使用GPT-4构建的项目!我们鼓励开发者反馈,以帮助我们确保模型更新的平稳过渡。

其中最重磅的更新是函数调用能力。

据OpenAI介绍,开发者现在可以向gpt-4-0613和gpt-3.5-turbo-0613两个模型描述函数,并让模型智能地选择输出一个包含参数的JSON(JavaScript Object Notation,一种数据交换的文本格式)对象,来调用这些函数。若将GPT功能与外部工具或API进行连接,这种方法更加可靠。

在英伟达首席科学家Jim Fan看来,函数调用=更好利用API工具=更强大的LLM与数字执行器(Digital Actuator)。

简单来说,GPT不再需要开发者描述复杂的提示语,它自己能够决定是否动用外部工具来解决问题,不仅显著提高了反应速度,还大大降低了出错的可能性。

然后就是大幅降价

官网公告显示,不同版本降价幅度不同,OpenAI最先进、用户最多的嵌入模型Text-embedding-ada-002降价75%;用户最多的聊天模型gpt-3.5-turbo降价25%。

此外,OpenAI还推出了gpt4-16k平替版——gpt-3.5-turbo-16k,价格为每输入1000 tokens 0.003美元,相当于降价95%!

值得注意的是,gpt-3.5-turbo-16k能够实现16000 tokens的上下文长度,相当于普通版gpt-3.5-turbo的4倍。而在价格方面,gpt-3.5-turbo-16k只是gpt-3.5-turbo的两倍。

不过,该模型一次只能读取大约20页的文本,明显低于AI初创公司Anthropic的旗舰模型,该模型可以处理数百页文本。

也与此同时,OpenAI宣布,未来几周内将邀请更多人试用GPT-4。

以下为公告全文:

今年初我们发布了gpt-3.5-turbo和gpt-4模型,仅仅几个月的时间,我们已经看到开发者们在这些模型上构建出了令人难以置信的应用。今天,我们要跟进一些令人兴奋的更新:

· Chat Completions API中新的函数调用功能

· 更新并增加可控制性的gpt-4和gpt-3.5-turbo版本

· gpt-3.5-turbo的新16k上下文版本(与标准4k版本对比)

· 我们最先进的嵌入模型的价格降低了75%

· gpt-3.5-turbo输入令牌的价格降低了25%

· 公布gpt-3.5-turbo-0301和gpt-4-0314模型的弃用时间线

所有这些模型都带有我们在3月1日推出的相同的数据隐私和安全保证——客户拥有他们的请求生成的所有输出,他们的API数据不会被用于训练。函数调用

开发者现在可以描述函数到gpt-4-0613和gpt-3.5-turbo-0613,并让模型智能地选择输出包含调用这些函数的参数的JSON对象。这是一种更可靠地将GPT的能力与外部工具和API连接的新方法。这些模型已经被微调,既能检测出何时需要调用函数(取决于用户的输入),又能回应符合函数签名的JSON。函数调用让开发者能更可靠地从模型获取结构化数据。例如,开发者可以:

· 创建通过调用外部工具(如ChatGPT插件)来回答问题的聊天机器人;

· 将“询问Anya是否想在下周五喝咖啡”这样的问题转换为诸如send_email(to: string, body: string)的函数调用,或者“波士顿现在的天气怎么样?”转换为get_current_weather(location: string, unit: ‘celsius’ | ‘fahrenheit’);

· 将自然语言转换为API调用或数据库查询;

· 将“这个月我的前十名客户是谁?”转换为内部API调用,如get_customers_by_revenue(start_date: string, end_date: string, limit: int),或者“上个月Acme, Inc.下了多少订单?”使用sql_query(query: string)转换为SQL查询;

· 从文本中提取结构化数据;

· 定义一个名为extract_people_data(people: [{name: string, birthday: string, location: string}])的函数,从维基百科文章中提取所有提到的人物。

这些用例都由我们的/v1/chat/completions端点中的新API参数,functions和function_call实现,这些参数允许开发者通过JSON Schema向模型描述函数,并选择性地要求它调用特定的函数。请开始使用我们的开发者文档,如果您发现哪些情况下函数调用可以得到改进,请添加评估。

函数调用示例

现在波士顿的天气怎么样?

步骤1

OpenAI API

使用函数和用户的输入调用模型

步骤2

第三方API

使用模型的响应调用你的API

步骤3

OpenAI API

将响应发送回模型进行总结波士顿现在的天气是晴朗的,温度为22摄氏度。自从ChatGPT插件的alpha版本发布以来,我们对如何使工具和语言模型安全地协同工作了解了很多。然而,仍然存在一些开放的研究问题。例如,一个概念验证漏洞说明了如何从工具的输出中获取不受信任的数据,使模型执行未预期的行动。我们正在努力减轻这些和其他风险。开发者可以通过只使用来自受信任的工具的信息,并在执行具有现实世界影响的行动,如发送电子邮件,在线发布,或进行购买之前,包括用户确认步骤来保护他们的应用。

新模型

GPT-4

gpt-4-0613包括了更新和改进的模型,以及函数调用功能。

gpt-4-32k-0613包括了与gpt-4-0613相同的改进,以及增加的上下文长度,用于更好地理解较大的文本。

有了这些更新,我们将在未来几周内邀请更多的等待名单上的人来试用GPT-4,我们的目标是完全取消这个模型的等待名单。感谢所有耐心等待的人们,我们很期待看到你们用GPT-4构建的作品!

GPT-3.5 Turbo

gpt-3.5-turbo-0613包括了与GPT-4相同的函数调用功能,以及通过系统消息更可靠地控制性,这两个特性都允许开发者更有效地引导模型的回应。

gpt-3.5-turbo-16k提供了gpt-3.5-turbo四倍的上下文长度,但价格是双倍的:每1K输入令牌$0.003,每1K输出令牌$0.004。16k的上下文意味着模型现在可以在一次请求中支持大约20页的文本。

模型弃用

今天,我们将开始为我们在3月宣布的gpt-4和gpt-3.5-turbo的初始版本升级和弃用的过程。使用稳定模型名称的应用(gpt-3.5-turbo,gpt-4,和gpt-4-32k)将在6月27日自动升级为上面列出的新模型。为了比较模型版本之间的性能,我们的Evals库支持公共和私有评估,以展示模型变化将如何影响你的用例。

需要更多时间进行过渡的开发者可以通过在他们的API请求的‘model’参数中指定gpt-3.5-turbo-0301,gpt-4-0314,或gpt-4-32k-0314来继续使用旧模型。这些旧模型将在9月13日之后仍然可以访问,之后指定这些模型名称的请求将失败。你可以通过我们的模型弃用页面来了解模型弃用的最新信息。这是对这些模型的第一次更新;因此,我们非常欢迎开发者的反馈,以帮助我们确保平稳过渡。

降低价格

我们会继续提高我们的系统效率,并将这些节省下来的成本传递给开发者,即日起生效。

Embeddings

text-embedding-ada-002是我们最受欢迎的嵌入模型。今天我们将其成本降低了75%,到每1K令牌$0.0001。

GPT-3.5 Turbo

gpt-3.5-turbo是我们最受欢迎的聊天模型,为数百万用户提供ChatGPT服务。今天我们将gpt-3.5-turbo的输入令牌成本降低了25%。开发者现在可以以每1K输入令牌$0.0015和每1K输出令牌$0.002的价格使用这个模型,这相当于每美元可以处理大约700页。

gpt-3.5-turbo-16k的价格将是每1K输入令牌$0.003,每1K输出令牌$0.004。

开发者的反馈是我们平台演化的基石,我们将根据收到的建议继续进行改进。我们期待看到开发者如何在他们的应用中使用这些最新的模型和新功能。

五、OpenAi函数调用(Function Calling)(一) API调用中,您可以描述函数规范,让模型智能地选择输出包含参数的JSON对象,过程中你以调用一个或多个函数。聊天补全API自身不能调用函数;而是,让模型生成JSON,使用它调用函数代码最新的模型(gpt-3.5-turbo-0125和gpt-4-turbo-preview)已通过训练,可以检测何时应该调用函数(取决于输入),并使用模型对符合函数签名的JSON进行响应。拥有这项能力的同时也伴随着风险。我们强烈建议在采取可能影响世界范围内的用户行为之前建立用户确认流程(例如:发邮件、发布网络、购物等待) 阅读详情

相关推荐

OpenAI开发系列(十一):Function calling功能的实际应用流程与案例解析

本文给出了Chat Completions模型中Function calling功能的背景,然后详细讲解了Function calling实现过程。这包括如何构建Chat外部函数库,包括字符串形式、Json形式和函数形式的传入,还解释了如何定义functions,包括JSON与JSON Schema对象和构建外部函数的Json Schema描述。最后,对Function calling的功能实现进行了详细介绍,并对整个流程进行了总结,提供了全面且深入的理解和应用Function calling功能的指导。

无敌小怪兽_Zz的博客 8132

耗时3天整理,一篇文章学会OpenAI大杀器--function Call

想象下,你创建一个人工智能助手,你可以这样对他说:“帮我买北京的火车票,提前一天提醒我”!如果是ChatGPT的话,它必然会无情地拒绝你。ChatGPT是世界上最强大的模型,不过,它虽然知道你想让它帮你买票,但它却不懂如何买票,它能力的上限就摆在那儿了。好在OpenAI在GPT模型引入了一个强大的功能–函数调用(function call)。相信有些小伙伴应该已经用过ChatGPT的plugins功能,Plugins的功能有不少是基于function call进行的。

panz1024的博客 3581

OpenAI开发系列(十二):Function calling功能的流程优化与多轮对话实现

本文首先概述了Function calling流程的优化思路,接着分别详细介绍了两种主要的优化方法:自动编写函数和编写自动应答函数。这两种优化方法可以显著提高Function calling的效率和实用性。最后,演示了如何实现一个多轮对话函数。

无敌小怪兽_Zz的博客 5194

深入了解openaiFunction Calling(通俗易懂-可跑nodejs代码)

function-calling详解+nodejs代码示例

weixin_43805502的博客 2482

无限访问 GPT-4,OpenAI 强势推出 ChatGPT 企业版!

整理 | 屠敏出品 | CSDN(ID:CSDNnews)继 ChatGPT收费大降价、推出App 版等系列动作之后,OpenAI 于今日宣布正式发布面向企业的 AI 助手——ChatGPT Enterprise 版。与 To C 端的 ChatGPT 版本有所不同的是,该版本可以以更快速度无限制地访问 GPT-4,还可以用来处理更长输入的上下文窗口、拥有加密、企业级安全和营私以及组帐户管理功...

AI科技大本营 705

DeepSeek赋能AI Agent开发:从核心能力到实战项目全解析

AI Agent作为人工智能领域的重要分支,其核心在于模拟人类智能体的自主决策与任务执行能力。其工作原理基于大语言模型的推理规划、工具调用与上下文管理,通过函数调用等机制与外部环境交互。这一技术价值在于将通用AI能力转化为解决特定场景问题的自动化工具,显著提升工作效率与智能化水平。在应用场景上,AI Agent已广泛应用于智能客服、代码助手、数据分析、个人助理等多个领域。随着DeepSeek等模型凭借其强大的推理能力、超长上下文支持和完全免费的API策略,AI Agent开发门槛大幅降低,社区生态快速繁荣,

weixin_34393428的博客 390

OpenAI模型策略调整:免费用户应对与本地开源模型部署指南

语言模型作为人工智能领域的核心技术,通过深度学习架构实现自然语言理解与生成。其工作原理基于Transformer架构,通过海量数据训练获得强大的泛化能力。这项技术的核心价值在于赋能开发者构建智能应用,提升自动化水平。在应用场景上,大语言模型广泛用于代码生成、文档分析、智能问答等领域。随着行业竞争加剧,模型服务商开始调整访问策略,推动用户向分层服务体系迁移。面对这一趋势,开发者需要掌握本地化部署能力,例如通过Ollama框架运行DeepSeek Coder等开源模型,构建自主可控的AI开发环境,确保项目在模

weixin_29056701的博客 345

Meta Llama 3开源大模型实战:从本地部署到生产级应用指南

开源大模型正成为人工智能领域的重要基础设施,其核心价值在于通过开源生态降低技术门槛与应用成本。这类模型通常基于Transformer架构,通过大规模预训练学习通用语言表示,再经过指令微调与人类反馈强化学习(RLHF)实现与人类意图的对齐。其技术价值在于为开发者提供了可私有化部署、数据可控且成本优化的AI能力替代方案,广泛应用于智能对话、代码生成、内容创作等场景。本文聚焦Meta最新发布的Llama 3模型,深入解析其通过高质量数据、GQA注意力优化等系统工程提升的“可用性”,并提供从环境配置、Transfo

weixin_30642869的博客 387

基于LLM的智能体世界杯:构建1v1足球对抗模拟环境

智能体(Agent)作为人工智能领域的重要概念,通过感知-规划-行动-反思循环赋予系统自主决策能力。其核心原理在于将大语言模型(LLM)的推理能力与环境交互相结合,形成可执行复杂任务的自治系统。这种技术架构在自动化流程、游戏AI和动态决策系统中具有重要价值,能够处理需要多步骤推理和实时反馈的应用场景。本文以足球比赛模拟为实践案例,探讨如何构建基于LLM的智能体对抗环境,涉及Agentic设计模式和多智能体协作等关键技术,通过环境交互实现智能体的策略执行与动态博弈。

weixin_30628077的博客 277

大模型量化从0到1(十五):同一模型横向实测——BF16、AWQ、GPTQ、GGUF、NF4 与 FP8 到底谁

本文对Qwen3-8B模型进行了六种量化方案的公平比较:BF16、AWQ INT4、GPTQ INT4、GGUF Q4_K_M、bitsandbytes NF4和FP8。通过建立受控和最佳生态两条评测赛道,避免了不同推理引擎对量化算法评估的干扰。实验结果表明,没有全能冠军,最佳方案取决于具体场景:BF16是质量基线;FP8在支持硬件上表现优异;AWQ/GPTQ适合GPU本地推理;GGUF擅长跨平台部署;NF4便于快速实验。研究强调,量化评估必须结合硬件、引擎、负载和质量要求,并提供了完整的复现方法和24个常

weixin_49520696的博客 333

AI编程助手选型与Cursor高效配置实战:从模型迭代到工作流优化

人工智能技术快速发展的背景下,大语言模型(LLM)已成为提升开发效率的关键工具。其核心原理是基于海量数据训练,通过理解上下文和生成代码来辅助编程。这项技术的价值在于能将开发者从重复性劳动中解放出来,聚焦于架构设计和复杂问题解决,广泛应用于代码生成、调试、重构和文档编写等场景。面对市场上层出不穷的模型更新和价格变动,如何理性选择并高效集成到开发流程成为焦点。本文以深度集成Claude和GPT模型的Cursor IDE为例,探讨如何穿透“模型参数”和“基准测试”的营销表象,聚焦于真实工作流优化。文章将分享包括

weixin_34013044的博客 379

Python深度学习:从入门到实战

亲爱的读者,欢迎您翻开这本书。我们即将探索的,是深度学习的宇宙——一个由数据、算法与算力构筑的奇妙世界。它既是严谨的科学,也是创造的艺术,是一条通往未来智慧的修行之路。本书将带您从最基础的数学原理出发,亲手搭建神经网络,驾驭Transformer等前沿模型,最终将智慧转化为现实世界的价值。请放下畏惧,保持好奇。这不仅是一次知识的学习,是一场思维的远行。来,随我一起,开启这趟非凡的旅程吧。

weixin_45747731的博客 411

《置身钉内》原文-可播放阅读

阿里员工的《置身钉内》相信你一定有听说、或看过这样的标题,最近出差、又加上各种其他的事还有,今天拿起来看,网上流传大多是 DPF 截图版,对于工作一天再盯着长篇着实累,所以搜索到一篇文字版,可以选择语音播放。文末会放一个网盘离线版本。以下是正文:发心第一 钉钉的动物园形象钉三多,是一只尖尾雨燕,世界上平飞最快的鸟类之一。它最特殊的地方在于,可以吃喝、睡眠、交配通通在空中完成;每年从非洲飞经印度和东南亚,回中国北方繁殖,最多可以连续飞行三百多天不落地。尖尾雨燕的拉丁文是apus apus,"pus"是"脚"的

JavaPub 6629
上一篇: AI技术:探索智能时代的未来
下一篇: OpenAI强势更新!增加函数调用能力,更便宜,更快,允许更长文本
super5⁢
博客等级 码龄7年 2652粉丝 47原创
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值