Auto Byte

专注未来出行及智能汽车科技

微信扫一扫获取更多资讯

Science AI

关注人工智能与其他前沿技术、基础学科的交叉研究与融合发展

微信扫一扫获取更多资讯

「草莓」即将上线,OpenAI新旗舰大模型曝光,代号「猎户座」

ChatGPT 要进化了?

本月初,OpenAI 创始人、CEO 山姆・奥特曼突然在 X 上发了一张照片,勾起了大家强烈的好奇心。

图片

「四个红草莓,其中还有一个未成熟的青色草莓,这不妥妥地是在说下一代 AI 大模型 GPT-5 要来了吗?」奥特曼在回应网友时也在暗示,惊喜马上就来。

图片

据科技媒体 The Information 报道,传说中的「草莓」真的要来了!

两位参与该项目的人士表示,OpenAI 计划最早在今年秋天推出代号为 「草莓」(之前称为 Q*,发音为 Q Star)的新人工智能,作为聊天机器人的一部分(可能集成在 ChatGPT 内)。「草莓」 可以解决它以前从未见过的数学问题(这是当今的聊天机器人无法准确做到的),并且训练后还可以解决涉及编程的问题,但它并不局限于回答技术问题。

据 The Information 报道,OpenAI 正在开发新旗舰 LLM,代号「Orion」。该模型旨在改进去年年初推出的现有旗舰 LLM——GPT-4。

而「草莓」旨在改进即将推出的「Orion(猎户座)」,并且 OpenAI 已经向安全监管人员展示了「草莓」模型。较小版本的「草莓」可以以聊天机器人的形式推出。

知情人士表示:OpenAI 正在使用较大版本的「草莓」来生成用于训练 Orion 的数据。这种人工智能生成的数据被称为「合成数据」。这意味着「草莓」可以帮助 OpenAI 克服获取足够高质量数据的限制,以便利用现实世界的数据(例如从互联网上提取的文本或图像)训练新模型。

当给予额外的「思考」时间时,「草莓」可以回答用户更主观的问题,例如产品营销策略。

OpenAI 推出「草莓」是为了保持对话式人工智能或大型语言模型的霸主地位。该技术还将对未来完成多步骤任务的智能体产品产生影响。 OpenAI 希望在智能体领域开辟更多收入机会。

为什么「草莓」对「Orion」如此重要

「草莓」最重要的应用之一是为下一代旗舰大语言模型 Orion 生成高质量的训练数据。该代号此前从未被报道过。

简单来说,「草莓」 可以生成更高质量的训练数据。智能体初创公司 Minion AI 的首席执行官、GitHub Copilot 的前首席架构师 Alex Graveley 表示,使用「草莓」生成更高质量的训练数据可以帮助 OpenAI 减少其模型生成的错误(也称为幻觉)数量,他还指出之所以能够做到这一点,是因为「训练数据中的歧义性较少」。

这里不得不提一下,OpenAI CEO 山姆・奥特曼在五月份的一次活动中曾说道:「我们觉得我们已经为下一个模型提供了足够的(数据),我们做了各种各样的实验,包括生成合成数据。」下一个模型可能指的就是「Orion」。

OpenAI 内部也在推动通过一种称为蒸馏(distillation)的过程来简化和缩小「草莓」。

现在还不能确定基于「草莓」的最终的产品将会是什么样子,但一个显而易见的想法是将「草莓」的推理能力融入到 ChatGPT。其结果是答案可能会更准确,但可能会更慢。

这意味着「草莓」可能不太适合用户期望立即得到响应的需求,但非常适合对时间不太敏感的用例。

或许我们可以想象,在不久的将来,ChatGPT 用户可以根据自身对时间的敏感程度来打开或关闭「草莓」。

今年夏天,OpenAI 已经向安全监管人员展示了「草莓」模型。此次演示可能是 OpenAI 努力向政策制定者提高透明度的一部分。

鉴于今年早些时候,Ilya Sutskever 等几位安全负责人的离职,对 OpenAI 来说,技术透明将尤其重要。

参考链接:
https://www.theinformation.com/articles/openai-races-to-launch-strawberry-reasoning-ai-to-boost-chatbot-business?rc=ks2jbm
https://www.theinformation.com/articles/openai-shows-strawberry-ai-to-the-feds-and-uses-it-to-develop-orion?rc=ks2jbm
产业OpenAI
1
相关数据
人工智能技术

在学术研究领域,人工智能通常指能够感知周围环境并采取行动以实现最优的可能结果的智能体(intelligent agent)

聊天机器人技术

聊天机器人是经由对话或文字进行交谈的计算机程序。能够模拟人类对话,通过图灵测试。 聊天机器人可用于实用的目的,如客户服务或资讯获取。有些聊天机器人会搭载自然语言处理系统,但大多简单的系统只会撷取输入的关键字,再从数据库中找寻最合适的应答句。

语言模型技术

语言模型经常使用在许多自然语言处理方面的应用,如语音识别,机器翻译,词性标注,句法分析和资讯检索。由于字词与句子都是任意组合的长度,因此在训练过的语言模型中会出现未曾出现的字串(资料稀疏的问题),也使得在语料库中估算字串的机率变得很困难,这也是要使用近似的平滑n元语法(N-gram)模型之原因。

推荐文章
暂无评论
暂无评论~