一种新型人工智能模型本周首次亮相,对于基于 Transformer 架构构建的模型来说,它做了一些不寻常的事情:它从不生成任何文本。据 TechCrunch 报道,Jev 由成立两年的初创公司 TypeSafe AI 发布,而是输出校准概率(该公司称之为类型化、校准决策),将自己定位为用于分类、路由和自动化工作的大型语言模型的廉价、快速替代品。
该公司由 OpenAI 研究员迪奥戈·阿尔梅达 (Diogo Almeida) 创立,他帮助构建了 ChatGPT,并为人类反馈强化学习 (RLHF) 的发明做出了贡献,这种训练技术被广泛认为塑造了当前一代人工智能助手。对新模型的需求非常强烈,以至于 TypeSafe 在推出后暂时失去了为某些 API 用户提供服务的能力。 更多相关背景,请参阅我们的AI行业报道。
为什么 ChatGPT 先锋放弃了语言
Almeida 的非文本模型之路始于对 OpenAI 的失望。 “我们有瓶装闪电,但它并没有什么用,”阿尔梅达告诉 TechCrunch,他描述了他的挫败感,尽管 ChatGPT 有能力,但该技术还达不到真正的自动化。 “从那时起我就一直在与这个问题作斗争。我花了一段时间才得出结论:问题是我们正在针对人类语言进行优化......四年来我们一直非常擅长人类语言,但这对自动化没有用,因为计算机说的是不同的语言。”
两年前,Almeida 离开 OpenAI,创立了 TypeSafe AI 并继续研究该论文。结果是 Jev,一个基于 Transformer 的模型,该公司坚称它不是一个大型语言模型。当法学硕士生成开放式文本时,Jev 返回用户预先定义的一组输出的概率——该公司表示,这种设计在结构上使幻觉成为不可能,因为模型只能回答给出的选项。
效率提升是宣传的核心部分。据 TechCrunch 称,Jev 的输出代币是免费的,输入代币按十亿而不是百万计量。该公司将 Jev 描述为“系统一模型”,专注于直觉而不是推理,并表示它使用一种阿尔梅达称之为“校准决策强化学习”的技术专门针对合成数据进行训练。
TypeSafe 一直对 Jev 的架构保密,尽管外部观察者怀疑该系统是建立在开放式法学硕士之上的。 “[我们公司] 的一半是一个实验室,基本上拥有统计上易于理解的合成数据的整个子领域,这现在是我生活的乐趣,”阿尔梅达告诉 TechCrunch。
早期开发者成果:更快、更便宜
早期采用者在测试中报告了显着的进步。 Vercel 的软件工程师 Pranit Sharma 告诉 TechCrunch,他的公司一直在使用 OpenAI 的 ChatGPT Luna 5.6 来运行一个分类器,用于检查命令的安全性。将工作负载转移给 Jev 后,Vercel 的结果速度提高了 5 到 18 倍,准确性也提高了。
Byo AI 的首席技术官 Nikhil Mudholkar 进行了不同的比较:使用 Jev 与 Google 的 Gemini 对商业电子邮件进行分类。在他的测试中,Gemini 的准确度稍高一些,但价格却贵了 10 到 20 倍。对于 Mudholkar 来说,Jev 最有价值的资产是其对不确定性的处理能力。他告诉 TechCrunch:“它是唯一能够返回真实概率的系统,这使其成为工作流程自动化的理想选择。”
代理观察代理,无需支付账单
TypeSafe 认为,除了在分类任务中取代法学硕士之外,Jev 还可以监管他们。使用人工智能代理来监控其他代理很快就会变得昂贵,但 Almeida 认为,Jev 的速度和成本概况使得跟踪 LLM 代理跟踪并实时防止越狱变得可行。
Earendil 的首席技术官兼开源模型工具 Pi 的构建者 Armin Ronacher 告诉 TechCrunch,这种方法将不确定性的责任转移给了开发人员。 “它将幻觉问题稍微委托给了用户,”罗纳彻说。 “用户必须说,好吧,如果只有 50% 的概率返回,也许这是抛硬币,我会忽略它。但如果是 95%,当然,那么我可以用它做点什么。”
Ronacher 还将模型路由标记为一个有前途的用例:预测给定的工作负载是否需要特定的、更昂贵的模型。使用法学硕士进行排序的成本很高,但 Jev 的低延迟和价格可以使实时路由变得可行。
借用经济学的名字
该模型以威廉·斯坦利·杰文斯 (William Stanley Jevons) 的名字命名,他是杰文斯悖论背后的 19 世纪经济学家——观察到,随着商品变得更便宜,其消费往往会增加。阿尔梅达的赌注是,决策级智能成本的下降将导致其在任何地方的部署,而不仅仅是在旗舰聊天机器人中。
阿尔梅达告诉 TechCrunch:“我们认为,智能软件将会以一种新兴的、分布式的方式遍布各处……更像是早期的互联网,而不是你所知道的人们现在正在尝试构建的大型应用程序。”
竞争对手是否效仿仍然是一个悬而未决的问题。 “我们应该在很多方面早点看到这一点,但大概是因为法学硕士非常便宜并且有补贴,你通常不需要有创造力,”罗纳彻告诉 TechCrunch。 TypeSafe 计划以新的方式提供 Jev 的其他版本。
至于 TypeSafe 是否算作前沿实验室,阿尔梅达给出了一个尖锐的答案:“前沿实验室的主要产品是恐惧或炒作。我希望我们的主要产品是智能……(但我们)不是那种意义上的实验室,你知道,就像赌上无限的财富,或者宗教,或者在数据中心建造上帝,或者任何当今的事情。”
---
掌握AI最新动态获取最新的AI新闻、分析和突破——尽在一处。
阅读更多AI新闻 →