注册并分享邀请链接,可获得视频播放与邀请奖励。

Gorden Sun (@Gorden_Sun) “Span-01:专门用来监测和评估其他AI的模型 质检专用版Jev。 以往监测 AI 是否犯错,很” — TopicDigg

Gorden Sun 的个人资料封面
Gorden Sun 的头像
Gorden Sun
@Gorden_Sun
加入 August 2013
0 正在关注    0 粉丝
Span-01:专门用来监测和评估其他AI的模型 质检专用版Jev。 以往监测 AI 是否犯错,很多团队习惯直接调用 GPT 这样的大型语言模型来逐字打分,或者使用传统的分类程序。传统的分类程序运行速度快,但面对未见过的全新问题时容易失误;大型通用模型虽然判断准确,但逐字输出的机制导致运行速度慢,花费也很高。 Span-01 解决了这个问题。它把推理和判定合在了一次运算中完成,直接输出结果概率。就算面对开发人员临时给出的全新判定规则,Span-01 也能一边看懂长对话记录,一边同时核对多条规则。 在针对 AI 实际表现的测试中,Span-01 在发现越狱攻击、隐私泄露、胡言乱语以及工具调用错误等问题上的表现,综合得分超过了同类的专用小模型,也超过了部分主流大型模型。 费用方面,官方推出了完全免费的 Span-01 Lite 版本,而完整版 Span-01 每百万输入词元的调用费用为 0.02 美元。 怎么一下子冒出好多这种模型? 官方介绍:
显示更多