微软新一代语言模型WizardLM2 8x22B发布及撤回原因解析

释放双眼,带上耳机,听听看~!
快科技报道了微软发布了新一代语言模型WizardLM2 8x22B,并突然撤回的原因,分析了幻觉测试对语言模型的重要性及可能的原因。

快科技4月21日消息,Meta发布超级彪悍的大语言模型Llama 3之后,微软也很快推出了自己的新一代WizardLM2 8x22B,号称迄今最强大,完全超越Claude 3 OpusSonnet、GPT-4等竞品,而且开源,但是马上又把它撤回去了。

没有任何征兆,微软就删除了WizardLM2大模型的相关文件、代码,而且一直没有任何公开解释。

微软的一位工程师单独给出了原因,令人啼笑皆非。

原来,微软已经几个月没有发布新的大模型,对上新流程有些陌生,居然忘了必需的幻觉测试(toxicity test),目前正在抓紧补测,很快就会重新上线。

大语言模型的幻觉”分为两种,一是事实性幻觉,指模型生成的内容与可验证的现实世界事实不一致,二是忠实性幻觉,指模型生成的内容与用户的指令或上下文不一致。

大模型幻觉产生的原因有很多,训练数据、预训练和对齐阶段、推理阶段都会出现缺陷。

这么重要的测试都能忘掉,微软真是

微软新一代语言模型WizardLM2 8x22B发布及撤回原因解析

微软新一代语言模型WizardLM2 8x22B发布及撤回原因解析

微软新一代语言模型WizardLM2 8x22B发布及撤回原因解析

本网站的内容主要来自互联网上的各种资源,仅供参考和信息分享之用,不代表本网站拥有相关版权或知识产权。如您认为内容侵犯您的权益,请联系我们,我们将尽快采取行动,包括删除或更正。
AI资讯

制造业技能短缺与人工智能培训的解决方案

2024-4-22 8:34:20

AI资讯

Microsoft 365 Copilot:企业人工智能助手的价值和未来展望

2024-4-22 9:18:57

个人中心
购物车
优惠劵
今日签到
有新私信 私信列表
搜索