刚刚曝光的 Claude3,直击 OpenAI 最大弱点

作为 OpenAI GPT3 研发负责人的创业项目,Anthropic 被视为最能与 OpenAI 抗衡的一家创业公司。

当地时间周一,Anthropic 发布了一组 Claude 3 系列大模型,称其功能最强大的模型在各种基准测试中均优于 OpenAI 的 GPT-4 和 Google 的 Gemini 1.0 Ultra。

但是,能处理更复杂的推理任务、更智能、更快响应,这些跻身大模型 Top3 的综合能力只是 Claude3 的基本功。

刚刚曝光的 Claude3,直击 OpenAI 最大弱点

Anthropic 致力于成为企业客户的最佳拍档

这是首先体现在 Claude3 是一组模型:Haiku、Sonnet 和 Opus,让企业客户根据自身场景选择不同性能、不同成本的版本。

其次,Anthropic 强调自家模型是最安全的。Anthropic 总裁 Daniela Amodei 介绍,在 Claude3 的训练中引入了一种叫做“宪法人工智能”的技术,增强其安全、可信、可靠

在看完 Claude3 的技术报告后,爱丁堡大学大模型和推理方向博士生符尧称,Claude3 在一些复杂推理的基准测试上表现尤其显著,尤其在金融和医疗领域,作为一家 ToB 公司,Anthropic 选择优化最挣钱的领域。

现在,Anthropic 在 159 个国家开放使用 Claude3 系列的两款模型(Haiku 和 Sonnet),最强版本 Opus 也即将推出。同时,Anthropic 也通过亚马逊和谷歌的云平台提供服务,后者曾分别向 Anthropic 注资 40 亿美元和 20 亿美元

一、更智能、响应更快的Claude3 家族:Opus、Sonnet 和 Haiku

据 Anthropic 官网,Claude3 是一系列模型,包含三种最先进的模型:Claude 3 Haiku、Claude 3 Sonnet 和 Claude 3 Opus,允许用户为其特定应用选择智能、速度和成本的最佳平衡。

在模型的通用能力上,Anthropic 称 Claude 3 系列“为广泛的认知任务树立了新的行业基准”,在分析和预测、细致内容的生成、代码生成以及西班牙语、日语和法语等非英语语言对话方面,显示出更强大的能力,在任务响应上也更及时。

其中,Claude 3 Opus 是这组模型中最智能的模型,尤其在高度复杂的任务处理上。Opus 在大多数常见的评测基准中都优于同行,包括本科水平专家知识(MMLU)、研究生水平专家推理 (GPQA)、基础数学(GSM8K)等。它在复杂任务上表现出接近人类水平的理解力和流畅性,是目前 Anthropic 对于通用智能最前沿的探索,“展示了生成式人工智能的外部极限”。

刚刚曝光的 Claude3,直击 OpenAI 最大弱点

Claude 3 Sonnet 在智能水平和响应速度之间实现了理想的平衡,尤其对于企业场景下的任务。与同类产品相比,它以更低的成本提供了强大的性能,并且专为大规模人工智能部署中的高耐用性(high endurance)而设计。对于绝大多数工作负载,Sonnet 的速度比 Claude 2 和 Claude 2.1 快 2 倍,且智能水平更高。它擅长执行需要快速响应的任务,例如知识检索或销售自动化。

Claude 3 Haiku 是最紧凑的模型,并且也最具成本效益。并且,它的响应速度也很快,可以在不到三秒的时间内阅读 arXiv 上包含图表、图形的信息以及数据密集的研究论文(约 10k token)。

二、瞄准企业客户的迭代

联合创始人 Daniela Amodei 介绍,除了通用智能的进步,Anthropic 特别关注企业客户把生成式 AI 集成到他们的业务时,所面临的许多挑战。针对企业客户,Claude3 家族在视觉能力、准确性、长文本输入和安全方面,都有进步。

很多企业客户的知识库拥有多种格式,如PDF、流程图或演示幻灯片。现在,Claude 3 系列模型可以处理各种视觉格式的内容,包括照片、图表、图形和技术图表。

Claude3 还优化了准确性和长文本窗口的能力。

在准确性上,Anthropic 使用了大量复杂的事实问题来针对当前模型中已知的弱点,将答案分为正确答案、错误答案(或幻觉)和承认不确定性。相应地,Claude3 模型表示它不知道答案,而不是提供不正确的信息。其中最强的版本 Claude 3 Opus 在具有挑战性的开放式问题上的准确性(或正确答案)上,比 Claude 2.1 提高了一倍,同时也减少了错误答案的水平。

刚刚曝光的 Claude3,直击 OpenAI 最大弱点

同时,由于语境理解能力的提升,Claude3 家族相比之前的版本,在响应用户任务上会作出更少的拒绝回答。

除了更准确的回复,Anthropic 称将在 Claude 3 带来“引用功能,可以指向参考材料中的精确句子来验证他们的答案

当前,Claude 3 系列模型将提供 200K token 的上下文窗口。后续,所有这三种模型都能够接受超过 100 万 token 的输入,这部分能力会提供给需要增强处理能力的精选客户。Anthropic 在技术报告中简单阐述了 Claude3 的上文本窗口能力,包括有效处理更长的上下文提示词,以及回忆能力。

三、“宪法人工智能”,应对“不精确的科学”

值得注意的是,Claude3 作为多模态模型,可以输入图像,但无法输出图像内容。联合创始人 Daniela Amodei 称,这是因为“我们发现企业对图像的需求要少得多”。

Claude3 的发布是在谷歌 Gemini 生成图片引发争议后发布的,面向企业客户的 Claude 也免不了在 AI 所引发的价值观偏见等问题上的控制与平衡。

对此,Dario Amodei 强调了控制人工智能模型的难度,称其为“不精确的科学”。他表示,该公司有专门的团队致力于评估和减轻模型带来的各种风险。

另一位联合创始人 Daniela Amodei 也承认,用目前的方法可能无法实现完全无偏见的人工智能。“创建一个完全中立的生成式人工智能工具几乎是不可能的,不仅在技术上,而且还因为并不是每个人都同意什么是中立。”她说。

刚刚曝光的 Claude3,直击 OpenAI 最大弱点

尽管如此,Anthropic 用一种称为“宪法人工智能”方法来尽可能使模型和人类广泛的价值观一致,模型遵循“宪法”中定义的原则来调整优化。

作为 OpenAI 曾经的核心人发人员,Amodei 兄妹的出走跟近日马斯克对 OpenAI 的一纸诉状有相同点,认为 OpenAI 不再是一个非赢利组织,不再遵循最初使命造福人类。有记者问 Amodei,Anthropic 符合你出走创业的愿景吗?

Amodei 说:“处于人工智能发展的前沿,是引导人工智能发展轨迹为社会带来积极成果的最有效方式。”

云帆号所有文章资讯、展示的图片素材等内容均为注册用户上传(部分报媒/平媒内容转载自网络合作媒体),仅供学习参考。用户通过本站上传、发布的任何内容的知识产权归属用户或原始著作权人所有。如有侵犯您的版权,请联系我们44669190@qq.com 反馈 本站将在三个工作日内改正。转转请注明出处:https://www.yunfanhao.com/n/4447.html

(0)
小阿开的头像小阿开
上一篇 2024年 3月 5日 上午10:49
下一篇 2024年 3月 5日 下午12:00

相关推荐

  • Claude 3再度登场!验证数据显示超越GPT-4的实际效果

    Claude 3 来了!实测结果赶超 GPT-4 就在刚刚,人工智能初创公司 Anthropic 发布了新版本的 Claude 3 聊天机器人,Claude 3 由 Claude 3 Opus、Sonnet 和 Haiku (按智能强度从高到低的顺序)三种人工智能语言模型组成。 Anthropic 首席执行官兼联合创始人 Dario Amodei 表示,Cl…

    2024年 3月 5日 上午11:58
    13300
  • 2024年,生成式人工智能兴起:探索人工智能行业的新动向

    受聊天机器人ChatGPT于2022年11月推出加持,2023年成为了AI(人工智能)发展史的一个转折点,活跃的开源环境和多模态模型一同推动了AI研究的进步。 随着生成式AI持续从实验室走入现实,人们对这项技术的态度正在变得越来越成熟。对于2024年的AI发展趋势,行业专家们也给出了一些展望。在此澎湃新闻记者综合相关分析,总结出了AI在2024年中的五大发展…

    2024年 3月 5日 上午11:58
    13300
  • AI革命日程外泄?揭秘神秘模型Q*的细节曝光

    在 ChatGPT 发布之后,有哪些 AI 产品同样开始崭露头角,并吸引了用户的关注?目前的 GenAI 产品领域,有哪些发展趋向和动态值得业内人士关注?不妨来看看本文的拆解和数据分析。 ChatGPT 发布已有 9 个月,成为最快月活跃达到 1 亿的产品,开启了生成式 AI 的新时代。 除了 ChatGPT 之外,用户还在使用哪些 AI 产品,有哪些产品已…

    2024年 3月 5日 上午11:58
    13300
  • 看到Sora,好莱坞的老板砍掉了投资8亿美元的新工作室

    “这将成为一场疯狂的竞争,没有人能赢,”概念艺术家 Karla Ortiz 说,她曾参与多部漫作品的制作,并被认为是奇异博士的主要角色设计者。“这将摧毁我们的行业。” 另一位因《饥饿游戏》《变形金刚:最后的骑士》和《女国王》而受到赞誉的概念艺术家 Reid Southen 强调,许多同行感受到作品需求正在减少,“很多人准备要离开电影行业了,我也一直在想,如果…

    2024年 3月 5日 上午11:58
    13300
  • 看完Claude 3创作的OpenAI连续剧,我都替马斯克委屈

    有的企业官司缠身,有的企业“弯道超车”。 3月4日,OpenAI最强竞争对手Anthropic发布Claude 3,一夜之间成为“全球最强大模型”。有网友当即就按耐不住了,公开叫嚣OpenAI,“GPT-5呢?”、“Q*在哪里”、“Sora什么时候发布”,压力直接给到Sam Altman。 Sam你可以发布GPT5了 3月6日,有网友率先提出,Claude似…

    2024年 3月 5日 上午11:58
    13300

发表回复

登录后才能评论

联系我们

400-800-8888

在线咨询: QQ交谈

邮件:admin@example.com

工作时间:周一至周五,9:30-18:30,节假日休息

关注微信