2024年12月12日,Anthropic开始向普通用户提供其最新的人工智能模型“Claude 3.5 Haiku”。这一进展是在 2024 年 10 月 22 日发布公告并于 11 月 5 日开始提供 API 之后进行的。
主要特点
- 200,000 个代币上下文窗口
- 生成第一个Token的时间为0.8秒
- 输出速度为 65.1 个令牌/秒
主要基准分数
- SWE-bench 已验证:40.6%
- 人类评价:88.1%
- MMUL:65.0%
定价
- 使用 API 时:每 100 万个输入代币 0.80 美元,每 100 万个输出代币 4 美元
- Claude 聊天机器人:免费版(每天大约 10 次交流)和专业版(每月 20 美元)
【编辑部评论】
首先要注意的是这款车型定位的变化。 Claude 3系列定位为“高速、廉价的入门级型号”,但3.5已发展为“高速、高性能的高级型号”。这反映在定价上,输入和输出费用翻了两番。
性能方面有了显着的进步。它在编码基准 SWE-bench Verified 上取得了 40.6% 的成绩,优于之前的旗舰型号 Claude 3 Opus。这表明人工智能模型在变得更小、更强大方面取得了技术突破。
实际上,一个主要特点是响应速度。与 ChatGPT 等其他主流 AI 聊天机器人相比,仅 0.36 秒即可快速生成第一个 Token。
。这种响应能力在实时交互很重要的情况下尤其有价值,例如客户服务或教育平台。
然而,目前也存在一些限制。不包括图像生成和网页浏览功能,因此需要这些功能的用户应考虑其他型号。
有趣的是,Anthropic 正在并行开发其 API 和聊天机器人产品。我们采用了灵活的提供格式,让您可以根据自己的使用情况进行选择,通过 API 使用按量付费,而聊天机器人则按月包月。
这种模式的出现也是AI民主化的标志。通过以更实惠的价格提供高性能人工智能模型,我们为中小型企业和初创企业打开了先进人工智能利用之门。
展望未来,该模型可能成为人工智能应用开发的新标准。特别是,快速响应和先进推理能力的结合可能会创造出超越传统权衡的新用例。
然而,我们还需要考虑提高模型性能所带来的责任问题。尽管Anthropic强调安全性评估,但也会要求用户制定适当的使用指南。
- 【术语解释】第一个 Token 生成时间
: - AI 开始第一次响应的时间。 0.36秒接近人类谈话的自然节奏。人类评估
: - 评估编程能力的基准。 88.1% 与人类程序员相当。MMUL
:
衡量数学推理能力的基准。 65.0% 的人具有高级数学思维能力。
- [参考链接]人智官方网站
(外部) - Anthropic 的官方网站,这是一家开发人工智能、注重安全和道德的公司。发布最新的AI模型和研究成果克劳德·艾尔
(外部)
