谷歌宣布:Gemini 1.5 大幅提升长文本理解能力

谷歌发布了 Gemini 1.5,一个对话式人工智能系统。这个最新版本代表了效率、性能和长格式推理能力方面的显着进步。 Google AI 负责人 Demis Hassabis 在博客文章中详细介绍了名为 Gemini 1.5 Pro 的核心模型,其性能可与该公司最大的 Gemini 1.0 Ultra 模型相媲美,但使用的计算资源更少。特别值得注意的是引入了实验性的 100 万个 token 上下文窗口,这代表了长文本理解的“突破”。标准 Gemini 模型在 128,000 个令牌上下文中分析提示,但 100 万个令牌升级允许 Gemini 1.5 处理更大量的连续信息,然后生成响应。

谷歌首席执行官桑达尔·皮查伊(Sundar Pichai)引用了总结整个阿波罗11号任务记录并全面分析44分钟无声电影的能力作为Gemini 1.5扩展推理能力的例子。这种扩展的上下文使 Gemini 1.5 能够在给定提示内“无缝地分析、分类和总结”大量内容。

目前尚不清楚 Gemini 1.5 何时发布,但谷歌目前通过其 Vertex AI 平台向开发者和企业用户提供有限预览。谷歌表示,Gemini 1.5 的效率改进将使其能够比以往更快地迭代、训练和交付更高级的 Gemini 版本。谷歌还致力于以负责任的方式开发Gemini,Gemini 1.5经过了广泛的道德和安全测试,重点关注内容安全和表达伤害等领域。

自去年年底宣布 ChatGPT 以来,对话式人工智能的进步急剧加速。专家指出,较低的培训成本和创新(例如谷歌的稀疏门控混合专家架构)使得新迭代的开发速度比过去的人工智能系统快得多。通过 Gemini 1.5,谷歌表明了其在人工智能竞赛中保持领先地位的意图。

【新闻评论】

谷歌公布了最新的对话式AI系统“Gemini 1.5”,其在性能和效率上取得了重大进步,成为热门话题。这个新版本显示了显着的进步,特别是在理解长文本的能力方面,使其能够比以前的模型处理和分析更多的信息。

Gemini 1.5 最显着的特点是它拥有前所未有的 100 万个代币的上下文窗口。这使得人工智能能够同时理解和处理比以前更长的文本和数据。例如,它将能够执行传统人工智能难以完成的任务,例如总结阿波罗 11 号任务的整个记录​​或全面分析一部无声电影。

技术的进步意味着人工智能将变得更有能力像人类一样处理和理解复杂的信息。预计这将在研究、教育和娱乐等各个领域得到应用。例如,可以即时分析和总结大量文献和数据,使研究人员的工作更加高效,教育内容更加易于获取。

然而,如此先进的人工智能技术的发展也伴随着伦理问题和安全风险。例如,传播错误信息的能力也会增加,需要更严格的检查以确保内容的安全性和准确性。此外,在隐私保护和数据安全方面还需要更先进的措施。

谷歌表示,它在开发 Gemini 1.5 时进行了广泛的道德和安全测试。这表明我们致力于负责任地管理技术进步对社会的影响。然而,随着人工智能技术的快速发展,法规和指南需要迅速到位。

未来,像Gemini 1.5这样的人工智能可能会进一步发展,人机协作可能会变得司空见惯。这有可能极大地扩展人类的能力并产生新的创造力和发现。然而,为了实现这一目标,重要的是要以与技术进步相同的速度考虑和回应道德考虑和社会可接受性。

谷歌推出 Gemini 1.5,具有百万代币上下文窗口的下一代人工智能模型