Gemini 2.0发布,原生多模态支持音频图像生成


谷歌DeepMind发布Gemini 2.0 Flash模型,这是首个实现原生多模态输入输出的大模型。DeepMind CEO Hassabis表示,该模型性能超越1.5 Pro版本,在相同成本下实现全面升级。新模型不仅能完成原有任务,还新增原生音频和图像生成能力,为AI Agent发展奠定基础。同

谷歌DeepMind发布Gemini 2.0 Flash模型,这是首个实现原生多模态输入输出的大模型。DeepMind CEO Hassabis表示,该模型性能超越1.5 Pro版本,在相同成本下实现全面升级。新模型不仅能完成原有任务,还新增原生音频和图像生成能力,为AI Agent发展奠定基础。同时发布的还有Project Astra助手、浏览器Agent助手Mariner和代码助手Jules。目前已在网页端开放使用。

推荐理由:谷歌发布重大模型升级,实现原生多模态突破,推动AI Agent发展

来源:极客公园|原文时间:2026-09-28

原文链接:http://www.geekpark.net/news/371326

原题:Gemini 2.0发布!主打Agent+多模态,性能超1.5 Pro、可直接生成音频、图片



扫描二维码,在手机上阅读

2026年9月28日 星期一 日报汇总

OpenAI正式发布Sora视频生成工具

评 论
评论已关闭