全世界在等的Gemini 3终于来了,强到断崖领先,连马斯克OpenAI都夸好

智东西11月19日报道,今天凌晨,谷歌最强推理模型Gemini 3终于亮相,一个模型囊括了原生多模态、推理、Agent多种能力。谷歌DeepMind研究团队称,这是全球最先进的...

智东西11月19日报道 ,今天凌晨,谷歌最强推理模型Gemini 3终于亮相,一个模型囊括了原生多模态 、推理、Agent多种能力 。

谷歌DeepMind研究团队称 ,这是全球最先进的多模态理解模型、谷歌最强大的Agent编程和氛围编程模型,能呈现更丰富的可视化效果和更深度的交互体验,且完全构建于最先进的推理技术基础之上。

该模型基于谷歌TPU进行训练 ,支持100万个token的上下文窗口 ,适用于需要以下功能的应用:Agent 、高级编程、长上下文、多模态理解 、算法开发。

刚一发布,Gemini 3就几乎屠榜所有评测集,以1501 Elo得分位列LMArena大模型竞技场第一 。

全世界在等的Gemini 3终于来了	,强到断崖领先,连马斯克OpenAI都夸好

OpenAI联合创始人 、CEO萨姆·阿尔特曼(Sam Altman)和xAI创始人、CEO埃隆·马斯克(Elon Musk)纷纷向谷歌发来“贺信 ”。阿尔特曼发推评价“Gemini 3看起来很不错”,谷歌CEO桑达尔·皮查伊(Sundar Pichai)用了个表情包回复。

全世界在等的Gemini 3终于来了	,强到断崖领先,连马斯克OpenAI都夸好

马斯克转发了谷歌DeepMind CEO戴密斯·哈萨比斯(Demis Hassabis)的推文称“干得不错” 。

全世界在等的Gemini 3终于来了,强到断崖领先	,连马斯克OpenAI都夸好

今天起,谷歌将在以下平台部署Gemini 3:

适用于Gemini应用的所有用户,以及在搜索的AI模式中使用Google AI Pro和Ultra订阅服务的用户;适用于Gemini API中的开发者、谷歌全新Agent开发平台Antigravity的开发者 ,以及Gemini CLI的开发者;适用于Vertex AI平台与Gemini企业版的企业用户 。

此外,谷歌将在未来几周向Google AI Ultra订阅者开放Gemini 3的深度思考模式,目前其还在进行安全评估。

对于Gemini 3的发布 ,皮查伊认为 ,这一模型可以让用户的任何想法变为现实。

01.

分分钟造出交互游戏 、App

还能帮你学新知识

先来看下Gemini 3 Pro能做什么 。

Gemini 3能编写托卡马克装置中等离子体流的可视化代码,并创作捕捉核聚变物理原理的诗歌。

全世界在等的Gemini 3终于来了,强到断崖领先	,连马斯克OpenAI都夸好

如果用户想学习家族传统烹饪,Gemini 3可以解读并翻译不同语言的手写食谱,制作成可共享的家庭食谱。

全世界在等的Gemini 3终于来了	,强到断崖领先,连马斯克OpenAI都夸好

如果用户想学习一个新话题,可以给Gemini 3输入学术论文、长视频讲座或教程 ,它还能生成交互式抽认卡、可视化或其他格式的代码,帮助用户掌握这些内容 。

全世界在等的Gemini 3终于来了,强到断崖领先	,连马斯克OpenAI都夸好

Gemini 3可以分析用户的匹克球比赛视频,找出可以改进的地方,并生成整体动作提升的训练计划。

全世界在等的Gemini 3终于来了	,强到断崖领先,连马斯克OpenAI都夸好

AI搜索模式下,Gemini 3能学习复杂主题内容,如借助搜索功能中AI模式的生成式用户界面 ,学习像RNA聚合酶作用机制这类复杂知识点。值得一提的是,这也是谷歌首次在模型发布首日,就将新模型直接集成至AI搜索功能中 。

全世界在等的Gemini 3终于来了	,强到断崖领先,连马斯克OpenAI都夸好

Gemini 3可以编写拥有丰富可视化界面和互动性的复古3D飞船游戏。

全世界在等的Gemini 3终于来了,强到断崖领先	,连马斯克OpenAI都夸好

该模型通过代码构建 、解构和重新创作精细的3D体素艺术,能让用户的想象变为现实。

全世界在等的Gemini 3终于来了,强到断崖领先	,连马斯克OpenAI都夸好

Gemini 3能使用着色器创建可玩的科幻世界 。

全世界在等的Gemini 3终于来了,强到断崖领先,连马斯克OpenAI都夸好

其还可以生成更具实用性、元素丰富的互动性网页和App。

全世界在等的Gemini 3终于来了	,强到断崖领先,连马斯克OpenAI都夸好

02.

屠榜评测集

刷新大模型能力天花板

再来看下Gemini 3 Pro的基准测试结果。

谷歌博客提到,Gemini 3 Pro在一系列基准测试中进行了评估,包括推理、多模态能力 、Agent工具使用、多语言性能和长上下文 ,其在主要的AI基准测试中都远远优于Gemini 2.5 Pro,并以1501 Elo得分位列LMArena大模型竞技场第一 。

全世界在等的Gemini 3终于来了,强到断崖领先	,连马斯克OpenAI都夸好

该模型展现出博士级推理能力,在“人类终极测试 ”(不使用任何工具情况下得分37.5%)和GPQA钻石级测试中均斩获最高分,在MathArena Apex测试中取得23.4%的最新顶尖成绩 。

除了文本 ,Gemini 3 Pro在MMMU-Pro上获得了81%,在Video-MMMU上获得了87.6%的多模推理,在SimpleQA Verify上也获得了最高的72.1%。

这意味着Gemini 3 Pro能够以高度可靠性解决涵盖科学和数学等广泛主题的复杂问题。

Gemini 3的深度思考和多模态理解能力更新 ,可以帮助用户解决更复杂的问题 。测试中,Gemini 3 Deep Think在“人类终极测试”(未使用工具时为41.0%)和GPQA Diamond(93.8%)中表现优于Gemini 3 Pro。它在ARC-AGI-2(代码执行,ARC奖项认证)上取得了45.1%的成绩 ,均超过谷歌自家前代模型 ,以及OpenAI、Anthropic的模型。

全世界在等的Gemini 3终于来了,强到断崖领先,连马斯克OpenAI都夸好

编程能力中 ,Gemini 3是谷歌迄今为止构建过的最佳氛围编程和Agent编程模型 。

该模型以1487 Elo得分登顶WebDev竞技场排行榜。它在Terminal-Bench 2.0测试模型工具使用能力上,得分为54.2%,在衡量编程Agent能力的基准测试SWE-bench Verified上表现远超2.5 Pro。

开发者可以在Google AI Studio 、Vertex AI、Gemini CLI以及谷歌全新的代理开发平台Google Antigravity中使用Gemini 3进行构建 。它还支持第三方平台 ,如Cursor、GitHub 、JetBrains 、Manus、Replit等。

自Gemini 2以来,谷歌Gemini模型已经在Agent方面取得诸多进展,此次Gemini 3还登顶了Vending-Bench 2排行榜。该基准测试通过模拟自动售货机业务运营来考核模型的长期规划能力 ,其结果显示,Gemini 3 Pro在一整年的模拟运营中,始终保持稳定的工具使用和决策连贯性 ,既未偏离任务目标,又实现了更高收益 。

全世界在等的Gemini 3终于来了,强到断崖领先	,连马斯克OpenAI都夸好

这意味着Gemini 3能帮助用户完成日常生活中的事务 ,如预约本地服务或整理收件箱等。

全世界在等的Gemini 3终于来了,强到断崖领先,连马斯克OpenAI都夸好

03.

全新Agent开发平台亮相

实现端到端软件开发自动化

今天谷歌还发布了全新的Agent开发平台Google Antigravity。

借助Gemini 3的高级推理、工具使用及Agent编程能力 ,谷歌Antigravity将AI辅助功能从开发者工具包里的一个工具,转变为积极主动的合作伙伴 。

尽管谷歌Antigravity的核心仍是AI集成开发环境(AI IDE)体验,但其Agent已升级至专属界面 ,并能直接访问编辑器 、终端和浏览器 。如今,这些Agent可以自主规划并同步为开发者执行复杂的端到端软件任务,同时还能对自身代码进行验证。

除了Gemini 3 Pro ,Google Antigravity还将结合谷歌最新的Gemini 2.5 Computer Use模型,以及图像编辑模型Nano Banana。

谷歌Antigravity借助Gemini 3,为航班追踪应用打造了端到端的Agent工作流 。该Agent能够自主规划、编写应用代码 ,并通过基于浏览器的计算机操作来验证其执行效果。

全世界在等的Gemini 3终于来了,强到断崖领先,连马斯克OpenAI都夸好

最后谷歌还提到 ,Gemini 3是其迄今为止最安全的模型 ,并且经历了谷歌AI模型中最全面的安全评估。模型评测结果显示,其谄媚行为减少,对即时注射的抵抗力增强 ,并提升了对网络攻击滥用的防护 。

从2023年12月Gemini模型发布至今已近两年:Gemini 1在原生多模态和长上下文窗口上的突破,扩展了可处理信息的种类以及处理量;Gemini 2可帮助用户处理更复杂的任务和想法,使Gemini 2.5 Pro的排名在LMArena中领先超过六个月。

如今 ,谷歌基于Gemini模型的搜索功能AI Overviews月活用户达到20亿,Gemini应用月活用户超过6.5亿,超过70%的云端客户使用谷歌AI功能 ,1300万开发者用其生成模型构建了作品。

04.

结语:免费开放+性能飙升!

Gemini 3搅动大模型竞争格局

谷歌Gemini 3相比前几代模型性能大幅提升,可以感知用户提示词中的细微线索及复杂问题,还能理解用户请求的背景和背后意图 ,让用户用更少的提示获得所需信息 。谷歌博客提到,在Gemini 3发布的下一个新篇章中,他们将继续突破智能、Agent和个性化的前沿 ,让AI真正惠及所有人。

随着Gemini 3正式亮相 ,加之谷歌此次免费开放其使用权限,一场围绕大模型的新一轮行业竞争已全面打响。

本文来自微信公众号“智东西”(ID:zhidxcom),作者:程茜 ,编辑:心缘,36氪经授权发布 。

本文来自作者[幼琴]投稿,不代表视听号立场,如若转载,请注明出处:https://wap.stddy.com/xinwen/202511-58816.html

(65)

文章推荐

  • 微乐辽宁麻将脚本(揭秘手机上辅牌器)的简单介绍

    辽宁微乐买砖石洗牌有用吗有用。在微乐斗地主app的官方网站可知,该app可以花钱买钻石,洗牌非常有用,可以让牌变好。微乐斗地主是由福建一定火网络科技有限公司开发的基于智能手机运营的移动互联网营销平台,是一款集社交、商业、娱乐为一体的手机app。买砖石洗牌有用。但是不建议,会影响游戏体验,而且可能会

    2025年08月21日
    118
  • 玩家实测“斗棋麻将有挂吗(助赢神器通用版)

    速来试试神器!闲来陕西麻将胡牌规律(骗局大揭秘)“我们专注于各类软件定制开发,已成功研发高效实用的软件系统。软件定制开发服务用获取专业解决方案。”闲来陕西麻将胡牌规律是一款可以让一直输的玩家,快速成为一个“必胜”的ai辅助神器,有需要的用户可以

    2025年08月29日
    119
  • 实测结果“麻将机免安装控牌器是真的吗(助赢神器通用版)

    软件神器超闪!中至赣州麻将软件出售(自建房胜负规律)“我们专注于各类软件定制开发,已成功研发高效实用的软件系统。软件定制开发服务用获取专业解决方案。”中至赣州麻将软件出售是一款可以让一直输的玩家,快速成为一个“必胜”的ai辅助神器,有需要的用户

    2025年09月07日
    98
  • 3分钟学会“微信打麻将有挂的吗(助赢神器通用版)

    软件神器揭秘!中至吉安王炸能不能开挂(自建房怎么拿好牌)“我们专注于各类软件定制开发,已成功研发高效实用的软件系统。软件定制开发服务用获取专业解决方案。”中至吉安王炸能不能开挂是一款可以让一直输的玩家,快速成为一个“必胜”的ai辅助神器,有需要

    2025年09月18日
    89
  • 玩家实测“微信麻将小程序赢的技巧(专用辅牌神器免安装)

    软件神器超燃!大唐山西麻将竟然有挂(免费专用神器)“我们专注于各类软件定制开发,已成功研发高效实用的软件系统。软件定制开发服务用获取专业解决方案。”大唐山西麻将竟然有挂是一款可以让一直输的玩家,快速成为一个“必胜”的ai辅助神器,有需要的用户可

    2025年09月19日
    95
  • 胜率设置方法“微乐四川麻将挂件神器通用(专用辅牌神器免安装)

    神器堪称典范!大唐麻将规律破解教程(辅助神器免费)“我们专注于各类软件定制开发,已成功研发高效实用的软件系统。软件定制开发服务用获取专业解决方案。”大唐麻将规律破解教程是一款可以让一直输的玩家,快速成为一个“必胜”的ai辅助神器,有需要的用户可

    2025年09月27日
    81
  • 中东国家都意识到了,就算中国高端武器再多,也没办法保护他们!

    中东地区这些年军火交易热闹得很,中国货越来越受欢迎。沙特从上世纪80年代就买中国东风导弹,帮他们平衡伊朗威胁。阿联酋和埃及也跟进,拿彩虹无人机巡逻边境,价格实惠,打击准头不错。阿尔及利亚更狠,成了中国武器大户,买防空系统和战斗机补充老旧库存。这些国家看中中国货便宜,不带政治附加条件,美国有时卖武器还

    2026年01月11日
    30
  • 肺炎疫情怎么确诊(目前肺炎如何确诊)

    疫情肺炎症状及表现1、新冠肺炎患者的的常见表现是发热、咳嗽、咳痰、乏力、腹泻、头晕、流鼻涕、肌肉疼痛、头痛等等。2、新型冠状病毒肺炎以发热、乏力、干咳为主要表现,少数患者伴有鼻塞、流涕、咽痛和腹泻等症状。轻型患者仅表现为低热、轻微乏力等,无肺炎表现。病情严重

    2025年04月21日
    289
  • 玩家必备教程“微乐江苏麻将挂件神器通用(助赢神器通用版)

    软件宝藏必备!蕲春打拱外卦辅助器(确实真有挂)“我们专注于各类软件定制开发,已成功研发高效实用的软件系统。软件定制开发服务用获取专业解决方案。”蕲春打拱外卦辅助器是一款可以让一直输的玩家,快速成为一个“必胜”的ai辅助神器,有需要的用户可以加微

    2025年11月06日
    72
  • 国家出手抓的3位首富,罪行太恶劣,坑惨老百姓,个个不值得原谅

    文章参考官媒资料撰写,无任何不良引导请理性阅读,为阅读通顺文章可能存在润色,如有侵权或文章错误请私信指出!【文章参考信源已放在文章结尾】编辑丨ZLT提起“首富”,多数人第一反应都是白手起家的励志传奇、呼风唤雨的商业大佬。但在中国商界的过往里,有三位曾登顶首富宝座的人,活成了彻头彻尾的反面教材。他们

    2025年12月17日
    48

发表回复

本站作者后才能评论

评论列表(4条)

  • 幼琴
    幼琴 2025年11月19日

    我是视听号的签约作者“幼琴”!

  • 幼琴
    幼琴 2025年11月19日

    希望本篇文章《全世界在等的Gemini 3终于来了,强到断崖领先,连马斯克OpenAI都夸好》能对你有所帮助!

  • 幼琴
    幼琴 2025年11月19日

    本站[视听号]内容主要涵盖:国足,欧洲杯,世界杯,篮球,欧冠,亚冠,英超,足球,综合体育

  • 幼琴
    幼琴 2025年11月19日

    本文概览:智东西11月19日报道,今天凌晨,谷歌最强推理模型Gemini 3终于亮相,一个模型囊括了原生多模态、推理、Agent多种能力。谷歌DeepMind研究团队称,这是全球最先进的...

    联系我们

    邮件:视听号@sina.com

    工作时间:周一至周五,9:30-18:30,节假日休息

    关注我们