![]()
![]()
潘 展|编译
2025年被谷歌称为“AI从工具属性迈向实用价值的关键一年”。谷歌通过Gemini系列模型迭代,推动了AI开发工具的智能革新和为科研、生产的跨界赋能。
本文梳理了谷歌2025年在研究领域取得的主要突破。
01
大型模型实现关键迭代
2025年谷歌AI模型体系实现跨越式升级,以Gemini系列为核心的技术突破重新定义了多模态推理与高效计算的标准。
3月,Gemini 2.5发布奠定年度进展基础,11月Gemini 3及12月Gemini 3 Flash的相继推出将技术能力推向顶峰。Gemini 3 Pro采用先进稀疏混合专家架构,在复杂推理领域表现卓越,不仅在LMArena排行榜登顶,更在"人类最后的考试"中全量题型取得37.5%的专家级推理成绩,在GPQA Diamond测试中达成91.9%的准确率,展现出博士级别的专业知识应用能力。在数学领域,其在MathArena Apex基准测试中斩获23.4%的最新技术水平,树立了前沿模型的数学求解新标准(参考资料:https://blog.google/products/gemini/gemini-3-flash/)。
![]()
Gemini 3 在一些最具挑战性的 AI 基准测试中表现
Gemini 3质量超越前代Gemini 2.5 Pro,同时价格大幅降低、延迟显著缩减,延续了"下一代Flash模型优于上一代Pro模型"的迭代规律。
此外,Gemini 3全系列支持百万级Token长上下文窗口,可一次性处理整部电影、完整代码仓库等海量数据,实现长序列数据的深层逻辑洞察。
![]()
Gemini 3 Flash 价格与基准测试表
Gemini 3 Flash则实现了性能与效率的平衡突破,既具备Gemini 3的专业级推理能力,又实现了低延迟、高性价比,使其成为同等规模下性能最优的模型(参考资料:https://blog.google/products/gemini/gemini-3/)。
![]()
Gemini 3 Pro展现了更好的长视野规划能力
![]()
Gemini 3 Pro 在 Terminal-Bench 2.0 测试中得分
开源生态方面,Gemma系列模型完成关键升级,新增多模态处理能力,显著扩展上下文窗口并强化多语言支持,同时实现效率与性能的双重提升。其中Gemma 3可在单个GPU或TPU上运行,Gemma 3 270M紧凑型模型则以超高效率适配轻量化应用场景,推动先进AI技术的普惠化落地。
02
AI赋能重构应用场景
谷歌2025年以智能体(Agentic)能力为核心,推动全产品矩阵的AI重构,实现了从辅助工具到协作伙伴的角色转变。
在开发者生态领域,Google Antigravity编码平台的推出与Gemini 3的超强编码能力相结合,开启了AI辅助软件开发的新纪元(https://blog.google/technology/developers/gemini-3-developers/)。
产品领域,Pixel 10集成多项AI功能,成为谷歌史上最实用的智能终端;搜索功能新增AI模式并扩展AI概览,优化信息获取效率;Gemini应用搭载3代模型实现智能升级,NotebookLM新增深度研究功能并支持更多数据源类型,构建起全场景智能服务体系。此外,在机器人领域实现了智能体与物理世界的融合。
在创意领域,Nano Banana及Nano Banana Pro为原生图像生成与编辑提供突破性能力,Veo 3.1视频生成模型实现原生音视频对齐与精准叙事控制,Imagen 4、Music AI Sandbox与Flow平台则进一步拓展了生成式媒体的应用边界,为创意产业提供高效工具支撑(参考资料:https://blog.google/technology/ai/generative-media-models-io-2025/)。
03
AI赋能科学创新与全球挑战应对
2025年谷歌AI深度赋能科学研究,在生命科学、数学、量子计算等领域取得突破性成果。
生命科学领域,AlphaFold迎来5周年,该诺奖级系统已服务全球190多个国家的300多万研究人员,其中包括100多万中低收入国家用户,持续推动蛋白质结构解析与药物研发进程。谷歌还推出DeepSomatic深度学习工具,通过CNN技术精准识别肿瘤样本中的遗传变异,支持多类型测序数据与样本类型,为精准医疗提供核心支撑;AlphaGenome与Cell2Sentence-Scale 27B模型则助力基因组解读与癌症治疗途径发现,拓展了AI在生命科学的应用维度(参考来源:https://research.google/blog/using-ai-to-identify-genetic-variants-in-tumors-with-deepsomatic/)。
在数学与编程竞赛领域,搭载Deep Think高阶推理模式的Gemini高级版本表现亮眼,先后在国际大学生程序设计竞赛世界总决赛与国际数学奥林匹克竞赛中达到金牌标准,实现了AI在深度抽象推理领域的历史性突破(参考来源:https://deepmind.google/blog/advanced-version-of-gemini-with-deep-think-officially-achieves-gold-medal-standard-at-the-international-mathematical-olympiad/)。
基础设施层面,谷歌推出专为推理时代设计的Ironwood TPU,该芯片采用AlphaChip AI设计方法,构建高效能源网络,为AI大规模推理提供核心硬件支撑,同时谷歌建立能源消耗评估体系,推动AI技术的绿色可持续发展。
![]()
TPU Ironwood构建的基础设施
在全球挑战应对方面,WeatherNext 2天气预报模型生成速度提升8倍,实现1小时高分辨率预报,其支持的洪水预报系统已覆盖150个国家的20多亿人口;FireSat系统实现野火早期发现,AI驱动的热带气旋预测则为气象机构决策提供多情景支撑。
教育领域,LearnLM与Gemini引导式学习功能拓展了认知边界,谷歌翻译集成Gemini先进翻译能力,实现更自然精准的文本翻译与语音互译试点,推动跨语言交流的高效实现。
04
构建可持续AI发展生态
谷歌将责任与安全贯穿AI发展全过程。Gemini 3经历了所有AI模型中最全面的安全评估,同时积极推进通用人工智能(AGI)风险预判与主动防控,主导模型上下文协议(MCP)等开放标准建设,保障智能体AI的互操作性与安全性。
展望2026年,推进AI前沿技术的安全可控发展、更好地服务于人类社会的可持续进步值得期待!
https://blog.google/technology/ai/2025-research-breakthroughs/
Deep Science预印本
![]()
![]()
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.