谷歌升级Gemini 3 Deep Think模型:助力科研与工程领域突破

谷歌宣布对Gemini 3 Deep Think模型进行重大升级,旨在推动科学、研究和工程应用,模型在数学、物理与化学领域表现卓越,助力实际工程与科研。

10效率工具谷歌AI科研工具工程应用智能模型

2 月 13 日,谷歌宣布对Gemini 3 Deep Think模型进行重大升级,该模型专为科学、研究与工程场景设计,旨在推动智能前沿发展。

新版Deep Think由谷歌开发人员与各行业科学家、研究人员共同打造,旨在解决科研环境中常见的复杂问题,如数据杂乱或不完整等。

此次升级后,Deep Think的可用范围进一步扩大,现已在Gemini应用中向Google AI Ultra订阅用户开放。

谷歌宣布 Gemini 3 Deep Think 深度思考大模型升级:推进科学、研究和工程应用,可达数学、物理与化学奥赛金牌水平插图

谷歌首次通过Gemini API将Deep Think提供给部分研究人员、工程师与企业,并开放申请入口以招募意向用户。

新版Deep Think在数学、算法与编程等高难推理任务上表现卓越。在终极人类考试(Humanity's Last Exam)上取得 48.4% 的成绩;在 ARC-AGI-2 上达到 84.6%,并由 ARC Prize Foundation 验证;在 Codeforces 竞赛编程基准上获得 3455 的 Elo;并在 2025 年国际数学奥林匹克竞赛(IMO 2025)上达到金牌水平表现。

查看成绩展示图

谷歌宣布 Gemini 3 Deep Think 深度思考大模型升级:推进科学、研究和工程应用,可达数学、物理与化学奥赛金牌水平插图1

除数学与编程之外,新版Deep Think在化学、物理等科学领域同样具备更强能力。在 2025 年国际物理奥林匹克与国际化学奥林匹克的笔试部分取得金牌级结果,同时在理论物理相关的 CMT-Benchmark 上获得 50.5% 的得分。

查看科学领域能力展示图

谷歌表示,Deep Think的目标不仅是追求基准测试成绩,还希望推动实际工程与科研应用,例如帮助研究人员解释复杂数据、帮助工程师通过代码对物理系统进行建模。