- 谷歌醒了,新入口大戰開打
- 2025年11月21日來源:中國經濟網
提要:11月19日凌晨,谷歌發布最新一代模型Gemini 3。隨后,Gemini 3系列模型在多模態、推理、Agent 等三條大模型主線路的多項國際測試上全面“屠榜”。除了在編程能力測試略遜于GPT-5.1和Claude Sonnet 4.5外,在其他國際主流測試項目上,Gemini 3 Pro得分都是斷檔的領先。
段永平:現在市場上的大模型10年后能活下來的不會超過10%。誰會活下來?我會猜Gemini,因為谷歌很強大,而且已經醒了。
文|《中國企業家》記者 王怡潔 見習記者 孫欣
蟄伏數月,谷歌再度出手甩出王炸——Gemini 3奇襲大模型圈,交出了一張幾乎“全A”的模型測試成績單。
11月19日凌晨,谷歌發布最新一代模型Gemini 3。隨后,Gemini 3系列模型在多模態、推理、Agent 等三條大模型主線路的多項國際測試上全面“屠榜”。除了在編程能力測試略遜于GPT-5.1和Claude Sonnet 4.5外,在其他國際主流測試項目上,Gemini 3 Pro得分都是斷檔的領先。
其中,Humanity's Last Exam (HLE)被認為是衡量AI能否解決人類頂尖難題的試金石,Gemini 3 Pro在此項測試的得分為37.5%。而GPT-5.1、Claude Sonnet 4.5得分分別為26.5%、12.7%。
模型發布后,谷歌美股股價一度上漲5.8%,市值突破3.5萬億美元創歷史新高。
OpenAI的CEO山姆·阿爾特曼也罕見對谷歌給予贊賞:“這看起來是一個很棒的模型。”短短一年前,谷歌在舉辦2024 I/O開發者大會時,阿爾特曼還曾直接嘲諷Gemini產品,甚至對發布會布置提出質疑:“我無法不去思考OpenAI和谷歌之間的美學差異。”
但在今年5月的開發者大會上,谷歌拿出十余種“AI萬花筒”產品,能力大幅提升,給了阿爾特曼一記回旋鏢。半年后,谷歌再度“炸場”,更表明在多年技術積累之下,谷歌已經重新找回節奏。
“谷歌已不再把自己視為一家搜索公司,而是要成為下一代計算平臺的創建者。”谷歌CEO皮查伊今年多次強調。2025年,谷歌的搜索、安卓系統、Chrome瀏覽器、YouTube、硬件乃至手機等核心業務,都在圍繞基座大模型Gemini進行重構。一年高達900億美元的資本開支以及工程資源,也都向模型供電傾斜。
基座模型迭代之際,谷歌也同步披露了一個關鍵數據:谷歌瀏覽器的AI模式月活躍用戶已達20億。這意味著,從模型到應用,谷歌正利用其龐大的生態系統,重新定義AI上的話語權。
谷歌全棧布局的示范效應,也勢必將大模型競爭拉到下一高度。近期,國內外圍繞入口的爭奪也不約而同地打響。OpenAI上線桌面瀏覽器,同時強勢進軍搜索功能;阿里千問App近期回歸,高調瞄準ChatGPT入局AI to C;字節也在通過豆包探索電商新入口。
幾天前,伯克希爾-哈撒韋公司披露的今年三季度持股報告顯示:巴菲特在退休前,首次建倉買入了谷歌。
近日,段永平在接受采訪時也表示:“現在市場上的大模型很多,10年后能活下來的大概率不會超過10%。大家可以猜猜10年后,大家還在用的主流大模型會是什么?我會猜Gemini,因為背后的谷歌很強大,而且已經醒了。”
模型屠榜,應用升級
Gemini 3發布前,谷歌相當低調。
2025年11月初,皮查伊在公司財報電話會議上談及Gemini 3時態度謹慎:“前沿大模型的開發需要更多時間,而Gemini 3預計不會讓人們立刻就看到突破性的進展。”
從結果看這像是一顆煙霧彈。據Model Card測試數據,Gemini 3成績幾乎全面碾壓當前所有主流大模型;在開放評測平臺 LMArena 上,Gemini 3 Pro以1501分位居通用模型榜首。
在博士級科學問答GPQA Diamond上,Gemini 3 Pro成績為91.9%;數學難題集MathArena Apex上創造了最新紀錄——23.4%;SimpleQA Verified(強調事實性與復雜問答準確度的測試)成績是72.1%,這意味著其幻覺率和知識錯誤率被顯著壓低;在ARC-AGI-2(推理測試)的成績為31.1%,而上一代 Gemini 2.5 Pro的該項成績還不到5%。
Gemini 3在多模態的表現同樣令人驚艷。目前,多模態模型上有兩項“終極試題”:MMMU-Pro和Video-MMMU,Gemini 3 Pro在這兩項的成績分別為81%和87.6%,創下多模態模型能力歷史最高紀錄。在Agentic Coding上,Gemini 3 Pro在SWE-Bench Verified的成績比GPT-5.1和Claude Sonnet 4.5分別僅差0.1%、0.9%。
某種程度上,Gemini 3是谷歌第一款給OpenAI構成實質性威脅的模型——它并非以某一項能力出圈,而是在多模態、推理、Agent這三條最難突破的線路上,全線抵達行業天花板。
谷歌的反攻還不止于在基座模型上“血洗”榜單,還有應用層的全面爆發。正是前者的能力跨越,才為應用頁面、交互方式的迭代提供了關鍵基礎。
2022年,ChatGPT把行業帶入了小助手式“對話優先”的交互世界。然而,Gemini新版應用不再是單一對話框——用戶發出自然語言請求,模型并非直接生成答案,而是即時生成一個結構化的、視覺化的界面,用戶可以和AI共同操作。
這也讓AI跳出了“小助手”的角色,不再只是在語言層面輔佐用戶,而是開始和用戶共享一個可操作的工作環境,向著真正的“工作伙伴”發展。據悉,Gemini 3將被整合進Gemini應用、谷歌的AI搜索產品AI Mode和AI Overviews,以及企業級產品。
谷歌如何找回節奏?
谷歌在AI上的爆發,可以說是“后發先至”。2022年11月底,ChatGPT燃爆硅谷后,同年12月6日,谷歌推出了Gemini 1.0。此后,谷歌的AI研發進程一直不溫不火。
模型開發滯后之下,OpenAI、Perplexity、Anthropic等對谷歌的搜索市場虎視眈眈。2024年底,谷歌搜索市場份額首次跌破90%。
“大企業病”“掉隊”“落伍”曾是外界詬病谷歌的形容詞。但谷歌通過對關鍵技術團隊的成功整合,再度找回了自己的研發節奏與產品高度。
2023年4月,谷歌宣布將Google Brain和DeepMind合并,由DeepMind創始人戴米斯·哈薩比斯執掌。此前,兩支團隊都做出過驕人戰績:Brain創造了Transformer架構,DeepMind則拿出過震驚世界的AlphaGo。
“一山不容二虎”的故事沒有在谷歌發生。團隊合并后,雖然帶頭人是哈薩比斯,但Google Brain的聯合創始人杰夫·迪恩仍然擔任首席科學家。2024年底,在團隊的共同努力下,Gemini模型順利完成了迭代。
接下來,谷歌更力出一孔。到2025年5月,皮查伊在I/O開發者大會上,大膽打破了谷歌搜索的立命之本:“搜索框不重要了,Google要做你的AI助理,直接替你把事辦了。”
大會上,谷歌共宣布了23項功能更新,覆蓋了AI模型、視覺生產、谷歌搜索、Agent系統、AI眼鏡、生態等幾乎所有與AI相關的領域。
AI顛覆搜索后,谷歌的野心也被放到了下一代計算平臺:其自研了TPU提供底層算力支持;用安卓與Chrome構成交互前臺,Workspace承接具體任務執行;YouTube打造流媒體資產,為Gemini在多模態能力上奠定基礎。此外,Gmail、Google Docs等成熟應用也逐步被注入AI功能。
Gemini 3的發布會上,谷歌宣布其瀏覽器AI模式的月活躍用戶已達20億,其中Gemini應用月活用戶達6.5億。皮查伊稱:“令人驚嘆的是,僅僅兩年時間,AI已從單純處理文本和圖像,發展到能夠讀懂場景。從今天起,Gemini將在谷歌全系產品中全面鋪開。”
入口大戰開打
谷歌的系統性進擊,也意味著AI新入口大戰已經打響。AI角逐已從基模大戰、技術競速,轉向了關乎下一個10年勢力版圖的場景落地競爭。
下一代入口在哪里?在移動互聯網時代,得流量者勝出。但未來如果把答案擴展到“誰能幫用戶解決問題”的效用之爭,機會又重新在巨頭面前攤平。
某種程度上,谷歌的全棧出擊,也是阿里正在嘗試“復刻”的道路。周靖人在云棲大會后,對《中國企業家》等媒體表示:阿里云是全球少數幾家在大模型和云計算方面都能夠做到全棧自研、聯合創新的公司。
11月17日,阿里千問App公測版亮相,直接瞄準AI to C入口,計劃打造會聊天、能辦事的個人AI助手,并整合了阿里全生態的服務能力。次日,螞蟻集團發布全模態通用AI助手“靈光”,用戶可以在30秒內,生成可交互、可編輯、可分享的“閃應用”。這些都昭示著阿里準備抓住“生產力入口”的野心。
在不久前的2025年第三季度財報會上,騰訊集團總裁劉熾平亦明確表示:微信最終將成為一個AI Agent,幫助用戶在微信內部完成大量任務。字節豆包則在流量加持下,正在從生態滲透,走向工具賦能,與抖音、剪映深度綁定,將豆包變為字節的生產力引擎。
最近,OpenAI已經將更多目光投向了企業服務與垂直場景落地。今年上半年,OpenAI實現43億美元營收,其中消費者與企業訂閱占據大頭。
一位海外文旅開發從業者對《中國企業家》表示:他在使用了國內外多項大模型后,感到GPT-5在上下文理解層面,明顯具備優勢。“雖然我們海外數據相對匱乏,但因為ChatGPT好用,海外系統反而更容易做。”
不過,靠舊地圖未必能拿到新船票。AI時代的贏家,不只屬于技術領先者,或者有能力“大水漫灌”的超級App擁有者,更是能理解用戶需求、將技術轉化為解決問題能力,能將AI與行業場景深度綁定,對AGI有更透徹理解和追求的企業。
版權及免責聲明:
1. 任何單位或個人認為南方企業新聞網的內容可能涉嫌侵犯其合法權益,應及時向南方企業新聞網書面反饋,并提供相關證明材料和理由,本網站在收到上述文件并審核后,會采取相應處理措施。
2. 南方企業新聞網對于任何包含、經由鏈接、下載或其它途徑所獲得的有關本網站的任何內容、信息或廣告,不聲明或保證其正確性或可靠性。用戶自行承擔使用本網站的風險。
3. 如因版權和其它問題需要同本網聯系的,請在文章刊發后30日內進行。聯系電話:01083834755 郵箱:news@senn.com.cn




