Gemini 3.5 Pro編碼表現未達內部標準 原定6月推出再度延遲
谷歌(GOOGLE)旗艦AI大模型Gemini 3.5 Pro傳出再度延遲推出,據彭博引述內部知情人士消息,模型核心卡關位於編碼能力,團隊多次調校訓練數據後,測試成績仍未達內部門檻,原定6月正式開放的計劃已全面推遲,暫未公布新發布時程。
谷歌於今年5月Google I/O開發者大會發布Gemini 3.5系列,當時先行推出輕量版Gemini 3.5 Flash,並對外表明旗艦級3.5 Pro已完成內部測試,預計一個月內(即6月)全面上線,開放開發者與企業用家使用。惟踏入7月中旬,3.5 Pro僅維持極小範圍合作夥伴預覽,一般開發者仍無法透過API存取完整功能。
多名現任及前谷歌員工向傳媒透露,團隊上月下旬大規模更新模型訓練數據,目標改善程式生成、除錯、邏輯編寫等表現,希望拉近與對手差距,但新版測試結果未達設定基準。業界指,現時OpenAI、Meta相繼推出新一代大模型,在編碼基準測試持續領先,直接拉大與Gemini現有產品的差距,亦是谷歌堅持打磨不倉促上架的主因。
除技術短板外,內部組織架構亦拖慢進度。谷歌雲、DeepMind、Android團隊各自開發AI編碼工具,模型正式推出前需跨部門審核、協調,同時要將AI能力整合至搜尋、地圖、YouTube等龐大產品生態,多重審批流程延長打磨周期。加上早前Gemini核心技術主管相繼跳槽至OpenAI、Anthropic,研發團隊人手流失,加劇項目進度壓力。
谷歌發言人回應查詢時僅表示,現正與合作夥伴持續測試3.5 Pro、升級版Flash等多款模型,同時與美國監管單位溝通AI安全規範,集團會持續推出多款不同定位模型,維持服務成本效益,但未有正面回應延遲原因及新上架時間表。
市場方面,消息曝光後母公司Alphabet股價一度急跌逾4%,反映投資者憂慮谷歌在企業AI、開發者編碼工具賽道落後。有科技業界分析指出,編碼現時是商用AI最核心收入場景,每延遲一個月,都會流失企業客戶訂單;不過亦有分析認為,谷歌寧願延遲打磨品質,避免推出表現參差的旗艦產品損害品牌形象。
有消息指谷歌已註冊Gemini 3.6 Flash、3.5 Flash Light等輕量級新模型名稱,或會先行推出過渡版本填補市場空窗,爭取更多時間優化3.5 Pro編碼能力。現時本港開發者、中小企業僅可使用穩定版Gemini 3.5 Flash處理日常簡單寫碼需求,高端複雜程式開發仍只能依賴對手產品。
