中國科技公司阿里巴巴今天(29日)發布其最新版人工智慧(AI)模型Qwen2.5,聲稱該模型超越最近爆紅的深度求索(DeepSeek)V3模型。
路透社報導,Qwen2.5-Max的發布時機不同尋常,選擇在農曆新年第一天,這顯示中國AI新創公司DeepSeek在過去3週的迅速崛起,不僅對海外競爭對手帶來壓力,也對國內競爭者構成挑戰。
阿里巴巴雲端運算部門在官方微信公告中表示:「Qwen2.5-Max在幾乎所有方面都優於GPT-4o、DeepSeek-V3和Llama-3.1-405B。」這些是美國科技公司OpenAI和Meta目前最先進的開源AI模型。
DeepSeek1月10日推出使用DeepSeek-V3模型的AI助手,接著於1月20日推出R1模型,這一系列舉措震撼了矽谷,導致科技股下跌。據稱DeepSeek的開發成本低廉,讓投資者對於美國主要AI公司的巨額投資計畫的合理性產生疑問。
然而,DeepSeek的成功也引發中國國內競爭對手加快升級自身AI模型。
在DeepSeek-R1推出的2天後,TikTok母公司字節跳動公布其旗艦AI模型的更新,並聲稱表現優於微軟支持的OpenAI o1模型。
DeepSeek也同樣聲稱,其R1模型在多項性能測試中可與OpenAI的o1模型媲美。
用Podcast訂閱本節目