Alibaba Qwen 3.8 Max 模型公測
已經開放其Qwen 3.8 Max模型的公共預覽,以跟上競爭步伐。這個系統擁有2.4兆參數,專注於深度推理和編程工程。國內開發者正在超越兆參數的標誌。Kimi K3以2.8兆參數領先,而MiniMax正在開發其2.7兆參數的M3 Pro模型。
今年三月Qwen技術負責人林俊暘卻突然在社交平台貼文宣布離職,未有披露去向。其後,惠彬原、郁博文等參與Qwen高層相繼離開,阿里巴巴的AI何去何從,耐人尋味。然而即使高層流失,Qwen 3.8聲稱性能可接近Fable 5水平,刺激股價上升。從評測的數據,Kimi K3在邏輯基準測試(如GPQA)上表現優異,並在生命週期推理、多步驟代碼修訂和連續編輯方面表現更佳。而Qwen 3.8 Max在三維建模、前端開發和SVG生成方面較強。
DeepSeek V4 模型發布
DeepSeek正準備正式推出V4模型,以挑戰阿里巴巴和Moonshot等,但DeepSeek又推出了全新的定價策略,在高峰流量時段收取更高費用。就原始能力而言,V4架構在編程任務和代理創建方面表現出色,V4 Pro版本可與anthropic的Opus 4.8匹敵。DeepSeek在2026年4月發布了V4模型系列預覽版,近期終於要推出「全功能」或通用可用性(GA)版本。最新版本同樣引入了V4-Pro和V4-Flash層級,API峰值-谷值定價機制亦首次亮相。Deepseek是最具成本效益的模型之一,定價進取,在代理計算方面表現出色,預覽版已經成為不同平台上最受歡迎的模型之一,加上又是開源,可下載模型及權重。最近,美國業界開始質疑當地前沿模型的價格水平,開源模型受到關注
商業隱性知識洩露風險
當企業員工將內部流程、戰略文件、行業獨有經驗或內部運作邏輯輸入至OpenAI或Anthropic等公開雲端API時,即使服務商聲稱不會將數據用於訓練基礎大模型,長期累積的提示與互動仍可能讓AI團隊逐步推斷出該企業乃至整個行業的商業策略。創辦人Alex Karp形容此為「weights and alpha」——即行業競爭優勢與核心商業密碼),AI廠商可利用從合作客戶身上習得的行業知識。 以反向開發競爭產品最典型例子,可數Anthropic與的合作:在深入掌握設計領域的場景知識後,Anthropic隨即推出面向設計師的Claude Design,直接切入客戶的核心市場,與合作夥伴形成競爭關係。
Karp在CNBC《Squawk Box》節目中直言,這種模式表面上是按token收費的服務,實質卻是「吸收客戶的產業智慧,再將其轉化為自身的競爭武器」,本質上屬於一種間接的「知識產權掠奪」,非傳統意義上的程式碼或專利竊取。其後,矽谷風險投資家Chamath Palihapitiya亦在同一節目中警告,企業在使用這類AI工具時,實際上是在「無償為競爭對手培訓未來的商業模式」,長遠將削弱自身的市場壁壘。
企業遷移有跡可尋
OpenAI等高價閉源模型,價格達約56美元/百萬token,成本持續走高。Palihapitiya說,企業出於兩個原因遷移:(1)成本太高;(2)不信任閉源廠商會吸收自己的內部知識,不確定性太強。他指,替代選項包括X Grok、Meta Llama等開放/半開放模型,可以本地部署,數據不外流,長期成本和行為都更加可預測、可控。Palihapitiya甚至表示,中國模型只需0.5美元,加上是開源,日常許多任務與前沿模型沒有區別,閉源高價模型將面臨更大挑戰。
