大佬動態
Moonshot AI 發布 Kimi K3:2.8 兆參數開放模型挑戰領先大廠
Moonshot AI 今晨推出 Kimi K3,參數約 2.8 兆、上下文長度 1 百萬 token,並承諾於 7 月 27 日開放權重。自報基準顯示在長程知識工作上大幅領先前代,且在多項測試中超過 Claude Opus 4.8 與 GPT‑5.5。此模型有望成為開放式 3 兆級別的首個大型模型,對開發者成本與生態產生深遠影響。
大佬動態
Moonshot AI 今晨推出 Kimi K3,參數約 2.8 兆、上下文長度 1 百萬 token,並承諾於 7 月 27 日開放權重。自報基準顯示在長程知識工作上大幅領先前代,且在多項測試中超過 Claude Opus 4.8 與 GPT‑5.5。此模型有望成為開放式 3 兆級別的首個大型模型,對開發者成本與生態產生深遠影響。
速報
本研究針對四款開放權重前沿大型語言模型,使用 Harvard Dataverse 於 2026 年發布的全球 AI 資料庫(GAID v2)進行基準測試。選取 18 項指標,涵蓋 IEEE IRAI 2026 框架的八大主題,產生近 3,000 筆國家‑指標‑年份觀測資料(2010‑2023)。
速報
北京AI實驗室MoonshotAI以開放權重Kimi大型語言模型為主。Kimi在程式碼基準與分發平台表現亮眼,帶動付費訂閱與API成長。創辦人為前Meta與GoogleBrain研究員,4月年經常性營收逾2億美元,公司完成約20億美元募資、估值約200億美元。
深度分析
DeepSeek發布DeepSeek‑V4,帶來原生百萬代幣上下文與1.6兆參數的MoE設計。它透過混合注意力、Manifold‑Constrained Hyper‑Connections與新優化器,大幅壓縮KV快取與推理成本,同時以MIT開放權重釋出。結果是多項代理與長上下文任務上接近閉源領先模型,並將高端模型的經濟門檻往下移動。
大佬動態
SimonWillison發布訊號指出DeepSeek推出V4預覽版,兩款均為MixtureofExperts並支援100萬token上下文;Pro採1.6T總參數且49B啟動,Flash為284B總參數與13B啟動,並以MIT授權釋出;此一發布將擴展開放權重與長上下文實驗的可及性,可能影響研究與部署習慣。