Alibaba
共 19 篇 · 第 1/1 頁
智譜認領神秘模型 Ox Alpha,OpenRouter 使用量狂飆、超 DeepSeek 兩倍以上
智譜 AI 於 2026 年 8 月 26 日正式確認 Ox Alpha 為 GLM 系列全新迭代,終結持續數日的社群偵探戰,並宣佈當晚公開模型權重。
2026-08-26 · 5 分鐘-
晶片算力
DeepSeek 發表 V4-Flash-Vision 實驗模型,多模態 Agent 效能直逼 Opus-4.8
DeepSeek 於 2026 年 8 月 21 日正式在 API 平台推出 DeepSeek-V4-Flash-Vision-Exp 實驗性多模態模型,文字推理與 Agent 能力與既有 V4-Flash 持平,並同步發布 DeepSeek Harness 0.1.1 以支援新模型。
-
政策監管
不只接入千問!蘋果傳攜手阿里深造底層訓練,在中國複製 Gemini 模式
阿里從千問接入升格為底層訓練夥伴,蘋果在中國複製 Gemini 路線。
-
晶片算力
中國 AI 史無前例擊敗美巨頭!Qwen3.8-Max 登頂 Agentic Index 幹掉 Claude 和 GPT
8 月 6 日,Artificial Analysis 公佈新一期 Agentic Index(agent 能力指數)排名,阿里巴巴 Qwen3.8-Max 以 55.4 分登頂,超越 Claude Opus5 和 GPT5.6。
-
開源生態
便宜又夠聰明!中國大模型 ARR 預期狂飆 30% 迎來商業化黃金交叉
8 月 3 日,高盛亞太分析師 Ronald Keung 將中國大模型廠商 2026 年末合計 ARR(年度經常性收入)預期從 100 億美元上調至 130 億美元,2030 年預測達 1250 億美元(五年 25 倍);同日 Jefferies 週報指出 OpenRouter 呼叫量前五連續 14 週全由中國模型包攬。
-
晶片算力
千問釋出 Qwen3.8-Max,阿里把戰場推向長週期 Agent
阿里巴巴於 2026 年 8 月 3 日釋出 Qwen3.8-Max,參數規模達 2.4 兆,支援 100 萬 Token 上下文,API 定價為每百萬 Token 輸入 12 元、輸出 36 元。
-
研究前沿
AI 燒錢撞牆!從 Token 狂燒到電網路卡死,AI 基礎建設爆結構性危機
2026 年中,企業 AI 支出面臨嚴重轉化率問題,研究指出每 1 美元 AI 花費中僅 18 美分進入生產環境,其餘消耗於除錯與重寫,Uber 高管亦公開質疑 AI 投資報酬率。
-
開源生態
270 億參數塞進 iPhone!PrismML 神級壓縮術讓蘋果 Siri 看見新出路
2026 年 7 月 14 日媒體報導,蘋果正與新創公司 PrismML 展開早期技術評估,後者已將阿里巴巴開源模型 Qwen 從約 54 GB 壓縮至不到 4 GB,270 億參數得以在 iPhone 15 上直接執行,無需雲端連線。
-
晶片算力
不用海外旗艦模型!OpenSquilla 0.5.0 靠國產模型組團登頂 DRACO 雙榜
2026 年 7 月 6 日,OpenSquilla 0.5.0 Preview 在 DRACO 深度研究榜 Brave Search 組拿下平均 64.09 分,高於 Opus 4.8(59.11)與 GPT-5.5(53.28),任務平均成本僅 $0.12,分別約為兩者的 8% 與 14%。
-
大廠戰略
阿里雲稱霸中國 AI 雲市場!沙利文新口徑曝光:一家市佔狂掃 40% 輾壓二到四名總和
7 月 6 日,沙利文發布《開箱即用的 AI 雲服務:2025 中國全棧 AI 雲服務市場報告》,以 IaaS(基礎設施即服務)、PaaS(平台即服務)加上 MaaS(模型即服務,Model as a Service)三層合計的「全套」口徑,測算 2025 年中國市場總規模達 595.9 億元。
-
開源生態
光象科技宣佈累計完成數億元人民幣天使輪融資,押注物理原生基座模型
光象科技於 2026 年 7 月 4 日披露累計完成數億元人民幣天使輪融資,資金將投入物理原生基座模型研發與具身智慧機器人商業化。
-
政策監管
Anthropic 指控阿里巴巴以 2.5 萬帳號竊取 Claude 能力,模型蒸餾進入中美科技攻防
2026 年 6 月 27 日,Anthropic 公開指控阿里巴巴用多達 2.5 萬個帳號,對 Claude 展開系統性大規模查詢,目標是提取並複製模型的核心能力,也就是業界所稱的 Knowledge Distillation(知識蒸餾)。
-
開源生態
吳泳銘直管 Token Foundry,阿里把 AI 從研究院搬進「代幣工廠」
6 月 8 日,阿里巴巴宣佈合併通義大模型事業部與未來生活實驗室,組建 Token Foundry 事業部,直接向集團 CEO 吳泳銘匯報。時間節點耐人尋味:Qwen-3.7 剛宣稱達到 Coding 能力全球前三、中國第一,Q4 財報也首次揭示 AI 業務已越過初期投入階段、進入商業回報週期,資本市場反應積極。
-
晶片算力
能力退化還是被壓抑?Off-Model SFT 的移除代價與解法
AI 控制研究裡有一類核心工具,叫做 off-model SFT:用另一個模型產生的標籤來微調目標模型,藉此改變它的行為,不需要直接重設目標函式。這個做法的主要應用場景,包括對抗 exploration hacking(模型在訓練過程中學到繞過監督的行為模式),以及清除被植入的後門。
-
開源生態
異質性是產品:四間實驗室的小模型議會,工程教訓全在 serving 層
v1 的 Thousand Token Wood 是個沙盒:五隻森林動物共用一個微調過的 0.5B 模型,交易、囤貨、在衝擊下崩盤,你是觀眾,負責調參、觀看泡沫生成。它驗證了多 agent 經濟體的可行性,但本質上是個展示品。
-
晶片算力
小模型實戰:五隻林地生物、一個會崩盤的經濟體,三個工程教訓
在 Build Small Hackathon,有人用 Qwen2.5-3B 跑了五隻林地生物組成的多代理經濟體,讓牠們交易五種商品、積累財富、觸發泡沫與貧富分化。推論後端是 vLLM on Modal,前端是 Gradio 介面。
-
晶片算力
Future-L1 放棄文字代理推理、改走潛在視覺空間,Qwen3-VL-8B 在 FutureBench 從 61.0 拉至 85.4
研究者提出 Future-L1,一個交錯潛在視覺推理框架,讓 MLLM 在自回歸解碼時於語言 token 與連續潛在視覺 span 之間交替,而非把所有中間推理步驟語言化。
-
Agent與應用
Qwen 3.6 35B 翻案:實測揭示 KV Cache 壓縮才是 Agent 任務的隱性瓶頸
一位 LocalLLaMA 開發者在 Rivet 子圖除錯中卡關兩天、因 context overflow 反覆觸發量化降級後,改用 Qwen 3.6 35B IQ4NXL 搭配未壓縮 KV cache,問題幾乎一次解決。
-
晶片算力
阿里 Qwen3.7-Plus 打入 Vision Arena 全球前五,多模態閉環 Agent 工作流開放 API
6 月 2 日,阿里巴巴發布 Qwen3.7-Plus,在全球視覺大模型榜單 Vision Arena 列全球前五、中國第一(廠商自報)。真正的訊號不是「一鍵複刻桌面軟體」的行銷說法,而是模型首次把視覺理解、深度推理、自我程式設計、工具呼叫、自驗證迭代整進同一個 agent 迴圈;目前已上線阿里雲百鍊,開放 API 服務。