Alibaba
共 12 篇 · 第 1/1 頁
270 億參數塞進 iPhone!PrismML 神級壓縮術讓蘋果 Siri 看見新出路
2026 年 7 月 14 日媒體報導,蘋果正與新創公司 PrismML 展開早期技術評估,後者已將阿里巴巴開源模型 Qwen 從約 54 GB 壓縮至不到 4 GB,270 億參數得以在 iPhone 15 上直接運行,無需雲端連線。
2026-07-15 · 5 分鐘-
晶片算力
不用海外旗艦模型!OpenSquilla 0.5.0 靠國產模型組團登頂 DRACO 雙榜
2026 年 7 月 6 日,OpenSquilla 0.5.0 Preview 在 DRACO 深度研究榜 Brave Search 組拿下平均 64.09 分,高於 Opus 4.8(59.11)與 GPT-5.5(53.28),任務平均成本僅 $0.12,分別約為兩者的 8% 與 14%。
-
大廠戰略
阿里雲稱霸中國 AI 雲市場!沙利文新口徑曝光:一家市占狂掃 40% 輾壓二到四名總和
7 月 6 日,沙利文發布《開箱即用的 AI 雲服務:2025 中國全棧 AI 雲服務市場報告》,以 IaaS(基礎設施即服務)、PaaS(平台即服務)加上 MaaS(模型即服務,Model as a Service)三層合計的「全套」口徑,測算 2025 年中國市場總規模達 595.9 億元。阿里雲以 239 億元總
-
開源生態
光象科技宣佈累計完成數億元人民幣天使輪融資,押注物理原生基座模型
光象科技於 2026 年 7 月 4 日披露累計完成數億元人民幣天使輪融資,資金將投入物理原生基座模型研發與具身智慧機器人商業化。
-
政策監管
Anthropic 指控阿里巴巴以 2.5 萬帳號竊取 Claude 能力,模型蒸餾進入中美科技攻防
2026 年 6 月 27 日,Anthropic 公開指控阿里巴巴用多達 2.5 萬個帳號,對 Claude 展開系統性大規模查詢,目標是提取並複製模型的核心能力,也就是業界所稱的 Knowledge Distillation(知識蒸餾)。Ars Technica 的報導標題更明確指出阿里巴巴此舉「違抗 Trump」
-
開源生態
吳泳銘直管 Token Foundry,阿里把 AI 從研究院搬進「代幣工廠」
6月8日,阿里巴巴宣布合併通義大模型事業部與未來生活實驗室,組建 Token Foundry 事業部,直接向集團 CEO 吳泳銘匯報。時間節點耐人尋味:Qwen-3.7 剛宣稱達到 Coding 能力全球前三、中國第一,Q4 財報也首次揭示 AI 業務已越過初期投入階段、進入商業回報週期,資本市場反應積極。
-
晶片算力
能力退化還是被壓抑?Off-Model SFT 的移除代價與解法
AI 控制研究裡有一類核心工具,叫做 off-model SFT:用另一個模型產生的標籤來微調目標模型,藉此改變它的行為,不需要直接重設目標函數。這個做法的主要應用場景,包括對抗 exploration hacking(模型在訓練過程中學到繞過監督的行為模式),以及清除被植入的後門。它不需要你知道「壞行為的實際觸發邏輯
-
開源生態
異質性是產品:四間實驗室的小模型議會,工程教訓全在 serving 層
v1 的 Thousand Token Wood 是個沙盒:五隻森林動物共用一個微調過的 0.5B 模型,交易、囤貨、在衝擊下崩盤,你是觀眾,負責調參、觀看泡沫生成。它驗證了多 agent 經濟體的可行性,但本質上是個展示品。
-
晶片算力
小模型實戰:五隻林地生物、一個會崩盤的經濟體,三個工程教訓
在 Build Small Hackathon,有人用 Qwen2.5-3B 跑了五隻林地生物組成的多代理經濟體,讓牠們交易五種商品、積累財富、觸發泡沫與貧富分化。推論後端是 vLLM on Modal,前端是 Gradio 介面。這是一份工程實戰報告,核心命題不是「小模型也能做到」,而是「這個任務本來就只能用小模型做
-
晶片算力
Future-L1 放棄文字代理推理、改走潛在視覺空間,Qwen3-VL-8B 在 FutureBench 從 61.0 拉至 85.4
研究者提出 Future-L1,一個交錯潛在視覺推理框架,讓 MLLM 在自回歸解碼時於語言 token 與連續潛在視覺 span 之間交替,而非把所有中間推理步驟語言化。以 Qwen3-VL-8B 為基底,Future-L1 在 FutureBench 上將分數從 61.0 提升至 85.4,並在論文所報告的兩項影片
-
Agent與應用
Qwen 3.6 35B 翻案:實測揭示 KV Cache 壓縮才是 Agent 任務的隱性瓶頸
一位 LocalLLaMA 開發者在 Rivet 子圖除錯中卡關兩天、因 context overflow 反覆觸發量化降級後,改用 Qwen 3.6 35B IQ4NXL 搭配未壓縮 KV cache,問題幾乎一次解決。實測對比顯示:35B IQ4NXL(KV 未壓縮)表現超越原本日常主力 Qwen 27B Q5KX
-
晶片算力
阿里 Qwen3.7-Plus 打入 Vision Arena 全球前五,多模態閉環 Agent 工作流開放 API
6月2日,阿里巴巴發布 Qwen3.7-Plus,在全球視覺大模型榜單 Vision Arena 列全球前五、中國第一(廠商自報)。真正的訊號不是「一鍵複刻桌面軟體」的行銷說法,而是模型首次把視覺理解、深度推理、自我編程、工具調用、自驗證迭代整進同一個 agent 迴圈;目前已上線阿里云百炼,開放 API 服務。