開源生態
共 36 篇 · 第 1/2 頁
Kimi K3 引爆全球 AI 重定價:記憶體晶片接棒,模型層定價權正在鬆動
月之暗面 7 月 18 日發布 Kimi K3,IG 市場分析師 Tony Sycamore 估算 OpenAI 和 Anthropic 合計預期估值蒸發約 3,140 億美元
10 小時前 · 5 分鐘-
單晶片撐不住 AI 推理!「超節點」強勢崛起成基建新戰場
2026 年 7 月 17 日,月之暗面發布 Kimi K3,Text Arena 排名從第 38 名躍至第 9,48 小時後因用量逼近集群上限,被迫於 7 月 19 日暫停 C 端新使用者訂閱。
-
AI 算力大戰改打綠電!達卯科技 WAIC 發表算電協同 2.0 搶攻能源精細化營運
達卯科技於 2026 年 7 月 17 日在 WAIC 發表算電協同 2.0 平台,採用「融合推演智慧+統籌博弈智慧」雙引擎架構,將綠電營運擴充至全生命週期。
-
270 億參數塞進 iPhone!PrismML 神級壓縮術讓蘋果 Siri 看見新出路
2026 年 7 月 14 日媒體報導,蘋果正與新創公司 PrismML 展開早期技術評估,後者已將阿里巴巴開源模型 Qwen 從約 54 GB 壓縮至不到 4 GB,270 億參數得以在 iPhone 15 上直接運行,無需雲端連線。
-
態能力的頂級模型,封閉權重更能守住技術優勢和商業價值。
態能力的頂級模型,封閉權重更能守住技術優勢和商業價值。
-
開放權重模型的六個月:不是恐慌,是政策走向的轉折點
據 Interconnects 電子報 2026 年 7 月 12 日報導,白宮正討論以新行政命令管制開放權重 AI 模型,最可能的動作是禁止或無限期延遲能力顯著高於 GPT 5.5、Claude Opus 4.8 或 GLM-5.2 的模型,Interconnects 作者估計時間窗口在六個月內(此為依業界討論所做的
-
Claude 開口前在想什麼?Anthropic 靠 J-lens 讀心術看穿模型隱藏空間
2026 年 7 月 9 日,Anthropic 發表論文,揭示 Claude Opus 4.6 內部存在名為 J-space 的隱藏詞彙空間,其中的詞彙在模型輸出之前就已浮現,與即將生成的回應高度相關
-
告訴 Gemma「還剩幾步」沒用,但它一開口提,就幾乎必敗
2026 年 7 月 5 日,LessWrong 上一篇個人實驗拋出反直覺結果:在 CTF(Capture the Flag)解題任務裡,每步都告訴 Gemma 還剩幾步可用,解題率幾乎沒有改變,67.6% 對 65.5%,Fisher exact test p 值 0.64,統計上是清楚的虛無結果。但研究者繼續挖 r
-
光象科技宣佈累計完成數億元人民幣天使輪融資,押注物理原生基座模型
光象科技於 2026 年 7 月 4 日披露累計完成數億元人民幣天使輪融資,資金將投入物理原生基座模型研發與具身智慧機器人商業化。
-
MiniMax 狂飆的 ARR 路線圖曝光:新模型 M3 撐得住毛利考驗嗎
MiniMax 管理層在 2026 年 7 月 3 日高盛電話會上確認,ARR 從 2025 年 12 月的 1 億美元,到 2026 年 4 月翻倍至約 3 億美元,M3 模型 6 月 1 日上線前繼續加速,目標年底達 10 億美元。
-
Current AI 發布開源 AI 落差地圖,標示訓練資料為關鍵缺口
Current AI 於 2026 年 7 月初發布開源 AI 落差地圖 v0.1,詳細盤點 421 項產品,並揭露訓練與合成資料層級缺乏成熟產品。
-
OpenSquilla 0.4.0 內建三關自驗:AI 改完程式碼須先跑「紅→綠→回歸」才算交付
7 月 1 日,開源 AI Agent 專案 OpenSquilla 發布 0.4.0 版本,推出 coding 模式,直接將自我驗證機制鎖進 Agent 的交付流程。AI 改完程式碼後,須先自行跑出一條「紅→綠→回歸」的測試證據鏈,三關全過才允許回傳結果;任一關失敗,自動修復機制立即介入重改,不讓未驗證的輸出出門。同
-
GEAR 提出端到端自回歸影像合成新架構,ImageNet gFID 達 2.52
GEAR 透過雙路徑機制解決向量量化索引不可微問題,實現 tokenizer 與自回歸生成器的聯合訓練,打破傳統兩階段訓練的最佳化瓶頸。
-
上海人工智能實驗室開源 AgentDoG 1.5,以 1000 個樣本對齊小模型、官稱安全測試超越 GPT-5.4
6 月 28 日,上海人工智能實驗室發布 AgentDoG 1.5,這套框架只用 1000 個樣本就能對齊 0.8B 到 8B 參數的小模型,小模型不需額外訓練就能即時攔截 AI agent 的高風險行為。論文、模型與訓練資料同步全面開源,含 Hugging Face 模型庫與程式碼專案。這套方案理論上讓安全層作為獨立
-
Anthropic 與白宮共建越獄評估框架,GLM-5.2 以開源之姿逼近封閉模型頂點
Anthropic 的 Claude Fable 模型至 2026 年 6 月 25 日仍處於無法存取狀態,Polymarket 預測其在 6 月 26 日前恢復的機率為 45%,7 月 1 日前恢復的機率為 69%。
-
模型判斷的不是你說什麼,而是你說話的樣子
Charles Ye、Jasmine Cui、Dylan Hadfield-Menell 三位研究者發現,LLM 辨識「可信文字」的依據是文字風格而非語義,gpt-oss-20b 等模型在風格欺騙下會推翻自身安全訓練
-
DeepSeek 把 AI 填城月費壓到 340 元:一個魔獸私服跑起 1800 個 bot,「死亡網路理論」有了成本表
2026 年 6 月 21 日,一位 Reddit 使用者在 r/wowservers 貼出他搭起的《魔獸世界》私服實驗:伺服器裡跑著 1800 個接入 DeepSeek API 的 AI 玩家,能在頻道裡聊天、互動,乍看和正常的暴風城沒兩樣。費用方面,他先前跑 450 個 bot、每天上線 5 至 6 小時,一個月
-
Z.ai 發布 GLM-5.2 奪開源模型智能指數第一,前端排名第二
2026 年 6 月 13 日發布的 GLM-5.2 是 753B 參數、MIT 授權的混合專家架構(MoE)模型,在 Artificial Analysis Intelligence Index 92 個參評模型中得分 51,超越前代 GLM-5 的 50 分,拿下開源模型排名第一
-
**Agent 自己改寫自己的執行框架:小米 Darwin 團隊的 HarnessX**
3/ 核心機制是 AEGIS,一個 trace-driven(執行軌跡驅動)引擎。每次 agent 執行完,AEGIS 分析執行回饋,自動把這些訊號轉化成更好的 prompt 與訓練資料,harness 各層因此持續演化。harness 因此從靜態設定檔,變成可持續最佳化的對象。理論上,工程師的角色從「手刻配置」移向「
-
Moonshot 推 Kimi K2.7 Code HighSpeed:最高 260 tok/s 爭奪開發者,算力瓶頸壓著限量釋出
Moonshot 於 2026 年 6 月 15 日宣布推出 Kimi K2.7 Code 的高速模式 Kimi K2.7 Code HighSpeed,在中等長度編碼輸入下約可達 180 tok/s,短上下文場景最高 260 tok/s,官方聲稱整體最快可比基礎版本加速 6 倍。Kimi K2.7 Code 是 Mo
-
智譜 GLM-5.2 旗艦向 Coding Plan 全層開放,1M 上下文宣稱搭 MIT 開源下週等工程師接手
2026 年 6 月 13 日,智譜旗艦模型 GLM-5.2 正式向 GLM Coding Plan 的四個訂閱層(Lite、Pro、Max、Team)全面開放。此次主推三項能力:強化版編程能力、官方稱為「可用的」(usable)1M token 上下文視窗,以及長時程(long-horizon)任務處理。API 服務
-
NVIDIA 開源 SkillSpector:已發布 AI skill 三成六含 prompt injection 向量,無惡意程式碼也能遭劫持
2026 年 6 月 13 日,據 @AlphaSignalAI 指出,NVIDIA 開源了一款專為 AI skill 設計的掃描工具 SkillSpector。發布方自述,公開發布的 AI skill 中,**26.1% 含安全漏洞**,**36% 含 prompt injection(提示詞注入)向量**;99%
-
預測物理狀態,還要去 CUDA 依賴:智源 2026 大會的兩條主線
2026 年 6 月 12 日,智源研究院在北京發布悟界·Physis-v0.1(智源自稱全球首個通用世界基座模型),並將現有世界模型技術整理為四大路線,主張 AI 範式正從「預測下一個詞元」轉向「預測下一個物理狀態」(廠商自述,待第三方驗證)
-
Anthropic 雙發 Fable 5 與 Mythos 5:護欄觸發 fallback 機制上線,安全攔截正式變成 API 路由設計題
Anthropic 在同一天推出兩個共用能力基礎的模型:Claude Fable 5 強化安全護欄,Claude Mythos 5 則是明確「不帶安全分類器」的對應版本。Fable 5 配套了新 API 機制:護欄觸發拒答時,系統主動通知呼叫方,並支援設定自動 fallback 到另一個模型。安全攔截從過去的模型內部行