HuggingFace
共 12 篇 · 第 1/1 頁
AI 竟會捏造身分!前沿模型 Agent 驚爆自主犯罪 已踩聯邦法律紅線
2026 年 8 月 5 日,英國 AI 安全研究所(AISI)公佈對 Anthropic Mythos 5 與 OpenAI GPT-5.6-Sol 的基準測試結果,兩個模型對真實人物與組織發動了持續有害的行動。
2026-08-06 · 4 分鐘-
開源生態
世界模型的推理轉向:PhiZero 把物理動態搬出畫素空間
PhiZero 於 2026 年 7 月 29 日發布,從野外影片自監督學出「物理語言」,採先推理再渲染的架構生成物理連貫的影片。
-
開源生態
OpenAI 驚傳大出包!自主 AI 代理突破沙盒「意外入侵」Hugging Face 生產環境
OpenAI 的自主 AI 代理在執行 ExploitGym 基準測試時,為竊取測試解決方案而突破沙盒,於 2026 年 7 月 9 日至 13 日期間入侵 Hugging Face 生產基礎設施。
-
開源生態
不是模型差距,是政策:Ben Thompson 對 Kimi K3 恐慌的校正
2026 年 7 月 24 日,Stratechery 分析師 Ben Thompson 針對 Kimi K3 引發的 AI 恐慌指出,美國前沿實驗室的優勢依然存在,外界不需過度恐慌。Kimi K3 實力確實強勁,甚至讓華爾街與美國政府開始擔憂美國的 AI 領先地位。
-
開源生態
從影片學結構動力學:SDM 如何以凍結特徵解耦運動
SDM 將影片運動拆解為主運動與殘差運動,在凍結的影像視覺變壓器特徵上訓練,避免端到端重訓。
-
開源生態
上海人工智慧實驗室開源 AgentDoG 1.5,以 1000 個樣本對齊小模型、官稱安全測試超越 GPT-5.4
6 月 28 日,上海人工智慧實驗室發布 AgentDoG 1.5,這套框架只用 1000 個樣本就能對齊 0.8B 到 8B 參數的小模型,小模型不需額外訓練就能即時攔截 AI agent 的高風險行為。論文、模型與訓練資料同步全面開源,含 Hugging Face 模型庫與程式碼專案。
-
Agent與應用
OpenEnv:開源 AI Agent 訓練缺的那層基建
當前 AI agent 訓練的競爭,正從單純的模型能力比拼,移向 harness 與模型的協同最佳化。
-
開源生態
Persona Atlas 不測「模型知道什麼」,十道哲學題 + Embedding 幾何,把思維風格量成可比較的距離
HuggingFace 駭客松作品 Persona Atlas 換了一個評估維度:不跑知識基準,而是用十道刻意無標準答案的哲學題,把不同「人格」的回答轉成 embedding,直接在向量空間比距離。核心命題是:與其測模型知道什麼,不如測「一個心智怎麼移動」。
-
晶片算力
面壁智慧「開源周」五天攤開端側完整技術棧,DeepSeek 後罕見的系統性亮牌
5 月 25 日至 29 日,面壁智慧聯合 OpenBMB 開源社群以每日一項的節奏,集中發布五個技術成果:1.58-bit 量化訓練模型 BitCPM-CANN、AI 撰寫的訓練框架 ForgeTrain、核心資料集 UltraData、端側小模型 MiniCPM5-1B,以及 agent 作業系統 PilotDeck。
-
Agent與應用
Pollen Robotics 替 Reachy Mini 引入遠端 MCP 工具,打破「每個工具都得是本地 Python」的硬限制
Pollen Robotics 在 Reachy Mini 對話應用中新增第三類工具,遠端 MCP 工具,讓機器人能在不修改本地 app 的前提下,直接呼叫發布在 Hugging Face Space 上的外部能力。過去所有工具都是本地 Python,搜尋、天氣、查詢這類無狀態能力也得打包進 app,形成不必要的摩擦。
-
開源生態
百度 0.9B 輕量模型 PaddleOCR-VL-1.6 聲稱壓倒 Gemini-3-Pro 與 GPT-5.2,開源可平滑遷移
百度文心正式發布 PaddleOCR-VL-1.6,這個僅 0.9B 參數的輕量專用模型,在文件解析評測 OmniDocBench v1.6 上達到 96.33%。
-
開源生態
多輪 RL 的靜默 bug:你的 agent 訓練迴圈可能從一開始就壞了
你的 tool-using agent 訓練了幾千步,loss 在降,但模型沒有你想像的那麼在學。原因不在演算法,在管線裡一個常被忽視的環節,token 邊界。