DeltaMedia
2026-07-22
← 所有故事線 開源生態

HuggingFace

4 則 · 29 天(2026-05-30 ~ 2026-06-28)

  1. 2026-06-28 上海人工智能實驗室開源 AgentDoG 1.5,以 1000 個樣本對齊小模型、官稱安全測試超越 GPT-5.4
    上海人工智能實驗室開源 AgentDoG 1.5,以 1000 個樣本對齊小模型、官稱安全測試超越 GPT-5.4

    6 月 28 日,上海人工智能實驗室發布 AgentDoG 1.5,這套框架只用 1000 個樣本就能對齊 0.8B 到 8B 參數的小模型,小模型不需額外訓練就能即時攔截 AI agent 的高風險行為。論文、模型與訓練資料同步全面開源,含 Hugging Face 模型庫與程式碼專案。這套方案理論上讓安全層作為獨立

  2. 2026-06-06 Persona Atlas 不測「模型知道什麼」,十道哲學題 + Embedding 幾何,把思維風格量成可比較的距離
    Persona Atlas 不測「模型知道什麼」,十道哲學題 + Embedding 幾何,把思維風格量成可比較的距離

    HuggingFace 黑客松作品 Persona Atlas 換了一個評估維度:不跑知識基準,而是用十道刻意無標準答案的哲學題,把不同「人格」的回答轉成 embedding,直接在向量空間比距離。核心命題是:與其測模型知道什麼,不如測「一個心智怎麼移動」。

  3. 2026-06-02 百度 0.9B 輕量模型 PaddleOCR-VL-1.6 聲稱壓倒 Gemini-3-Pro 與 GPT-5.2,開源可平滑遷移
    百度 0.9B 輕量模型 PaddleOCR-VL-1.6 聲稱壓倒 Gemini-3-Pro 與 GPT-5.2,開源可平滑遷移

    百度文心正式發布 PaddleOCR-VL-1.6,這個僅 0.9B 參數的輕量專用模型,在文檔解析評測 OmniDocBench v1.6 上達到 96.33%。廠商公告稱其綜合性能超越 Gemini-3-Pro、GPT-5.2、MinerU-2.5-Pro、GLM-OCR 等通用大模型與專用 OCR 方案,刷新該評

  4. 2026-05-30 多輪 RL 的靜默 bug:你的 agent 訓練迴圈可能從一開始就壞了
    多輪 RL 的靜默 bug:你的 agent 訓練迴圈可能從一開始就壞了

    你的 tool-using agent 訓練了幾千步,loss 在降,但模型沒有你想像的那麼在學。原因不在演算法,在管線裡一個常被忽視的環節,token 邊界。