DeltaMedia
2026-07-22
← 所有故事線 Agent與應用

OpenAI

12 則 · 46 天(2026-05-30 ~ 2026-07-15)

  1. 2026-07-15 造出 agent 不再是主戲:2026 年 AI 工程重心已移轉
    造出 agent 不再是主戲:2026 年 AI 工程重心已移轉

    2026 年 7 月的 AI Engineer World's Fair 上,AutoGPT 等 2023 年指標性的自主代理人專案幾乎無人提及,取而代之的是 Claude Code、Codex、Gemini CLI、Cursor 等以系統可靠性為核心的工具。

  2. 2026-06-23 OpenAI 語音新模型 Bidi 1 測試爆料流出:說話途中可即時插嘴,全雙工互動格局浮上檯面
    OpenAI 語音新模型 Bidi 1 測試爆料流出:說話途中可即時插嘴,全雙工互動格局浮上檯面

    6 月 23 日,社群帳號 testingcatalog 在 X 上公開一批未經 OpenAI 官方證實的測試紀錄,稱 OpenAI 正開發代號「Bidi 1」的雙向語音模型,能在使用者說話時同步回應,而非等待對方停頓才處理。若爆料屬實,這意味著 ChatGPT 語音互動可能從現行的半雙工(half-duplex)輪流

  3. 2026-06-13 模型主權:Fable/Mythos 停供的供應鏈課
    模型主權:Fable/Mythos 停供的供應鏈課

    2026 年 6 月 13 日,Anthropic 在 Fable 5 與 Mythos 5 上線僅三天後宣布,依美國政府指令暫停外籍使用者對這兩款模型的存取,合規處理期間全球客戶一併受到波及,存取全數中斷。Anthropic 對評估報告提出異議,稱政府只提供了口頭證據,涉及的是「狹窄、非普遍性的越獄」,且類似能力在

  4. 2026-06-12 答題學霸不等於干活能手:Agents' Last Exam 讓 Fable 5 輸給 GPT-5.5
    答題學霸不等於干活能手:Agents' Last Exam 讓 Fable 5 輸給 GPT-5.5

    2026 年 6 月 12 日,UC Berkeley 發布 ALE(Agents' Last Exam)基準,要求 AI agent 在 Siemens NX、Unreal Engine、Adobe After Effects 等真實軟體裡複製人類領域專家已完成的任務;冠軍 GPT-5.5 + Codex 通過率 2

  5. 2026-06-12 OpenAI 收購 agent 雲端執行平台 Ona,Codex 長任務基建補齊、Managed Agents 呼之欲出
    OpenAI 收購 agent 雲端執行平台 Ona,Codex 長任務基建補齊、Managed Agents 呼之欲出

    6 月 11 日,OpenAI 宣布收購 Ona,一個專為 AI agent 設計的雲端執行平台。官方說明指向兩個具體目標:讓 Codex 能在使用者關閉筆電後仍持續跑長時間任務,以及協助更多企業在生產環境安全部署 agent。相比於模型能力的持續迭代,這筆收購讓 OpenAI 開始明確補上 agent 執行層的基礎設

  6. 2026-06-08 OpenEnv:開源 AI Agent 訓練缺的那層基建
    OpenEnv:開源 AI Agent 訓練缺的那層基建

    當前 AI agent 訓練的競爭,正從單純的模型能力比拼,移向 harness 與模型的協同優化。Claude Code、Codex、OpenClaw、Hermes 這類 agent harness 持續進步,背後的關鍵之一是:前沿實驗室的模型與自家 harness 一起訓練,GPT-5.5 和 Opus 4.8 都

  7. 2026-06-07 開源 Agent Swarm 上線:Opus 4.8 規劃、Deepseek 執行,agentic loop 成本砍十倍
    開源 Agent Swarm 上線:Opus 4.8 規劃、Deepseek 執行,agentic loop 成本砍十倍

    一套開源 AI agent swarm 框架正式上線,核心設計是分層模型路由:強模型負責規劃、輕量模型負責執行。與全程使用 Opus 4.8 相比,成本降低十倍,速度提升兩倍,效果相當。

  8. 2026-06-04 GitLab 營收漲 23% 仍砍 14% 員工,CEO「agentic era」轉型被市場一日打臉
    GitLab 營收漲 23% 仍砍 14% 員工,CEO「agentic era」轉型被市場一日打臉

    GitLab 在 Q1 財報超預期的當天同步宣布裁員約 350 人(佔全員近 14%),並退出 22 個國家及地區。本季營收 2.642 億美元、年增 23%,超出分析師預期的 2.54 億;財報發布後盤後股價一度漲 7%,但次日開盤消化裁員消息後,漲幅全數回吐。

  9. 2026-06-03 競爭已從模型跑分蔓延到 IPO 時間表:Anthropic S-1 背後的三條線索
    競爭已從模型跑分蔓延到 IPO 時間表:Anthropic S-1 背後的三條線索

    6 月 1 日,Anthropic 向 SEC 秘密遞交 Form S-1 草案,同日宣布完成 650 億美元 Series H 融資,投後估值達 9,650 億美元。股份數量與發行價格尚未確定,後續視 SEC 審查進度而定。

  10. 2026-06-02 OpenAI 模型與 Codex 登陸 AWS,分發層邏輯正在改寫
    OpenAI 模型與 Codex 登陸 AWS,分發層邏輯正在改寫

    OpenAI 的 frontier 模型與 Codex 現已可在 AWS 上直接取用。這個動作的真正訊號不是「又多一個雲端入口」,而是模型供應商主動把自己鋪進企業既有的雲端工作負載裡,過去雲廠商靠「自家模型優先」築牆的邏輯正在鬆動。對已在 AWS 上架設 agent 或 coding pipeline 的團隊,最直接的

  11. 2026-06-02 開源 Agentic Coding 的差距正在收斂,M3 的真正訊號不是跑分
    開源 Agentic Coding 的差距正在收斂,M3 的真正訊號不是跑分

    MiniMax M3 最值得認真看的,不是 SWE-Bench Pro 的 59%,雖然這個數字超過 GPT-5.5 和 Gemini 3.1 Pro、接近 Opus 4.7 確實夠硬。真正的訊號是:它是國內第一個把長上下文、多模態、Coding 三件事同時做到的開源模型。缺少任何一條,agentic 任務就會在中途卡

  12. 2026-05-30 Anthropic 的雙重翻盤:估值是煙火,Agent 編排才是結構變局
    Anthropic 的雙重翻盤:估值是煙火,Agent 編排才是結構變局

    去年 12 月,Anthropic 的年化營收是 $9B。五個月後,這個數字跳到 $47B。同步完成的 $65B Series H 讓其估值達到 $965B post-money,投資人涵蓋 Altimeter、Dragoneer、Greenoaks、Sequoia,以及包含 Amazon 在內的主要雲端業者。