OpenAI
12 則 · 46 天(2026-05-30 ~ 2026-07-15)
-
2026-07-15
造出 agent 不再是主戲:2026 年 AI 工程重心已移轉2026 年 7 月的 AI Engineer World's Fair 上,AutoGPT 等 2023 年指標性的自主代理人專案幾乎無人提及,取而代之的是 Claude Code、Codex、Gemini CLI、Cursor 等以系統可靠性為核心的工具。
-
2026-06-23
OpenAI 語音新模型 Bidi 1 測試爆料流出:說話途中可即時插嘴,全雙工互動格局浮上檯面6 月 23 日,社群帳號 testingcatalog 在 X 上公開一批未經 OpenAI 官方證實的測試紀錄,稱 OpenAI 正開發代號「Bidi 1」的雙向語音模型,能在使用者說話時同步回應,而非等待對方停頓才處理。若爆料屬實,這意味著 ChatGPT 語音互動可能從現行的半雙工(half-duplex)輪流
-
2026-06-13
模型主權:Fable/Mythos 停供的供應鏈課
2026 年 6 月 13 日,Anthropic 在 Fable 5 與 Mythos 5 上線僅三天後宣布,依美國政府指令暫停外籍使用者對這兩款模型的存取,合規處理期間全球客戶一併受到波及,存取全數中斷。Anthropic 對評估報告提出異議,稱政府只提供了口頭證據,涉及的是「狹窄、非普遍性的越獄」,且類似能力在
-
2026-06-12
答題學霸不等於干活能手:Agents' Last Exam 讓 Fable 5 輸給 GPT-5.5
2026 年 6 月 12 日,UC Berkeley 發布 ALE(Agents' Last Exam)基準,要求 AI agent 在 Siemens NX、Unreal Engine、Adobe After Effects 等真實軟體裡複製人類領域專家已完成的任務;冠軍 GPT-5.5 + Codex 通過率 2
-
2026-06-12
OpenAI 收購 agent 雲端執行平台 Ona,Codex 長任務基建補齊、Managed Agents 呼之欲出
6 月 11 日,OpenAI 宣布收購 Ona,一個專為 AI agent 設計的雲端執行平台。官方說明指向兩個具體目標:讓 Codex 能在使用者關閉筆電後仍持續跑長時間任務,以及協助更多企業在生產環境安全部署 agent。相比於模型能力的持續迭代,這筆收購讓 OpenAI 開始明確補上 agent 執行層的基礎設
-
2026-06-08
OpenEnv:開源 AI Agent 訓練缺的那層基建
當前 AI agent 訓練的競爭,正從單純的模型能力比拼,移向 harness 與模型的協同優化。Claude Code、Codex、OpenClaw、Hermes 這類 agent harness 持續進步,背後的關鍵之一是:前沿實驗室的模型與自家 harness 一起訓練,GPT-5.5 和 Opus 4.8 都
-
2026-06-07
開源 Agent Swarm 上線:Opus 4.8 規劃、Deepseek 執行,agentic loop 成本砍十倍
一套開源 AI agent swarm 框架正式上線,核心設計是分層模型路由:強模型負責規劃、輕量模型負責執行。與全程使用 Opus 4.8 相比,成本降低十倍,速度提升兩倍,效果相當。
-
2026-06-04
GitLab 營收漲 23% 仍砍 14% 員工,CEO「agentic era」轉型被市場一日打臉
GitLab 在 Q1 財報超預期的當天同步宣布裁員約 350 人(佔全員近 14%),並退出 22 個國家及地區。本季營收 2.642 億美元、年增 23%,超出分析師預期的 2.54 億;財報發布後盤後股價一度漲 7%,但次日開盤消化裁員消息後,漲幅全數回吐。
-
2026-06-03
競爭已從模型跑分蔓延到 IPO 時間表:Anthropic S-1 背後的三條線索
6 月 1 日,Anthropic 向 SEC 秘密遞交 Form S-1 草案,同日宣布完成 650 億美元 Series H 融資,投後估值達 9,650 億美元。股份數量與發行價格尚未確定,後續視 SEC 審查進度而定。
-
2026-06-02
OpenAI 模型與 Codex 登陸 AWS,分發層邏輯正在改寫
OpenAI 的 frontier 模型與 Codex 現已可在 AWS 上直接取用。這個動作的真正訊號不是「又多一個雲端入口」,而是模型供應商主動把自己鋪進企業既有的雲端工作負載裡,過去雲廠商靠「自家模型優先」築牆的邏輯正在鬆動。對已在 AWS 上架設 agent 或 coding pipeline 的團隊,最直接的
-
2026-06-02
開源 Agentic Coding 的差距正在收斂,M3 的真正訊號不是跑分
MiniMax M3 最值得認真看的,不是 SWE-Bench Pro 的 59%,雖然這個數字超過 GPT-5.5 和 Gemini 3.1 Pro、接近 Opus 4.7 確實夠硬。真正的訊號是:它是國內第一個把長上下文、多模態、Coding 三件事同時做到的開源模型。缺少任何一條,agentic 任務就會在中途卡
-
2026-05-30
Anthropic 的雙重翻盤:估值是煙火,Agent 編排才是結構變局
去年 12 月,Anthropic 的年化營收是 $9B。五個月後,這個數字跳到 $47B。同步完成的 $65B Series H 讓其估值達到 $965B post-money,投資人涵蓋 Altimeter、Dragoneer、Greenoaks、Sequoia,以及包含 Amazon 在內的主要雲端業者。