OpenAI
共 87 篇 · 第 4/4 頁
-
晶片算力
Codex 週活破 500 萬示範新門檻,Kimi Work 把多 Agent 協作封裝進本地
OpenAI 在《知識工作的下一個時代》報告中揭露,Codex 週活使用者已超過 500 萬,自今年 2 月推出桌面版後增長逾六倍;知識工作者目前佔使用者總數約 20%,增速是開發者三倍以上。
-
模型動態
800K 參數,100% 正確:消去式推理為何讓大模型看起來像在猜謎
AI 圈有個根深蒂固的假設:規模越大,能力越強。更多參數、更多算力、更長訓練,問題就解決了。這個邏輯在語言理解、程式生成等任務上確實成立,但最近一篇論文戳到了它的盲點。
-
Agent與應用
開源 Agent Swarm 上線:Opus 4.8 規劃、Deepseek 執行,agentic loop 成本砍十倍
一套開源 AI agent swarm 框架正式上線,核心設計是分層模型路由:強模型負責規劃、輕量模型負責執行。與全程使用 Opus 4.8 相比,成本降低十倍,速度提升兩倍,效果相當。
-
晶片算力
OpenAI 晶片二號員工 Clive Chan 量產前夕出走,ASIC 經驗直送 Anthropic
OpenAI 硬體組第二號員工 Clive Chan 本週宣佈離職,隨即加入 Anthropic。時間節點耐人尋味:他主導的 OpenAI 與博通合作 10 GW 定製 AI 加速器,據稱採台積電 3 nm 工藝,正值量產視窗,Chan 曾於 2025 年 10 月透露該晶片將於九個月後量產,往後推算恰好是現在。
-
開源生態
異質性是產品:四間實驗室的小模型議會,工程教訓全在 serving 層
v1 的 Thousand Token Wood 是個沙盒:五隻森林動物共用一個微調過的 0.5B 模型,交易、囤貨、在衝擊下崩盤,你是觀眾,負責調參、觀看泡沫生成。它驗證了多 agent 經濟體的可行性,但本質上是個展示品。
-
大廠戰略
斬斷致命三角的一條腿:Lockdown Mode 的防禦邏輯
Prompt injection 不是新威脅,但防禦方法長期停留在「讓 AI 自己判斷哪些指令可信」這個根本上不可靠的路徑。OpenAI 近期正式上線 Lockdown Mode,目前向 Free、Go、Plus、Pro 及自助式 Business 帳號陸續推出,它的設計意圖值得建構 agent 的團隊認真拆解。
-
政策監管
OpenAI 拋出前沿 AI 民主治理藍圖,監管話語權之爭浮上檯面
OpenAI 於官方網站發布《Frontier Safety Blueprint》,提出其對前沿 AI 民主治理框架的構想,將安全議題從實驗室內部自律推向公共政策層次。這份檔案本質上是一份單邊主張,代表 OpenAI 試圖在監管成形之前率先定錨討論框架。
-
Agent與應用
GitLab 營收漲 23% 仍砍 14% 員工,CEO「agentic era」轉型被市場一日打臉
GitLab 在 Q1 財報超預期的當天同步宣佈裁員約 350 人(佔全員近 14%),並退出 22 個國家及地區。本季營收 2.642 億美元、年增 23%,超出分析師預期的 2.54 億;財報發布後盤後股價一度漲 7%,但次日開盤消化裁員訊息後,漲幅全數回吐。
-
Agent與應用
競爭已從模型跑分蔓延到 IPO 時間表:Anthropic S-1 背後的三條線索
6 月 1 日,Anthropic 向 SEC 秘密遞交 Form S-1 草案,同日宣佈完成 650 億美元 Series H 融資,投後估值達 9,650 億美元。股份數量與發行價格尚未確定,後續視 SEC 審查進度而定。
-
大廠戰略
Token 不是問題,進不了 Production 才是
去年六月,OpenAI 執行長放話「廉價到幾乎免費的智慧」近在咫尺。一年後,現實是:有公司幾個月就燒完全年 token 預算,部分 AI 計畫悄悄喊停。「tokenmaxxing」成為業界最新的恐慌詞彙,有人開始懷疑 AI 的動能只是泡沫在撐著。
-
政策監管
佛州 AG 起訴 OpenAI 與 Altman:AI 合規風險從模型延伸到創辦人個人
佛羅里達州總檢察長 James Uthmeier 對 OpenAI 及 CEO Sam Altman 提起訴訟,指控涉及欺騙性商業行為,這是美國首件由州政府主導、直接點名 AI 公司與創辦人個人的執法行動。此案的核心訊號不在個案輸贏,而在於州層級監管正從立法透明度要求升級為主動執法。
-
Agent與應用
OpenAI 模型與 Codex 登陸 AWS,分發層邏輯正在改寫
OpenAI 的 frontier 模型與 Codex 現已可在 AWS 上直接取用。這個動作的真正訊號不是「又多一個雲端入口」,而是模型供應商主動把自己鋪進企業既有的雲端工作負載裡,過去雲廠商靠「自家模型優先」築牆的邏輯正在鬆動。
-
Agent與應用
開源 Agentic Coding 的差距正在收斂,M3 的真正訊號不是跑分
MiniMax M3 最值得認真看的,不是 SWE-Bench Pro 的 59%,雖然這個數字超過 GPT-5.5 和 Gemini 3.1 Pro、接近 Opus 4.7 確實夠硬。真正的訊號是:它是國內第一個把長上下文、多模態、Coding 三件事同時做到的開源模型。
-
開源生態
百度 0.9B 輕量模型 PaddleOCR-VL-1.6 聲稱壓倒 Gemini-3-Pro 與 GPT-5.2,開源可平滑遷移
百度文心正式發布 PaddleOCR-VL-1.6,這個僅 0.9B 參數的輕量專用模型,在文件解析評測 OmniDocBench v1.6 上達到 96.33%。
-
Agent與應用
Anthropic 的雙重翻盤:估值是煙火,Agent 編排才是結構變局
去年 12 月,Anthropic 的年化營收是 $9B。五個月後,這個數字跳到 $47B。同步完成的 $65B Series H 讓其估值達到 $965B post-money,投資人涵蓋 Altimeter、Dragoneer、Greenoaks、Sequoia,以及包含 Amazon 在內的主要雲端業者。