Nvidia
共 60 篇 · 第 3/3 頁
-
資本市場
點雲押注:FP3 的 3D 賭注,與中國具身基座白熱化
機器人基座模型大多吃的是 2D 影像,這本身是一個先天妥協。現實空間是三維的,影像壓縮掉深度資訊,模型靠統計猜物件位置。ICRA 2026 最佳論文提名的 FP3,賭的就是這條縫:用點雲取代影像,直接輸入 3D 幾何。
-
開源生態
異質性是產品:四間實驗室的小模型議會,工程教訓全在 serving 層
v1 的 Thousand Token Wood 是個沙盒:五隻森林動物共用一個微調過的 0.5B 模型,交易、囤貨、在衝擊下崩盤,你是觀眾,負責調參、觀看泡沫生成。它驗證了多 agent 經濟體的可行性,但本質上是個展示品。
-
研究前沿
幾何重建連霸、資料牆被捅破、遊戲成基座:讀懂 CVPR 2026 三條主線
CVPR 2026 在丹佛落幕,74 篇入圍、5 篇獲獎。略過花名冊,三條主線值得做研究和建產品的人記好。
-
Agent與應用
NVIDIA Nemotron 3 Ultra:開放權重新座標,與一場低精度預訓練的規模跳躍
開源模型與閉源前沿的差距,一直是做 agent 系統的團隊繞不開的成本題。NVIDIA 這次發布 Nemotron 3 Ultra,給這道題打進了一個新的刻度。
-
資本市場
A2A 進消費端、6G 備戰 2029:AI 代理的底層基礎設施正在成形
三條新聞放在一起讀,輪廓才會清晰。微信宣佈與華為、小米、榮耀、OPPO 等手機廠商接入 A2A(Agent-to-Agent)協議;中國工信部發布 6G 部省協同試點行動通知,目標 2029 年形成可商用技術體系;SpaceX 啟動 IPO 路演,計劃公開發行超過 5.5 億股 A 類普通股,定價預計每股 135 美元。
-
研究前沿
小鵬 CVPR 拒答路線之爭:VLA 與世界模型雙軌協同,Tesla、Waymo、英偉達同台聆聽
CVPR 2026 首屆具身智慧基座模型部署研討會上,特斯拉、Waymo、英偉達等物理 AI 第一梯隊悉數到場。受邀登台的唯一中國企業是小鵬。小鵬通用智慧中心負責人劉先明被問及「走 VLA 路線還是世界模型路線」,給出第三個答案:小鵬物理世界基座模型既是第二代 VLA、也是世界模型,二者用不同訓練訊號協同進化。
-
晶片算力
面壁智慧「開源周」五天攤開端側完整技術棧,DeepSeek 後罕見的系統性亮牌
5 月 25 日至 29 日,面壁智慧聯合 OpenBMB 開源社群以每日一項的節奏,集中發布五個技術成果:1.58-bit 量化訓練模型 BitCPM-CANN、AI 撰寫的訓練框架 ForgeTrain、核心資料集 UltraData、端側小模型 MiniCPM5-1B,以及 agent 作業系統 PilotDeck。
-
研究前沿
智在無界 Being-H-Flash 月費 150 元落地端側,隱式路線把世界模型成本打到英偉達 Cosmos 的 2%
智在無界發布隱式世界模型產品 Being-H-Flash,在單台機器人每日掃碼千件的流水線場景中,月算力成本僅需 150 元,相當於一張 GPT Plus 訂閱費,是英偉達 Cosmos 方案的 2%、比 VLA 架構的 Pi0.5 便宜 70%。
-
研究前沿
跨維智慧奪下 WorldArena Track 2 全球第一,世界模型的勝負標準從畫面真實轉向資料可執行性
WorldArena 5 月 25 日截止的最新榜單顯示,跨維智慧的世界模型 DSCFuncWorld 拿下 Track 2(Data Engine)全球第一,比分顯著領先第二名,並超越 WoW、BLM 等國際旗艦模型。
-
開源生態
操作是 APP,運動才是 OS:全行業搞錯了優先順序
具身智慧賽道的共識快成路徑依賴:疊衣服、端咖啡、鎖螺絲,操作任務結果直觀,資料需求自然向上半身集中。橋介數物創辦人尚陽星在深度訪談中給出反向判斷,全身運動資料的重要性,被整個行業嚴重低估了。
-
Agent與應用
開源 Agentic Coding 的差距正在收斂,M3 的真正訊號不是跑分
MiniMax M3 最值得認真看的,不是 SWE-Bench Pro 的 59%,雖然這個數字超過 GPT-5.5 和 Gemini 3.1 Pro、接近 Opus 4.7 確實夠硬。真正的訊號是:它是國內第一個把長上下文、多模態、Coding 三件事同時做到的開源模型。
-
研究前沿
xAI Ethan He:影片模型的智慧源自 LLM,下一個 Sora 是影片 Agent
前 NVIDIA Cosmos 世界模型主導工程師 Ethan He 加入 xAI 後,率小型團隊在三個月內從零建出 Grok Imagine,並在 Latent Space podcast 拋出反直覺核心論點:影片模型的「智慧」主要來自 LLM,不是來自看更多影片訓練資料。這個判斷直接改寫了影片生成的下一步路線圖。