Chip Insight 資料庫
#AI Inference
找到 3 篇文章
家裡的舊顯卡別急著退休:NVIDIA PAIR 要把多台 PC 組成你的私人 AI 叢集
NVIDIA 在 IFA 2026 發表 Personal AI Router(PAIR),試圖把家中分散在不同 PC、工作站甚至 Mac 上的閒置運算能力串成一套私人 AI inference 系統。它不會把多張顯卡的 VRAM 合併,而是像 AI 工作負載的智慧交通警察,將不同推論請求送往當下最合適的裝置。
晶片觀測站·4 週前
8 mind-Matrix 發表 Raptor AI 推論晶片:宣稱頻寬密度達 NVIDIA Rubin 20 倍,挑戰 HBM 架構瓶頸
AI 晶片新創 d-Matrix 公布新一代 Raptor 推論加速器,透過將最多四層 DRAM 直接堆疊於 TSMC N4 邏輯晶片下方,試圖繞過傳統 HBM 的水平資料傳輸與 PHY 功耗限制。公司宣稱,新架構可帶來約 20 倍的單位面積頻寬密度,以及每傳輸 1GB 資料約 13.5 倍的能源效率改善,並鎖定大型語言模型最受記憶體頻寬限制的 Decode 階段。不過目前公開資訊主要仍來自 d-Matrix 的技術簡報與效能宣稱,尚缺乏完整規格、現場展示與第三方獨立測試。
晶片觀測站·1 個月前
8 minAMD 收購 AI 推論晶片新創 Taalas,將 AI 模型直接「燒錄進矽晶片」,瞄準新一代高效推論市場
AMD 宣布已簽署最終協議收購 AI 晶片新創 Taalas。這項收購發生在 AMD 與 Cerebras 合作推出 Helios AI 系統僅數週後,顯示 AMD 正積極布局 AI 推論(Inference)市場。Taalas 的核心技術並非提升 GPU 算力,而是將 AI 模型直接固化於晶片電路中,藉此大幅降低記憶體存取延遲,突破長期困擾 AI 推論的 Memory Wall(記憶體瓶頸)。
晶片觀測站·1 個月前
5 min

