Chip Insight 資料庫
#AI Accelerator
找到 3 篇文章
AI 晶片真正的瓶頸不是算力?新論文指出:記憶體正在成為整台電腦的核心
一篇最新 arXiv 綜述重新整理了 GPU、TPU、Trainium、Groq、Cerebras、FPGA、PIM、神經形態運算與光子運算等 AI 加速器架構。作者指出,大型語言模型真正的限制正在從純算力轉向記憶體頻寬、KV Cache 容量與資料搬運能耗。未來 AI 硬體不太可能由單一架構取代 GPU,而更可能走向以記憶體為中心的異質運算系統。
晶片觀測站·1 個月前
9 mind-Matrix 發表 Raptor AI 推論晶片:宣稱頻寬密度達 NVIDIA Rubin 20 倍,挑戰 HBM 架構瓶頸
AI 晶片新創 d-Matrix 公布新一代 Raptor 推論加速器,透過將最多四層 DRAM 直接堆疊於 TSMC N4 邏輯晶片下方,試圖繞過傳統 HBM 的水平資料傳輸與 PHY 功耗限制。公司宣稱,新架構可帶來約 20 倍的單位面積頻寬密度,以及每傳輸 1GB 資料約 13.5 倍的能源效率改善,並鎖定大型語言模型最受記憶體頻寬限制的 Decode 階段。不過目前公開資訊主要仍來自 d-Matrix 的技術簡報與效能宣稱,尚缺乏完整規格、現場展示與第三方獨立測試。
晶片觀測站·1 個月前
8 min阿里巴巴全面退出自製遊戲!出售靈犀互娛持股套現逾 20 億美元,資金轉向 AI 與資料中心
阿里巴巴同意將旗下遊戲開發商靈犀互娛出售給亞洲私募股權公司 Trustar Capital,交易涉及阿里巴巴持有的全部股權。據 Reuters 引述知情人士指出,阿里巴巴可望從交易取得超過 20 億美元;Bloomberg 則報導靈犀互娛估值至少達 15 億美元。這筆出售意味阿里巴巴將正式退出內部遊戲開發業務,並進一步將資本集中至 AI、雲端運算、資料中心與自研晶片等核心戰略。
晶片觀測站·1 個月前
7 min

