AMD收購Taalas,爲其帶來可實現每位用戶每秒16,000 token吞吐量的模型專用矽晶片——性能是目前GPU推理能力的數倍。
AMD收購Taalas,爲其帶來可實現每位用戶每秒16,000 token吞吐量的模型專用矽晶片——性能是目前GPU推理能力的數倍。

AMD收購了Taalas,這家公司的硬接線AI晶片可實現每位用戶每秒16,000 token的吞吐量,爲這家晶片製造商提供了一條在快速增長的推理市場中挑戰Nvidia的道路。
「我們創立Taalas的初衷,是圍繞模型來構建硬體,從根本上重新思考AI推理。」Taalas執行長兼聯合創辦人Ljubisa Bajic表示,「加入AMD將爲我們提供規模、工程資源和全球佈局,以加速我們的創新步伐。」
Taalas成立於2023年,由前Tenstorrent領導層(包括前執行長Bajic在內)共同創立,今年2月從隱密狀態中正式亮相,其示範晶片在Llama3.1-8B上實現了每位用戶每秒超過16,000 token的吞吐量——是目前世代GPU所能提供性能的數倍。該公司的HC1晶片將模型的資料流硬接線至矽晶片中,並將權重燒錄其中,借鑑了2000年代初期的結構化ASIC方法。其代價是:這款晶片只能運行Llama3.1-8B,更換模型需要重新流片——通常需要兩套分別代表權重和資料流的光罩。該公司從Quiet Capital和Pierre Lamond處籌得5,000萬美元,隨後今年稍早又從包括Fidelity在內的投資者手中獲得1.69億美元融資。
AMD計劃將Taalas技術整合到系統級解決方案中,與其Instinct GPU並行,這與Nvidia近期幾乎全資收購Groq的做法,以及AMD與Cerebras在分離式推理領域的現有合作如出一轍。這筆交易尚需滿足交割條件並獲得監管批准,爲AMD提供了一條進入推理市場的差異化路徑——在這個市場中,效率比靈活性更爲重要。
16,000 token背後的結構化ASIC賭注
Taalas的做法以犧牲可程式化性來換取速度。HC1晶片完全基於SRAM架構,模型權重和資料流均燒錄於矽晶片中。對於更大的模型,物理限制便顯現出來:DeepSeek-671B大約需要30次單獨的流片。該公司的工具流程可在大約兩個月內將訓練好的模型轉換爲光罩設計,這是其核心競爭優勢所在——與客製化ASIC典型的1至2年開發週期形成鮮明對比。
單一Taalas晶片的參數量上限似乎約爲80億參數,具體取決於模型被量化的激進程度。這使得該技術適用於小型模型推理工作負載——包括邊緣應用、實體AI以及對延遲敏感的部署場景,在這些場景中,功耗限制和成本敏感度勝過對頻繁模型更新的需求。
AMD推理堆疊 vs. Nvidia-Groq
AMD的收購行動反映了業界正在形成的分離式推理架構趨勢。Nvidia去年底幾乎全資收購了Groq,計劃將其晶片用於推理的解碼階段,與GPU搭配使用。AMD最近也宣佈了與Cerebras的類似安排:其GPU負責預填充階段,而Cerebras的晶圓級引擎則加速解碼。Taalas的SRAM基晶片有可能在內部填補這一解碼角色,使AMD擁有一套完全掌控的系統,與Nvidia-Groq的組合相媲美。
這筆交易還加深了AMD在加拿大的佈局。自2006年收購ATI Technologies以來,該公司一直在多倫多維持營運,這是在短短一年多內對加拿大AI晶片公司的第二次收購,此前於2025年完成了Untether AI團隊的交易。AMD同時也是多倫多新創公司Cohere和Xanadu的投資者。
AMD股價目前報489.28美元,過去一年回報率超過100%,反映了市場對其AI資料中心發展軌跡的樂觀情緒。2026年第二季營收達到115億美元,與Core Scientific的合作關係預示著未來的大規模部署。Taalas收購案爲AMD的產品組合增添了推理專用矽晶片,而該組合已涵蓋消費級PC中的Ryzen AI、資料中心中的EPYC處理器以及用於訓練工作負載的Instinct GPU。
對投資者而言,關鍵問題在於AMD能否將Taalas技術轉化爲具體的系統級勝利——即推理最佳化晶片能在企業或雲端部署中與Instinct GPU一起出貨。證據將體現在具體客戶公告,或在未來資料中心更新中量化推理解決方案的貢獻。Nvidia憑藉其CUDA軟體平台和積極的競爭回應,仍是評估AMD任何推理策略的基準。
本文僅供資訊參考用途,不構成投資建議。