智通財經APP獲悉,全球AI大模型/AI應用領軍者Anthropic PBC公司已聘請阿米爾·薩萊克(Amir Salek),他是Alphabet Inc.旗下谷歌的定製化AI芯片項目(即谷歌TPU AI芯片)的核心創始人之一;此舉正值這家全球最頂級人工智能實驗室為全力進軍自研AI半導體領域(也被稱作定製化AI ASIC/XPU芯片,TPU即是該技術路線)奠定重要基礎之際。
這家人工智能公司周五表示,薩萊克將加入Claude AI超級平台開發商Anthropic旗下的人工智能算力團隊。在2022年之前,他一直負責谷歌的張量處理單元(TPU)業務,並幫助谷歌完成設計前七代TPU芯片。履新後,薩萊克將直接向Anthropic人工智能算力總負責人詹姆斯·布拉德伯裏(James Bradbury)彙報。
美國科技巨頭之一的微軟(MSFT.US)計劃很快推出其最新自研AI加速器Maia,加之谷歌與Fabless芯片公司Marvell(邁威爾科技)的新協議覆蓋AI加速器、存儲和內存控制器等多款定製芯片,凸顯出AI應用領軍者以及超大規模雲計算廠商們主導的AI算力基礎設施建設進程正在從「集體採購英偉達GPU」全面升級為英偉達GPU+AMD GPU+自研AI專用集成電路(AI ASIC)/XPU+CPU/DPU大規模協同運行的異構計算體系。當AI大模型架構逐步穩定且全球各行業Token調用量呈現出指數級增長後,高併發AI推理工作負載越來越適合通過定製芯片降低單位Token成本。
也就是說,AI訓練算子進程以及那些架構最複雜、變化速率最快的前沿AI工作負載仍高度需要AI GPU集群——前沿模型預訓練、強化學習和快速變化的新算子仍更依賴GPU的可編程性、CUDA生態與NVLink/NVSwitch集群能力,而圍繞成熟與開源體系AI大模型、Copilot、AI Agent(即AI智能體)的大規模AI推理工作負載則越來越適合專用的自研AI芯片。
在摩根士丹利、Wedbush Securities等持續看好AI算力產業鏈投資前景的機構們看來,AI推理時代的近乎無止境最前沿算力與圍繞AI智能體的算力需求,使AI ASIC能夠在不摧毀GPU需求的情況下成長為第二個萬億級算力生態的重要組成部分——反而進一步強化了「AI半導體超級周期不是單一GPU周期,而是整個數據中心硅含量提升周期」的AI算力產業鏈投資邏輯。
Anthropic加碼佈局AI芯片,定製硅成為推理成本決勝點
Anthropic從包括英偉達、谷歌和亞馬遜在內的多種渠道大規模採購AI芯片/AI加速器。該公司近期已經表明,希望建立內部自研硅芯片業務。這家總部位於舊金山的公司已開始為此招募人才並發布相關職位,並且有媒體報道稱該公司開始與「全球芯片代工之王」台積電洽談先進製程與先進封裝長期代工合作。
不過Anthropic目前尚未公布最新代自研芯片的架構、流片時間或者類似博通與Marvell這樣的正式外部fabless芯片聯合設計夥伴。博通此前參與的是Anthropic約350億美元算力擴建項目,為其提供定製化AI ASIC芯片、網絡基礎設施方案及孖展支持,但截至目前尚未被確認是Anthropic自有芯片業務的長期合作伙伴。
與其他人工智能應用端超級巨頭一樣,Anthropic正競相爭取足夠的數據中心基礎設施,以支撐其宏大目標。定製化的AI芯片集群可能幫助該公司以更加全面的姿態來應對全球AI芯片供應短缺,並根據自身需求有針對性地優化芯片設計與綜合性能,且有望大幅降低Anthropic數據中心運營端的AI推理成本。
ChatGPT背後的公司,即Anthropic的最強競爭對手OpenAI也在採取類似行動。OpenAI已發布一款與芯片巨頭博通攜手完成設計且名為「Jalapeno」的自研AI芯片雛形架構,並計劃於今年晚些時候開始使用。
Anthropic正以極快速度簽署AI芯片以及整個數據中心超大容量協議,同時與成熟供應商和新興雲計算廠商們展開多年期合作。據媒體此前不久報道,該公司已與英國芯片初創企業Fractile達成協議,首批芯片訂單規模約為2.5億美元,並計劃未來擴大該合同。Anthropic近期還與Riot Platforms Inc.和Volta Infra Holdings Ltd.簽署了數據中心大規模容量供給協議。
此外,這家Claude AI應用平台的前沿AI開發者正在進行相關估值與IPO募資測算,並且管理層準備最快於本月底公開提交潛在超大型IPO的必要申請文件。有媒體援引知情人士透露的消息報道稱,Anthropic管理層預計其美股市場首次公開募股(IPO)規模將追平或超過SpaceX 6月登陸美股上市時的創紀錄IPO規模,這一最新關於AI產業鏈的動態可謂是再次表明,希望從史無前例人工智能投資熱潮中獲利的機構與散戶投資者需求極其旺盛。
Anthropic設定的比SpaceX更具雄心壯志的IPO目標規模足以反映出,人工智能行業的最熱門領軍企業正在重塑科技投資版圖。這家成立僅僅五年的公司今年5月以9,650億美元估值孖展650億美元,超過競爭對手OpenAI今年3月孖展1,220億美元時所達到的8,520億美元估值。
Anthropic財務曲線為華爾街對於該公司的極度樂觀盈利路徑以及創紀錄IPO預期提供了罕見的可驗證性。Anthropic年化營收運行率由2025年底約90億美元升至2026年5月470億美元、7月底超過650億美元,七個月內營收規模達到約7.2倍、增幅約622%;第二季度初步營收超過115億美元,是2025年同期7.87億美元的約14.6倍,也達到第一季度47.3億美元的約2.4倍,並首次實現經調整營業利潤轉正。
離開谷歌後,薩萊克一直擔任私募股權公司Cerberus Capital Management的高級董事總經理。該公司由美國國防部副部長斯蒂芬·範伯格(Stephen Feinberg)共同創立。值得注意的是,他此前還曾供職於全球領先的人工智能處理器製造商英偉達。
谷歌聯手Marvell、Anthropic挖角TPU元老,AI巨頭們在AI推理時代爭奪「硅權」
AI推理時代的Token經濟學截然不同於AI訓練工作負載,訓練包含前向傳播、反向傳播、梯度同步與頻繁變化的研究型算子,更看重通用性、軟件成熟度和集群擴展能力;推理則可拆分為計算密集型的預填充(Prefill)和內存帶寬、KV緩存及延遲敏感的解碼。ASIC/XPU能夠實現刪除不必要的通用電路,針對FP8/FP4低精度矩陣運算、注意力機制、混合專家模型(MoE)、KV Cache和數據移動路徑進行硬化,從而提升每瓦Token數量級、每美元Token數及服務等級協議(SLA)的確定性。
需要強調的是,AI智能體的模型調用模式雖然相比於GPU更加適合ASIC,但其規劃、工具調用、檢索增強生成(RAG)和狀態管理仍需CPU、內存、網絡與存儲協同,因此智能體時代反而會進一步強化異構計算。
具體來看,谷歌將第八代TPU分為訓練型TPU 8t和推理型TPU 8i:8i通過更大的片上SRAM、288GB HBM和專用集合通信引擎優化KV Cache與低延遲推理,官方稱其推理性價比較Ironwood提高最高80%;谷歌與Marvell的新協議則覆蓋AI加速器、存儲和內存控制器等定製芯片,潛在採購對應Marvell截至2033財年的最高約1200億美元收入,實質是分散對谷歌TPU長期以來的技術端合作伙伴博通這一單一fabless設計夥伴的依賴。
微軟Maia 200則以台積電3納米制程、FP8/FP4張量核心、272MB片上SRAM及定製片上網絡(NoC)壓縮Azure、Copilot與大模型推理成本;其相對英偉達GPU的核心優勢不是「任何模型都更快」,而是微軟能夠把芯片、編譯器、模型、數據中心網絡和雲端調度聯合優化,並避免支付外部GPU廠商們的全部利潤溢價。
來自華爾街頂級投資機構Wolfe Research的策略師Chris Caso指出,費城半導體指數(SOXX)此前約三個月翻倍,隨後從高點下跌約25%,近期疲弱更像是大漲後的預期重置。Caso預計人工智能芯片的需求至少到2028年仍將超過供應,認為此前市場擔憂的超大規模雲計算資本開支放緩並未實際發生,圍繞AI智能體的競爭趨勢反而令超大規模雲廠商「沒有不投入的選擇」。
更多港股重磅資訊,下載智通財經app
更多港股及海外理財資訊,請點擊www.zhitongcaijing.com(搜索「智通財經」);欲加入智通港股投資群,請加智通客服微信(ztcjkf)