午夜神马影院-日本天堂在线-国产精品777-奇米影视亚洲春色-天堂8中文-日本在线观看一区二区-天天干天天操天天插-国产精品女同-色骚综合-四川一级毛毛片-99在线看-国产极品久久-波多野吉衣毛片-婷婷在线综合-欧美视频成人-亚洲影视一区二区三区-国产精品久久久久久久一区二区-国产精品9191-污污免费观看-日本三区在线

天數智芯發布天垓300,面向三類智能構建新一代通用算力底座

天數智芯發布天垓300,面向三類智能構建新一代通用算力底座

供稿 / 2026-07-20 13:321304
標簽:WAIC2026

2026世界人工智能大會期間,天數智芯正式發布新一代通用GPU旗艦產品天垓300。作為公司新一代架構的首款產品,天垓300面向人工智能從信息處理、任務執行到未知探索的發展趨勢,圍繞芯片架構、關鍵算子、系統擴展和軟件生態全面升級,以對標并超越Hopper架構國際主流方案(以下簡稱Hopper方案)的效能表現,為AI規模化應用提供高質量算力支撐。

【通稿】天數智芯發布天垓300,面向三類智能構建新一代通用算力底座204.png 天垓300 PCIe板卡和OAM模組

天垓300基于SIMT通用計算架構,可高效支持標量、矢量和張量等多種計算類型,并圍繞Attention、MoE、AF分離、PD分離及大規模系統擴展等關鍵技術進行優化,進一步提升底層算力向實際Token產出和業務價值的轉化效率。在復雜業務負載下,產品兼顧計算效率、業務時延和TCO,滿足人工智能規模化應用對通用性、性能和成本的綜合要求。

天數智芯AI與加速計算負責人單天逸表示,人工智能正從理解與生成信息的“信息智能”,邁向具備規劃和執行能力的“行動智能”,并進一步拓展至能夠建模、預測和探索未知的“探索智能”。三類智能對計算提出不同要求,也構成了天垓300的產品設計主線。

信息智能:突破關鍵瓶頸,提升大模型訓推效率

隨著模型參數規模擴大、上下文長度增長和推理請求增加,算力平臺既要提升訓練吞吐,也要兼顧推理響應和使用成本。針對大模型計算中的核心環節,天垓300重點優化了Attention與MoE。

在Attention計算中,天垓300通過提升矩陣計算與向量計算的并行效率,減少數據讀寫等待和冗余計算,在不同精度下實現超過90%的Attention效率,效能優于Hopper架構主流方案。在長序列任務中,產品能夠更加充分地利用計算資源,提升訓練與推理效率。在上下文64k的場景中,天垓300的Attention效能高于Hopper方案10%。

針對MoE架構中的專家調度和數據路由損耗,天垓300通過算法與硬件協同優化,提高專家與計算單元利用率。在DeepSeek V4 MoE場景中的計算效率突破70%,綜合訓練效能和性價比優于Hopper方案;在推理場景中,可在保持相同響應體驗的情況下承載更多并發請求,以相同算力投入完成更多推理任務,平均效能高于Hopper方案10%。

行動智能:優化PD分離,提升Agent響應與執行效率

Agent不僅要理解目標和規劃任務,還要持續調用工具并完成執行,對首字響應、生成速度和多卡通信提出了更高要求。為此,天垓300強化PD分離能力,分別針對上下文處理的Prefill階段和逐Token生成的Decode階段進行差異化優化,讓Agent既能“想得快”,也能“做得快”。

在Qwen、GLM、Kimi、DeepSeek等主流模型測試中,天垓300首字延遲較Hopper架構主流方案降低約20%。針對Decode階段高頻、多卡、小數據量通信,產品通過降低協議開銷、優化鏈路路徑和數據流轉機制,使平均通信延遲降低約13%。在GLM 5.2等模型的Decode測試中,效能較Hopper方案提升10%,可為智能編程、辦公助手和業務自動化等Agent應用提供更加及時、流暢的交互體驗。在PD分離中Prefill和Decode的效能都能高于Hopper方案,實現全面突破。

探索智能:回歸計算本質,支撐多元算法演進

在新材料發現、氣象預測、數字孿生和世界模型等場景中,AI需要參與復雜系統建模、實驗驗證和未來預測,計算范式也由相對集中的大模型負載,拓展至矩陣求解、動態規劃、稀疏計算和仿真模擬等多類任務。

天垓300堅持“回歸計算本質”,不局限于Transformer架構,可高效支持標量、矢量和張量計算,覆蓋FP4、FP8等多種精度及MMA、DPX、FMA等指令。除Attention、FFN和MoE外,還可適配矩陣求解、動態規劃、稀疏計算和數字孿生等任務,為現有算法優化和未來計算范式演進預留空間,幫助客戶通過虛擬仿真降低現實世界中的實驗成本和試錯風險。

在Cosmos3世界模型中,天垓300的推理效能相較Hopper方案同樣高出10%。

不止于芯片:以底層創新與全棧生態釋放通用算力價值

支撐三類智能的,是天垓300在底層架構上的持續創新。ixSMEX通過提高數據復用率減少重復訪存;ixDPX將動態規劃中原本需要六條指令完成的計算壓縮至一條;ixTrans則通過無損矩陣轉置,降低存儲沖突和顯存開銷,進一步釋放芯片計算效能。

天數智芯認為,通用GPU的長期價值不僅來自單顆芯片的性能,更在于構建一個通用、好用、易用的生態。公司自2018年起持續完善軟件棧,目前已開發近百個加速庫,并形成覆蓋通信、編譯、驅動、量化和性能分析的工具體系。天垓300同步支持全球主流大模型框架、模型及關鍵加速組件,可減少客戶在遷移、適配和性能調優中的重復投入。

目前,天垓300已具備規模化應用條件,并與國內云廠商、服務器廠商、互聯生態及超節點系統開展深度適配,可支持從單機到萬卡集群的規模化部署。

天垓300并非一款孤立的芯片產品,其背后是一套由硬件、軟件、系統與合作伙伴共同構成的生態。未來,天數智芯將與更多產業鏈伙伴共同完善通用GPU產品與生態,以高質量算力賦能智能社會,推動人工智能重塑千行百業。


聲明類型:無需添加自主聲明

發表評論注冊|