午夜神马影院-日本天堂在线-国产精品777-奇米影视亚洲春色-天堂8中文-日本在线观看一区二区-天天干天天操天天插-国产精品女同-色骚综合-四川一级毛毛片-99在线看-国产极品久久-波多野吉衣毛片-婷婷在线综合-欧美视频成人-亚洲影视一区二区三区-国产精品久久久久久久一区二区-国产精品9191-污污免费观看-日本三区在线

天數(shù)智芯發(fā)布天垓300,面向三類智能構(gòu)建新一代通用算力底座

天數(shù)智芯發(fā)布天垓300,面向三類智能構(gòu)建新一代通用算力底座

供稿 / 2026-07-20 13:321432
標(biāo)簽:WAIC2026

2026世界人工智能大會期間,天數(shù)智芯正式發(fā)布新一代通用GPU旗艦產(chǎn)品天垓300。作為公司新一代架構(gòu)的首款產(chǎn)品,天垓300面向人工智能從信息處理、任務(wù)執(zhí)行到未知探索的發(fā)展趨勢,圍繞芯片架構(gòu)、關(guān)鍵算子、系統(tǒng)擴(kuò)展和軟件生態(tài)全面升級,以對標(biāo)并超越Hopper架構(gòu)國際主流方案(以下簡稱Hopper方案)的效能表現(xiàn),為AI規(guī)模化應(yīng)用提供高質(zhì)量算力支撐。

【通稿】天數(shù)智芯發(fā)布天垓300,面向三類智能構(gòu)建新一代通用算力底座204.png 天垓300 PCIe板卡和OAM模組

天垓300基于SIMT通用計算架構(gòu),可高效支持標(biāo)量、矢量和張量等多種計算類型,并圍繞Attention、MoE、AF分離、PD分離及大規(guī)模系統(tǒng)擴(kuò)展等關(guān)鍵技術(shù)進(jìn)行優(yōu)化,進(jìn)一步提升底層算力向?qū)嶋HToken產(chǎn)出和業(yè)務(wù)價值的轉(zhuǎn)化效率。在復(fù)雜業(yè)務(wù)負(fù)載下,產(chǎn)品兼顧計算效率、業(yè)務(wù)時延和TCO,滿足人工智能規(guī)?;瘧?yīng)用對通用性、性能和成本的綜合要求。

天數(shù)智芯AI與加速計算負(fù)責(zé)人單天逸表示,人工智能正從理解與生成信息的“信息智能”,邁向具備規(guī)劃和執(zhí)行能力的“行動智能”,并進(jìn)一步拓展至能夠建模、預(yù)測和探索未知的“探索智能”。三類智能對計算提出不同要求,也構(gòu)成了天垓300的產(chǎn)品設(shè)計主線。

信息智能:突破關(guān)鍵瓶頸,提升大模型訓(xùn)推效率

隨著模型參數(shù)規(guī)模擴(kuò)大、上下文長度增長和推理請求增加,算力平臺既要提升訓(xùn)練吞吐,也要兼顧推理響應(yīng)和使用成本。針對大模型計算中的核心環(huán)節(jié),天垓300重點優(yōu)化了Attention與MoE。

在Attention計算中,天垓300通過提升矩陣計算與向量計算的并行效率,減少數(shù)據(jù)讀寫等待和冗余計算,在不同精度下實現(xiàn)超過90%的Attention效率,效能優(yōu)于Hopper架構(gòu)主流方案。在長序列任務(wù)中,產(chǎn)品能夠更加充分地利用計算資源,提升訓(xùn)練與推理效率。在上下文64k的場景中,天垓300的Attention效能高于Hopper方案10%。

針對MoE架構(gòu)中的專家調(diào)度和數(shù)據(jù)路由損耗,天垓300通過算法與硬件協(xié)同優(yōu)化,提高專家與計算單元利用率。在DeepSeek V4 MoE場景中的計算效率突破70%,綜合訓(xùn)練效能和性價比優(yōu)于Hopper方案;在推理場景中,可在保持相同響應(yīng)體驗的情況下承載更多并發(fā)請求,以相同算力投入完成更多推理任務(wù),平均效能高于Hopper方案10%。

行動智能:優(yōu)化PD分離,提升Agent響應(yīng)與執(zhí)行效率

Agent不僅要理解目標(biāo)和規(guī)劃任務(wù),還要持續(xù)調(diào)用工具并完成執(zhí)行,對首字響應(yīng)、生成速度和多卡通信提出了更高要求。為此,天垓300強(qiáng)化PD分離能力,分別針對上下文處理的Prefill階段和逐Token生成的Decode階段進(jìn)行差異化優(yōu)化,讓Agent既能“想得快”,也能“做得快”。

在Qwen、GLM、Kimi、DeepSeek等主流模型測試中,天垓300首字延遲較Hopper架構(gòu)主流方案降低約20%。針對Decode階段高頻、多卡、小數(shù)據(jù)量通信,產(chǎn)品通過降低協(xié)議開銷、優(yōu)化鏈路路徑和數(shù)據(jù)流轉(zhuǎn)機(jī)制,使平均通信延遲降低約13%。在GLM 5.2等模型的Decode測試中,效能較Hopper方案提升10%,可為智能編程、辦公助手和業(yè)務(wù)自動化等Agent應(yīng)用提供更加及時、流暢的交互體驗。在PD分離中Prefill和Decode的效能都能高于Hopper方案,實現(xiàn)全面突破。

探索智能:回歸計算本質(zhì),支撐多元算法演進(jìn)

在新材料發(fā)現(xiàn)、氣象預(yù)測、數(shù)字孿生和世界模型等場景中,AI需要參與復(fù)雜系統(tǒng)建模、實驗驗證和未來預(yù)測,計算范式也由相對集中的大模型負(fù)載,拓展至矩陣求解、動態(tài)規(guī)劃、稀疏計算和仿真模擬等多類任務(wù)。

天垓300堅持“回歸計算本質(zhì)”,不局限于Transformer架構(gòu),可高效支持標(biāo)量、矢量和張量計算,覆蓋FP4、FP8等多種精度及MMA、DPX、FMA等指令。除Attention、FFN和MoE外,還可適配矩陣求解、動態(tài)規(guī)劃、稀疏計算和數(shù)字孿生等任務(wù),為現(xiàn)有算法優(yōu)化和未來計算范式演進(jìn)預(yù)留空間,幫助客戶通過虛擬仿真降低現(xiàn)實世界中的實驗成本和試錯風(fēng)險。

在Cosmos3世界模型中,天垓300的推理效能相較Hopper方案同樣高出10%。

不止于芯片:以底層創(chuàng)新與全棧生態(tài)釋放通用算力價值

支撐三類智能的,是天垓300在底層架構(gòu)上的持續(xù)創(chuàng)新。ixSMEX通過提高數(shù)據(jù)復(fù)用率減少重復(fù)訪存;ixDPX將動態(tài)規(guī)劃中原本需要六條指令完成的計算壓縮至一條;ixTrans則通過無損矩陣轉(zhuǎn)置,降低存儲沖突和顯存開銷,進(jìn)一步釋放芯片計算效能。

天數(shù)智芯認(rèn)為,通用GPU的長期價值不僅來自單顆芯片的性能,更在于構(gòu)建一個通用、好用、易用的生態(tài)。公司自2018年起持續(xù)完善軟件棧,目前已開發(fā)近百個加速庫,并形成覆蓋通信、編譯、驅(qū)動、量化和性能分析的工具體系。天垓300同步支持全球主流大模型框架、模型及關(guān)鍵加速組件,可減少客戶在遷移、適配和性能調(diào)優(yōu)中的重復(fù)投入。

目前,天垓300已具備規(guī)?;瘧?yīng)用條件,并與國內(nèi)云廠商、服務(wù)器廠商、互聯(lián)生態(tài)及超節(jié)點系統(tǒng)開展深度適配,可支持從單機(jī)到萬卡集群的規(guī)?;渴?。

天垓300并非一款孤立的芯片產(chǎn)品,其背后是一套由硬件、軟件、系統(tǒng)與合作伙伴共同構(gòu)成的生態(tài)。未來,天數(shù)智芯將與更多產(chǎn)業(yè)鏈伙伴共同完善通用GPU產(chǎn)品與生態(tài),以高質(zhì)量算力賦能智能社會,推動人工智能重塑千行百業(yè)。


聲明類型:無需添加自主聲明

發(fā)表評論注冊|