“算力×聯接” 新華三網路讓AI算力更普惠

首頁 > 科技

“算力×聯接” 新華三網路讓AI算力更普惠

來源:怎樣不禿頂 釋出時間:2024-05-16 15:14

在生成式AI爆發的時代,人們需要的不止是大規模的加速計算,高質量的智算中心建設更為關鍵。這一過程中,算力、網路、儲存、運維等環節缺一不可,要知道,大模型的推理和訓練需要成千上萬顆GPU,這些海量GPU連線後形成的超級計算叢集,離不開高可靠、低時延、有韌性的智算網路。尤其是對於中國算力產業的發展來說,計算叢集的並行化、協同化發展更為重要。例如,擁有1750億引數的ChatGPT-3由1萬個V100 GPU和28.5萬個CPU組成,每個GPU伺服器要有400Gb/s的網路效能才能滿足算力需求,更不要說萬億級引數的GPT-4。

國家發展改革委等部門印發的《關於深入實施“東數西算”工程加快構建全國一體化算力網的實施意見》(下稱“《意見》”)指出,到2025年底,普惠易用、綠色安全的綜合算力基礎設施體系初步成型,東西部算力協同排程機制逐步完善,通用算力、智慧算力、超級算力等多元算力加速集聚,國家樞紐節點地區各類新增算力佔全國新增算力的60%以上,國家樞紐節點算力資源使用率顯著超過全國平均水平。1ms時延城市算力網、5ms時延區域算力網、20ms時延跨國家樞紐節點算力網在示範區域內初步實現。算力電力雙向協同機制初步形成,國家樞紐節點新建資料中心綠電佔比超過80%。使用者使用各類算力的易用性明顯提高、成本明顯降低,國家樞紐節點間網路傳輸費用大幅降低。算力閘道器鍵核心技術基本實現安全可靠,以網路化、普惠化、綠色化為特徵的算力網高質量發展格局逐步形成。?

“如果說過去的網路是分析層級,是單點連線的,那麼在智算時代,網路之間聯接的外延和內生都在拓展,深入到了伺服器內部、伺服器與伺服器之間、資料中心之間,以及廣域網、園區網之間等等。”新華三集團高階副總裁、網路產品線總裁曾富貴談到,“多元化算力的異構性和大幅提升的計算機能需要更強的網路支撐,因此,新華三網路也迎來了全面進級,從‘算力+聯接’,演進到了‘算力×聯接’。”

新華三集團高階副總裁、網路產品線總裁曾富貴

可以說,“算力×聯接”是新華三“AI in All”、“AI for All”戰略落地的技術基礎。在算力需求爆發的背景下,資料中心內部、資料中心之間的聯接和海量的資料傳輸對網路提出了更嚴苛的要求,要實現資料在超長距離下的無損通訊。因此,高品質、確定性的網路聯接就顯得尤為重要,而這需要網路基礎設施、控制和管理層,以及運維服務層協同進級。更重要的是,要有一個“智慧大腦”對網路全域性進行視覺化的實時採集和分析,並使其靈活排程,不亂可靠。

依託於“算力×聯接”理念,新華三釋出了靈犀大模型,並透過全面融合AI能力的AD-NET 7.0承載靈犀大模型落地,支援其部署在雲端或本地,結合網路裝置內嵌的NAI(Native Artificial Intelligence)智原生技術,對資料中心、園區網、廣域網等場景能力均進行了升級。透過靈犀大模型對整個網路賦能,能夠讓資料中心以算力為目標,實現更高效率、更低能耗的算力生產;讓園區網以智快至簡為目標,實現超寬、隨時隨地線上的算力應用接入;讓廣域網以業務智享為目標,實現面向業務、精細化管理的算力傳送,滿足要不同地域上高效的算力排程。基於新華三的智算能力、行業知識和實踐經驗,AD-NET 7.0實現了從“應用驅動網路”向“雙A(Application+AI)驅動”的進化。

與此同時,模型引數的暴增讓加速卡也來到了數十萬張的量級,這種引數對硬體數量的非線性關係使得相應的網路裝置、埠、光模組等數量會升至百萬級的規模,資料中心的密度會越來越高,埠密度隨之提高,高密度使得一個埠要有多個連線芯數。此時,規模化帶來的第一個問題就是網路彈性,涉及技術、架構、能源等多方面的挑戰,例如路由器跨城域無損、資料中心網路無損等。

第二個要解決有限空間內的電力供應和成本,如果要支援1000個機櫃,需要數兆瓦的電力,電力和算網的成本同樣重要。

新華三集團副總裁、網路產品線副總裁、交換機產品線總經理李玉濤介紹稱,新華三在400G、800G交換機的研發過程中重點考慮了能耗的問題,支援LPO線性光模組,傳統400G光模組的能耗是10-12瓦,LPO光模組則是6.5瓦,規模降幅顯著。同時,新華三還推出了矽光交換機(CPO),省去了光模組的能源消耗,讓機房的長期運營大受裨益。

為了確保大模型在訓練過程中的網路可靠性,新華三的算網產品在出廠時就經過了各種嚴格的測試,透過專門的指導規範把光鏈路在上線後的故障率降到非常低的水平,並且在軟體層面利用負載均衡等技術,提供了充分的冗餘機制,在硬體故障時可以快速轉換。例如藉助DPSH協議,讓過去鏈路斷掉後的秒級或毫秒級轉換,變為現在的微秒級轉換,硬體可以自行感知鏈路狀態,甚至無需軟體介入。

可以看到,算力基礎設施、AD-NET 7.0、靈犀大模型,構成了新華三網路AI能力的正向迴圈,即以網強算、以算提智、以智增效。其中,以智增效是指加速AI技術在資料通訊領域的應用落地,AD-NET利用AIGC可實現高效的異常檢測、趨勢預測、故障診斷和智慧調優,靈犀助手就是典型的應用,其支援使用者以自然語言的方式獲取網路知識、配置、產品推薦等資訊,幫助各種複雜網路自動調優,同樣,AI也可以讓系統排障、防護更專業,網路執行更高效。以算提智,會基於新華三在ICT領域的知識語料積累,數萬名網路專家,利用算力訓練和微調獲取靈犀大模型,對統一運維能力進行進級。以網強算,這也是網路和算力融合的體現,由AD-NET提供算力產生和算力聯接的網路基礎設施,為AI模型的訓練帶來了高效算力,支撐了智慧化服務所需的聯接服務。

在提高算力的同時,還要透過網路的無損、大吞吐量等方式讓算力的利用率大幅提升,負載均衡就是很有代表性的技術,包括增強逐流均衡、逐包均衡、信元均衡等。智算資料中心內訓練的模型引數非常大,大模型下面的流量模型差異較大,過去,不同業務之間的流量是10G、20G的差別,現在的均衡差別可能是數百G,這就導致了按流負載會出現大面積不均衡的情況,產生擁塞和丟包,影響整個模型的效率,消耗過多的網路頻寬和訓練時間。如果是按包負載,雖然能做到包數量的均衡,但在網路末端有可能出現數據包的亂序,使得終端網絡卡或網路要對亂序包進行重組,否則應用就會出現問題。這一過程中,並不是所有網絡卡和網路末端都有重組排序的能力。對此,新華三的盒盒組網、框盒組網、DDC組網可以支援各種異構的算力、網路末端的標卡和智慧網絡卡,能夠根據客戶需求實施各類負載均衡的演算法,實現了全域性的負載均衡,無阻塞網路可以讓每條鏈路都得到利用。

“比如說一條400G的鏈路,平時在訓練過程中的流量資料很少,一旦訓練完要做集合計算的時候,資料就會出現鋸齒的形態,抖動非常大,流量頻寬幾乎都被佔滿了。如果多條鏈路同時再發的時候,一定會出現丟包,這就必需要用到負載均衡。我們可以預知不不亂因素,對流量進行排程,把丟包率降到最低。”李玉濤表示,“開放標準的乙太網要透過負載均衡技術把RoCE最大的無損能力發揮出來,無論是DLB仍是全域性路徑的規劃,還有配合Agent軟體,我們在網路鏈路中的效率提升是很明顯的。”新華三的負載均衡體系架構可以對不同智算場景提供適合的負載均衡技術組合,提升智算中心算力規模和效率。

新華三的多元化產品和技術組合打通了異構算力的有效聯接,支援開放的智算解決方案,還可以透過不同的組網形式和組網方案,讓客戶選擇自由解耦的方案,大幅節省智算中心的網路建設成本,為供應鏈的多樣性和持續的可靠性帶來了保障。資料中心方面,新華三推出了基於DDC架構(Disaggregated Distributed Chassis分散式解耦機框)的算力叢集核心交換機H3C S12500 AI系列,旨在為使用者提供更具擴充套件性、更易運維管理、更具成本效益的分散式解耦機框方案。H3C S12500 AI系列具備信元級負載均衡、原生無損、超大規模的特點,可為使用者構建天然零丟包的無損網路,提供自動化部署以及NCF與NCP的自組網能力,新增網元上線即可用,並且在網元失效時實現微秒級的拓撲收斂速度,適合異構GPU互聯的場景。

園區網方面,以太全光+PON融合的技術大幅提升了接入層使用者頻寬,進一步降低園區網的能耗和TCO,讓全網使用壽命得以提高。同時,新華三也在將更多的AI能力引入園區網,透過更精細化的粒度提升運維管理效率和體驗,打造智快至簡的園區網,讓算力隨時隨地可獲取和使用。為此,新華三進級了全光網路+Wi-Fi 7的解決方案,為基於AI的各類場景化應用提供了“最後一跳”的高質量接入體驗,並且對輕量化園區BRAS(Broadband Remote Access Server)、視覺化智慧管理運維等環節進行了創新。此外,新華三也在推進FTTD接入產品、場景化Wi-Fi 7 AP和工業交換機的新品上市速度,針對全光施工部署的實際需求,新華三推出了光纖速熔技術,大幅簡化佈線的工序數量和耗時。

“我們會關注結合AI技術的發展,讓園區智慧運維再升級,比如無線4i技術(iRadio、iStation、iEdge、iHeal),用AI演算法來最佳化軟硬體的結合,讓整體的網路體驗變得更好。”新華三集團副總裁、無線產品線總經理趙玉金說。基於此,新華三推出了融入無線4i技術的Central AC解決方案,加上輕量化園區BRAS,可以大幅簡化有線無線使用者策略的管理複雜度,降低運維工作量,提供隨需而動的園區策略管理和始終如一的園區使用者體驗。

《意見》中提到,以算力高質量發展賦能經濟高質量發展為主線,充分發揮全國一體化算力網路國家樞紐節點引領帶動作用,協同推進“東數西算”工程,形成跨地域、跨部門協同發展合力,統籌通用算力、智慧算力、超級算力協同計算,東中西地區及大中小城市協同佈局,算力、資料、演算法協同應用,算力和綠色電力協同建設,算力發展和安全協同保障,構建聯網排程、普惠易用、綠色安全的全國一體化算力網,助力網路強國、數字中國建設,打造中國式現代化的數字基座。

要想把核心樞紐算力網、跨區算力網、城市算力網統一起來,技術、成本、頻寬都很重要。對於廣域算力網路來說,頻寬、演算法和可靠性更是關鍵。以主力的CR19000、CR16000E-F等核心路由產品為例,新華三做了三點進級:其一,提供更高的400G轉發速率,並利用確定性網路技術大幅降低廣域網的延遲和抖動,藉助DetNet、DetNetOAM等技術,新華三路由器可實現城域1毫秒、區域5毫秒、核心20毫秒的超低傳輸延遲,以及低至15微秒網路抖動幅度,大幅提升算力網路品質;其二,將算力因子融入了網路裝置內嵌的路由演算法,使廣域網天然合用於傳輸算力;其三,讓使用者能夠按需構建專用算力通道,提供服務化的算力專線。透過引數可選、隨用隨建、自動化建網、用完即拆、頻寬動態調整等一系列特性,新華三路由器可進一步提升算力網路的資源利用率和網路SLA。

新華三集團路由器產品線總經理汪小勇稱:“透過產品的創新、全網路節能、大模型最佳化等方式,網路成本會進一步降低,與此同時,網路會更具靈活性和彈性,客戶自行操作也會更便捷。新華三的產品能做到從接入匯聚到核心網的端到端IPv6+的能力,把從城市算力網到核心算力網的技術底座全部打通。”

在AIGC的熱潮下,各行各業的智慧化都在加速,新華三網路的AD-NET也從Application驅動升級到了Application+AI的“雙AI階段”。“新華三在雲、網、安、算、存、端進行了深入佈局,去年推出了百業靈犀大模型,強調做私域部署,做專、做精。”新華三集團智慧管理與運維產品線總經理敖襄橋談到,“從網路端來看,我們有著多年的技術和經驗積累,堅定融入大模型的能力。AD-NET就是要以AIGC為抓手,逐步提升智慧化的水平,進一步強化其作為‘專家顧問’的能力。”如今,使用者可以透過自然語言的方式讓“靈犀助手”推薦方案和配置、自動組網,滿足各類知識問答的需求,同時,還能夠進行特定場景的故障預測,例如光模組診斷、流量預測等,並且Agent的能力還在提升。

可以說,算力和聯接在智算時代已加速融合、互為動力。深耕企業網領域二十餘年,新華三透過資料中心、園區、廣域的三大場景創新釋放了“算力×聯接”的乘數效應,為行業客戶提供了高品質的網路聯接,推動了行業智慧化的程序。“我們用AI技術對網路進行了新的賦能和升級,同時,我們的網路也對AI創新提供了堅實的基礎。我們希望新華三的網路能夠對算力的普惠化貢獻更多,這既是未來的技術趨勢,也是我們的使命。”曾富貴說。

(8713491)

在生成式AI爆發的時代,人們需要的不止是大規模的加速計算,高質量的智算中心建設更為關鍵。這一過程中,算力、網路、儲存、運維等環節缺一不可,要知道,大模型的推理和訓練需要成千上萬顆GPU,這些海量GPU連線後形成的超級計算叢集,離不開高可靠、低時延、有韌性的智算網路。尤其是對於中國算力產業的發展來說,計算叢集的並行化、協同化發展更為重要。例如,擁有1750億引數的ChatGPT-3由1萬個V100 GPU和28.5萬個CPU組成,每個GPU伺服器要有400Gb/s的網路效能才能滿足算力需求,更不要說萬億級引數的GPT-4。

國家發展改革委等部門印發的《關於深入實施“東數西算”工程加快構建全國一體化算力網的實施意見》(下稱“《意見》”)指出,到2025年底,普惠易用、綠色安全的綜合算力基礎設施體系初步成型,東西部算力協同排程機制逐步完善,通用算力、智慧算力、超級算力等多元算力加速集聚,國家樞紐節點地區各類新增算力佔全國新增算力的60%以上,國家樞紐節點算力資源使用率顯著超過全國平均水平。1ms時延城市算力網、5ms時延區域算力網、20ms時延跨國家樞紐節點算力網在示範區域內初步實現。算力電力雙向協同機制初步形成,國家樞紐節點新建資料中心綠電佔比超過80%。使用者使用各類算力的易用性明顯提高、成本明顯降低,國家樞紐節點間網路傳輸費用大幅降低。算力閘道器鍵核心技術基本實現安全可靠,以網路化、普惠化、綠色化為特徵的算力網高質量發展格局逐步形成。?

“如果說過去的網路是分析層級,是單點連線的,那麼在智算時代,網路之間聯接的外延和內生都在拓展,深入到了伺服器內部、伺服器與伺服器之間、資料中心之間,以及廣域網、園區網之間等等。”新華三集團高階副總裁、網路產品線總裁曾富貴談到,“多元化算力的異構性和大幅提升的計算機能需要更強的網路支撐,因此,新華三網路也迎來了全面進級,從‘算力+聯接’,演進到了‘算力×聯接’。”

新華三集團高階副總裁、網路產品線總裁曾富貴

可以說,“算力×聯接”是新華三“AI in All”、“AI for All”戰略落地的技術基礎。在算力需求爆發的背景下,資料中心內部、資料中心之間的聯接和海量的資料傳輸對網路提出了更嚴苛的要求,要實現資料在超長距離下的無損通訊。因此,高品質、確定性的網路聯接就顯得尤為重要,而這需要網路基礎設施、控制和管理層,以及運維服務層協同進級。更重要的是,要有一個“智慧大腦”對網路全域性進行視覺化的實時採集和分析,並使其靈活排程,不亂可靠。

依託於“算力×聯接”理念,新華三釋出了靈犀大模型,並透過全面融合AI能力的AD-NET 7.0承載靈犀大模型落地,支援其部署在雲端或本地,結合網路裝置內嵌的NAI(Native Artificial Intelligence)智原生技術,對資料中心、園區網、廣域網等場景能力均進行了升級。透過靈犀大模型對整個網路賦能,能夠讓資料中心以算力為目標,實現更高效率、更低能耗的算力生產;讓園區網以智快至簡為目標,實現超寬、隨時隨地線上的算力應用接入;讓廣域網以業務智享為目標,實現面向業務、精細化管理的算力傳送,滿足要不同地域上高效的算力排程。基於新華三的智算能力、行業知識和實踐經驗,AD-NET 7.0實現了從“應用驅動網路”向“雙A(Application+AI)驅動”的進化。

與此同時,模型引數的暴增讓加速卡也來到了數十萬張的量級,這種引數對硬體數量的非線性關係使得相應的網路裝置、埠、光模組等數量會升至百萬級的規模,資料中心的密度會越來越高,埠密度隨之提高,高密度使得一個埠要有多個連線芯數。此時,規模化帶來的第一個問題就是網路彈性,涉及技術、架構、能源等多方面的挑戰,例如路由器跨城域無損、資料中心網路無損等。

第二個要解決有限空間內的電力供應和成本,如果要支援1000個機櫃,需要數兆瓦的電力,電力和算網的成本同樣重要。

新華三集團副總裁、網路產品線副總裁、交換機產品線總經理李玉濤介紹稱,新華三在400G、800G交換機的研發過程中重點考慮了能耗的問題,支援LPO線性光模組,傳統400G光模組的能耗是10-12瓦,LPO光模組則是6.5瓦,規模降幅顯著。同時,新華三還推出了矽光交換機(CPO),省去了光模組的能源消耗,讓機房的長期運營大受裨益。

為了確保大模型在訓練過程中的網路可靠性,新華三的算網產品在出廠時就經過了各種嚴格的測試,透過專門的指導規範把光鏈路在上線後的故障率降到非常低的水平,並且在軟體層面利用負載均衡等技術,提供了充分的冗餘機制,在硬體故障時可以快速轉換。例如藉助DPSH協議,讓過去鏈路斷掉後的秒級或毫秒級轉換,變為現在的微秒級轉換,硬體可以自行感知鏈路狀態,甚至無需軟體介入。

可以看到,算力基礎設施、AD-NET 7.0、靈犀大模型,構成了新華三網路AI能力的正向迴圈,即以網強算、以算提智、以智增效。其中,以智增效是指加速AI技術在資料通訊領域的應用落地,AD-NET利用AIGC可實現高效的異常檢測、趨勢預測、故障診斷和智慧調優,靈犀助手就是典型的應用,其支援使用者以自然語言的方式獲取網路知識、配置、產品推薦等資訊,幫助各種複雜網路自動調優,同樣,AI也可以讓系統排障、防護更專業,網路執行更高效。以算提智,會基於新華三在ICT領域的知識語料積累,數萬名網路專家,利用算力訓練和微調獲取靈犀大模型,對統一運維能力進行進級。以網強算,這也是網路和算力融合的體現,由AD-NET提供算力產生和算力聯接的網路基礎設施,為AI模型的訓練帶來了高效算力,支撐了智慧化服務所需的聯接服務。

在提高算力的同時,還要透過網路的無損、大吞吐量等方式讓算力的利用率大幅提升,負載均衡就是很有代表性的技術,包括增強逐流均衡、逐包均衡、信元均衡等。智算資料中心內訓練的模型引數非常大,大模型下面的流量模型差異較大,過去,不同業務之間的流量是10G、20G的差別,現在的均衡差別可能是數百G,這就導致了按流負載會出現大面積不均衡的情況,產生擁塞和丟包,影響整個模型的效率,消耗過多的網路頻寬和訓練時間。如果是按包負載,雖然能做到包數量的均衡,但在網路末端有可能出現數據包的亂序,使得終端網絡卡或網路要對亂序包進行重組,否則應用就會出現問題。這一過程中,並不是所有網絡卡和網路末端都有重組排序的能力。對此,新華三的盒盒組網、框盒組網、DDC組網可以支援各種異構的算力、網路末端的標卡和智慧網絡卡,能夠根據客戶需求實施各類負載均衡的演算法,實現了全域性的負載均衡,無阻塞網路可以讓每條鏈路都得到利用。

“比如說一條400G的鏈路,平時在訓練過程中的流量資料很少,一旦訓練完要做集合計算的時候,資料就會出現鋸齒的形態,抖動非常大,流量頻寬幾乎都被佔滿了。如果多條鏈路同時再發的時候,一定會出現丟包,這就必需要用到負載均衡。我們可以預知不不亂因素,對流量進行排程,把丟包率降到最低。”李玉濤表示,“開放標準的乙太網要透過負載均衡技術把RoCE最大的無損能力發揮出來,無論是DLB仍是全域性路徑的規劃,還有配合Agent軟體,我們在網路鏈路中的效率提升是很明顯的。”新華三的負載均衡體系架構可以對不同智算場景提供適合的負載均衡技術組合,提升智算中心算力規模和效率。

新華三的多元化產品和技術組合打通了異構算力的有效聯接,支援開放的智算解決方案,還可以透過不同的組網形式和組網方案,讓客戶選擇自由解耦的方案,大幅節省智算中心的網路建設成本,為供應鏈的多樣性和持續的可靠性帶來了保障。資料中心方面,新華三推出了基於DDC架構(Disaggregated Distributed Chassis分散式解耦機框)的算力叢集核心交換機H3C S12500 AI系列,旨在為使用者提供更具擴充套件性、更易運維管理、更具成本效益的分散式解耦機框方案。H3C S12500 AI系列具備信元級負載均衡、原生無損、超大規模的特點,可為使用者構建天然零丟包的無損網路,提供自動化部署以及NCF與NCP的自組網能力,新增網元上線即可用,並且在網元失效時實現微秒級的拓撲收斂速度,適合異構GPU互聯的場景。

園區網方面,以太全光+PON融合的技術大幅提升了接入層使用者頻寬,進一步降低園區網的能耗和TCO,讓全網使用壽命得以提高。同時,新華三也在將更多的AI能力引入園區網,透過更精細化的粒度提升運維管理效率和體驗,打造智快至簡的園區網,讓算力隨時隨地可獲取和使用。為此,新華三進級了全光網路+Wi-Fi 7的解決方案,為基於AI的各類場景化應用提供了“最後一跳”的高質量接入體驗,並且對輕量化園區BRAS(Broadband Remote Access Server)、視覺化智慧管理運維等環節進行了創新。此外,新華三也在推進FTTD接入產品、場景化Wi-Fi 7 AP和工業交換機的新品上市速度,針對全光施工部署的實際需求,新華三推出了光纖速熔技術,大幅簡化佈線的工序數量和耗時。

“我們會關注結合AI技術的發展,讓園區智慧運維再升級,比如無線4i技術(iRadio、iStation、iEdge、iHeal),用AI演算法來最佳化軟硬體的結合,讓整體的網路體驗變得更好。”新華三集團副總裁、無線產品線總經理趙玉金說。基於此,新華三推出了融入無線4i技術的Central AC解決方案,加上輕量化園區BRAS,可以大幅簡化有線無線使用者策略的管理複雜度,降低運維工作量,提供隨需而動的園區策略管理和始終如一的園區使用者體驗。

《意見》中提到,以算力高質量發展賦能經濟高質量發展為主線,充分發揮全國一體化算力網路國家樞紐節點引領帶動作用,協同推進“東數西算”工程,形成跨地域、跨部門協同發展合力,統籌通用算力、智慧算力、超級算力協同計算,東中西地區及大中小城市協同佈局,算力、資料、演算法協同應用,算力和綠色電力協同建設,算力發展和安全協同保障,構建聯網排程、普惠易用、綠色安全的全國一體化算力網,助力網路強國、數字中國建設,打造中國式現代化的數字基座。

要想把核心樞紐算力網、跨區算力網、城市算力網統一起來,技術、成本、頻寬都很重要。對於廣域算力網路來說,頻寬、演算法和可靠性更是關鍵。以主力的CR19000、CR16000E-F等核心路由產品為例,新華三做了三點進級:其一,提供更高的400G轉發速率,並利用確定性網路技術大幅降低廣域網的延遲和抖動,藉助DetNet、DetNetOAM等技術,新華三路由器可實現城域1毫秒、區域5毫秒、核心20毫秒的超低傳輸延遲,以及低至15微秒網路抖動幅度,大幅提升算力網路品質;其二,將算力因子融入了網路裝置內嵌的路由演算法,使廣域網天然合用於傳輸算力;其三,讓使用者能夠按需構建專用算力通道,提供服務化的算力專線。透過引數可選、隨用隨建、自動化建網、用完即拆、頻寬動態調整等一系列特性,新華三路由器可進一步提升算力網路的資源利用率和網路SLA。

新華三集團路由器產品線總經理汪小勇稱:“透過產品的創新、全網路節能、大模型最佳化等方式,網路成本會進一步降低,與此同時,網路會更具靈活性和彈性,客戶自行操作也會更便捷。新華三的產品能做到從接入匯聚到核心網的端到端IPv6+的能力,把從城市算力網到核心算力網的技術底座全部打通。”

在AIGC的熱潮下,各行各業的智慧化都在加速,新華三網路的AD-NET也從Application驅動升級到了Application+AI的“雙AI階段”。“新華三在雲、網、安、算、存、端進行了深入佈局,去年推出了百業靈犀大模型,強調做私域部署,做專、做精。”新華三集團智慧管理與運維產品線總經理敖襄橋談到,“從網路端來看,我們有著多年的技術和經驗積累,堅定融入大模型的能力。AD-NET就是要以AIGC為抓手,逐步提升智慧化的水平,進一步強化其作為‘專家顧問’的能力。”如今,使用者可以透過自然語言的方式讓“靈犀助手”推薦方案和配置、自動組網,滿足各類知識問答的需求,同時,還能夠進行特定場景的故障預測,例如光模組診斷、流量預測等,並且Agent的能力還在提升。

可以說,算力和聯接在智算時代已加速融合、互為動力。深耕企業網領域二十餘年,新華三透過資料中心、園區、廣域的三大場景創新釋放了“算力×聯接”的乘數效應,為行業客戶提供了高品質的網路聯接,推動了行業智慧化的程序。“我們用AI技術對網路進行了新的賦能和升級,同時,我們的網路也對AI創新提供了堅實的基礎。我們希望新華三的網路能夠對算力的普惠化貢獻更多,這既是未來的技術趨勢,也是我們的使命。”曾富貴說。

(8713491)

在生成式AI爆發的時代,人們需要的不止是大規模的加速計算,高質量的智算中心建設更為關鍵。這一過程中,算力、網路、儲存、運維等環節缺一不可,要知道,大模型的推理和訓練需要成千上萬顆GPU,這些海量GPU連線後形成的超級計算叢集,離不開高可靠、低時延、有韌性的智算網路。尤其是對於中國算力產業的發展來說,計算叢集的並行化、協同化發展更為重要。例如,擁有1750億引數的ChatGPT-3由1萬個V100 GPU和28.5萬個CPU組成,每個GPU伺服器要有400Gb/s的網路效能才能滿足算力需求,更不要說萬億級引數的GPT-4。

國家發展改革委等部門印發的《關於深入實施“東數西算”工程加快構建全國一體化算力網的實施意見》(下稱“《意見》”)指出,到2025年底,普惠易用、綠色安全的綜合算力基礎設施體系初步成型,東西部算力協同排程機制逐步完善,通用算力、智慧算力、超級算力等多元算力加速集聚,國家樞紐節點地區各類新增算力佔全國新增算力的60%以上,國家樞紐節點算力資源使用率顯著超過全國平均水平。1ms時延城市算力網、5ms時延區域算力網、20ms時延跨國家樞紐節點算力網在示範區域內初步實現。算力電力雙向協同機制初步形成,國家樞紐節點新建資料中心綠電佔比超過80%。使用者使用各類算力的易用性明顯提高、成本明顯降低,國家樞紐節點間網路傳輸費用大幅降低。算力閘道器鍵核心技術基本實現安全可靠,以網路化、普惠化、綠色化為特徵的算力網高質量發展格局逐步形成。?

“如果說過去的網路是分析層級,是單點連線的,那麼在智算時代,網路之間聯接的外延和內生都在拓展,深入到了伺服器內部、伺服器與伺服器之間、資料中心之間,以及廣域網、園區網之間等等。”新華三集團高階副總裁、網路產品線總裁曾富貴談到,“多元化算力的異構性和大幅提升的計算機能需要更強的網路支撐,因此,新華三網路也迎來了全面進級,從‘算力+聯接’,演進到了‘算力×聯接’。”

新華三集團高階副總裁、網路產品線總裁曾富貴

可以說,“算力×聯接”是新華三“AI in All”、“AI for All”戰略落地的技術基礎。在算力需求爆發的背景下,資料中心內部、資料中心之間的聯接和海量的資料傳輸對網路提出了更嚴苛的要求,要實現資料在超長距離下的無損通訊。因此,高品質、確定性的網路聯接就顯得尤為重要,而這需要網路基礎設施、控制和管理層,以及運維服務層協同進級。更重要的是,要有一個“智慧大腦”對網路全域性進行視覺化的實時採集和分析,並使其靈活排程,不亂可靠。

依託於“算力×聯接”理念,新華三釋出了靈犀大模型,並透過全面融合AI能力的AD-NET 7.0承載靈犀大模型落地,支援其部署在雲端或本地,結合網路裝置內嵌的NAI(Native Artificial Intelligence)智原生技術,對資料中心、園區網、廣域網等場景能力均進行了升級。透過靈犀大模型對整個網路賦能,能夠讓資料中心以算力為目標,實現更高效率、更低能耗的算力生產;讓園區網以智快至簡為目標,實現超寬、隨時隨地線上的算力應用接入;讓廣域網以業務智享為目標,實現面向業務、精細化管理的算力傳送,滿足要不同地域上高效的算力排程。基於新華三的智算能力、行業知識和實踐經驗,AD-NET 7.0實現了從“應用驅動網路”向“雙A(Application+AI)驅動”的進化。

與此同時,模型引數的暴增讓加速卡也來到了數十萬張的量級,這種引數對硬體數量的非線性關係使得相應的網路裝置、埠、光模組等數量會升至百萬級的規模,資料中心的密度會越來越高,埠密度隨之提高,高密度使得一個埠要有多個連線芯數。此時,規模化帶來的第一個問題就是網路彈性,涉及技術、架構、能源等多方面的挑戰,例如路由器跨城域無損、資料中心網路無損等。

第二個要解決有限空間內的電力供應和成本,如果要支援1000個機櫃,需要數兆瓦的電力,電力和算網的成本同樣重要。

新華三集團副總裁、網路產品線副總裁、交換機產品線總經理李玉濤介紹稱,新華三在400G、800G交換機的研發過程中重點考慮了能耗的問題,支援LPO線性光模組,傳統400G光模組的能耗是10-12瓦,LPO光模組則是6.5瓦,規模降幅顯著。同時,新華三還推出了矽光交換機(CPO),省去了光模組的能源消耗,讓機房的長期運營大受裨益。

為了確保大模型在訓練過程中的網路可靠性,新華三的算網產品在出廠時就經過了各種嚴格的測試,透過專門的指導規範把光鏈路在上線後的故障率降到非常低的水平,並且在軟體層面利用負載均衡等技術,提供了充分的冗餘機制,在硬體故障時可以快速轉換。例如藉助DPSH協議,讓過去鏈路斷掉後的秒級或毫秒級轉換,變為現在的微秒級轉換,硬體可以自行感知鏈路狀態,甚至無需軟體介入。

可以看到,算力基礎設施、AD-NET 7.0、靈犀大模型,構成了新華三網路AI能力的正向迴圈,即以網強算、以算提智、以智增效。其中,以智增效是指加速AI技術在資料通訊領域的應用落地,AD-NET利用AIGC可實現高效的異常檢測、趨勢預測、故障診斷和智慧調優,靈犀助手就是典型的應用,其支援使用者以自然語言的方式獲取網路知識、配置、產品推薦等資訊,幫助各種複雜網路自動調優,同樣,AI也可以讓系統排障、防護更專業,網路執行更高效。以算提智,會基於新華三在ICT領域的知識語料積累,數萬名網路專家,利用算力訓練和微調獲取靈犀大模型,對統一運維能力進行進級。以網強算,這也是網路和算力融合的體現,由AD-NET提供算力產生和算力聯接的網路基礎設施,為AI模型的訓練帶來了高效算力,支撐了智慧化服務所需的聯接服務。

在提高算力的同時,還要透過網路的無損、大吞吐量等方式讓算力的利用率大幅提升,負載均衡就是很有代表性的技術,包括增強逐流均衡、逐包均衡、信元均衡等。智算資料中心內訓練的模型引數非常大,大模型下面的流量模型差異較大,過去,不同業務之間的流量是10G、20G的差別,現在的均衡差別可能是數百G,這就導致了按流負載會出現大面積不均衡的情況,產生擁塞和丟包,影響整個模型的效率,消耗過多的網路頻寬和訓練時間。如果是按包負載,雖然能做到包數量的均衡,但在網路末端有可能出現數據包的亂序,使得終端網絡卡或網路要對亂序包進行重組,否則應用就會出現問題。這一過程中,並不是所有網絡卡和網路末端都有重組排序的能力。對此,新華三的盒盒組網、框盒組網、DDC組網可以支援各種異構的算力、網路末端的標卡和智慧網絡卡,能夠根據客戶需求實施各類負載均衡的演算法,實現了全域性的負載均衡,無阻塞網路可以讓每條鏈路都得到利用。

“比如說一條400G的鏈路,平時在訓練過程中的流量資料很少,一旦訓練完要做集合計算的時候,資料就會出現鋸齒的形態,抖動非常大,流量頻寬幾乎都被佔滿了。如果多條鏈路同時再發的時候,一定會出現丟包,這就必需要用到負載均衡。我們可以預知不不亂因素,對流量進行排程,把丟包率降到最低。”李玉濤表示,“開放標準的乙太網要透過負載均衡技術把RoCE最大的無損能力發揮出來,無論是DLB仍是全域性路徑的規劃,還有配合Agent軟體,我們在網路鏈路中的效率提升是很明顯的。”新華三的負載均衡體系架構可以對不同智算場景提供適合的負載均衡技術組合,提升智算中心算力規模和效率。

新華三的多元化產品和技術組合打通了異構算力的有效聯接,支援開放的智算解決方案,還可以透過不同的組網形式和組網方案,讓客戶選擇自由解耦的方案,大幅節省智算中心的網路建設成本,為供應鏈的多樣性和持續的可靠性帶來了保障。資料中心方面,新華三推出了基於DDC架構(Disaggregated Distributed Chassis分散式解耦機框)的算力叢集核心交換機H3C S12500 AI系列,旨在為使用者提供更具擴充套件性、更易運維管理、更具成本效益的分散式解耦機框方案。H3C S12500 AI系列具備信元級負載均衡、原生無損、超大規模的特點,可為使用者構建天然零丟包的無損網路,提供自動化部署以及NCF與NCP的自組網能力,新增網元上線即可用,並且在網元失效時實現微秒級的拓撲收斂速度,適合異構GPU互聯的場景。

園區網方面,以太全光+PON融合的技術大幅提升了接入層使用者頻寬,進一步降低園區網的能耗和TCO,讓全網使用壽命得以提高。同時,新華三也在將更多的AI能力引入園區網,透過更精細化的粒度提升運維管理效率和體驗,打造智快至簡的園區網,讓算力隨時隨地可獲取和使用。為此,新華三進級了全光網路+Wi-Fi 7的解決方案,為基於AI的各類場景化應用提供了“最後一跳”的高質量接入體驗,並且對輕量化園區BRAS(Broadband Remote Access Server)、視覺化智慧管理運維等環節進行了創新。此外,新華三也在推進FTTD接入產品、場景化Wi-Fi 7 AP和工業交換機的新品上市速度,針對全光施工部署的實際需求,新華三推出了光纖速熔技術,大幅簡化佈線的工序數量和耗時。

“我們會關注結合AI技術的發展,讓園區智慧運維再升級,比如無線4i技術(iRadio、iStation、iEdge、iHeal),用AI演算法來最佳化軟硬體的結合,讓整體的網路體驗變得更好。”新華三集團副總裁、無線產品線總經理趙玉金說。基於此,新華三推出了融入無線4i技術的Central AC解決方案,加上輕量化園區BRAS,可以大幅簡化有線無線使用者策略的管理複雜度,降低運維工作量,提供隨需而動的園區策略管理和始終如一的園區使用者體驗。

《意見》中提到,以算力高質量發展賦能經濟高質量發展為主線,充分發揮全國一體化算力網路國家樞紐節點引領帶動作用,協同推進“東數西算”工程,形成跨地域、跨部門協同發展合力,統籌通用算力、智慧算力、超級算力協同計算,東中西地區及大中小城市協同佈局,算力、資料、演算法協同應用,算力和綠色電力協同建設,算力發展和安全協同保障,構建聯網排程、普惠易用、綠色安全的全國一體化算力網,助力網路強國、數字中國建設,打造中國式現代化的數字基座。

要想把核心樞紐算力網、跨區算力網、城市算力網統一起來,技術、成本、頻寬都很重要。對於廣域算力網路來說,頻寬、演算法和可靠性更是關鍵。以主力的CR19000、CR16000E-F等核心路由產品為例,新華三做了三點進級:其一,提供更高的400G轉發速率,並利用確定性網路技術大幅降低廣域網的延遲和抖動,藉助DetNet、DetNetOAM等技術,新華三路由器可實現城域1毫秒、區域5毫秒、核心20毫秒的超低傳輸延遲,以及低至15微秒網路抖動幅度,大幅提升算力網路品質;其二,將算力因子融入了網路裝置內嵌的路由演算法,使廣域網天然合用於傳輸算力;其三,讓使用者能夠按需構建專用算力通道,提供服務化的算力專線。透過引數可選、隨用隨建、自動化建網、用完即拆、頻寬動態調整等一系列特性,新華三路由器可進一步提升算力網路的資源利用率和網路SLA。

新華三集團路由器產品線總經理汪小勇稱:“透過產品的創新、全網路節能、大模型最佳化等方式,網路成本會進一步降低,與此同時,網路會更具靈活性和彈性,客戶自行操作也會更便捷。新華三的產品能做到從接入匯聚到核心網的端到端IPv6+的能力,把從城市算力網到核心算力網的技術底座全部打通。”

在AIGC的熱潮下,各行各業的智慧化都在加速,新華三網路的AD-NET也從Application驅動升級到了Application+AI的“雙AI階段”。“新華三在雲、網、安、算、存、端進行了深入佈局,去年推出了百業靈犀大模型,強調做私域部署,做專、做精。”新華三集團智慧管理與運維產品線總經理敖襄橋談到,“從網路端來看,我們有著多年的技術和經驗積累,堅定融入大模型的能力。AD-NET就是要以AIGC為抓手,逐步提升智慧化的水平,進一步強化其作為‘專家顧問’的能力。”如今,使用者可以透過自然語言的方式讓“靈犀助手”推薦方案和配置、自動組網,滿足各類知識問答的需求,同時,還能夠進行特定場景的故障預測,例如光模組診斷、流量預測等,並且Agent的能力還在提升。

可以說,算力和聯接在智算時代已加速融合、互為動力。深耕企業網領域二十餘年,新華三透過資料中心、園區、廣域的三大場景創新釋放了“算力×聯接”的乘數效應,為行業客戶提供了高品質的網路聯接,推動了行業智慧化的程序。“我們用AI技術對網路進行了新的賦能和升級,同時,我們的網路也對AI創新提供了堅實的基礎。我們希望新華三的網路能夠對算力的普惠化貢獻更多,這既是未來的技術趨勢,也是我們的使命。”曾富貴說。

(8713491)

在生成式AI爆發的時代,人們需要的不止是大規模的加速計算,高質量的智算中心建設更為關鍵。這一過程中,算力、網路、儲存、運維等環節缺一不可,要知道,大模型的推理和訓練需要成千上萬顆GPU,這些海量GPU連線後形成的超級計算叢集,離不開高可靠、低時延、有韌性的智算網路。尤其是對於中國算力產業的發展來說,計算叢集的並行化、協同化發展更為重要。例如,擁有1750億引數的ChatGPT-3由1萬個V100 GPU和28.5萬個CPU組成,每個GPU伺服器要有400Gb/s的網路效能才能滿足算力需求,更不要說萬億級引數的GPT-4。

國家發展改革委等部門印發的《關於深入實施“東數西算”工程加快構建全國一體化算力網的實施意見》(下稱“《意見》”)指出,到2025年底,普惠易用、綠色安全的綜合算力基礎設施體系初步成型,東西部算力協同排程機制逐步完善,通用算力、智慧算力、超級算力等多元算力加速集聚,國家樞紐節點地區各類新增算力佔全國新增算力的60%以上,國家樞紐節點算力資源使用率顯著超過全國平均水平。1ms時延城市算力網、5ms時延區域算力網、20ms時延跨國家樞紐節點算力網在示範區域內初步實現。算力電力雙向協同機制初步形成,國家樞紐節點新建資料中心綠電佔比超過80%。使用者使用各類算力的易用性明顯提高、成本明顯降低,國家樞紐節點間網路傳輸費用大幅降低。算力閘道器鍵核心技術基本實現安全可靠,以網路化、普惠化、綠色化為特徵的算力網高質量發展格局逐步形成。?

“如果說過去的網路是分析層級,是單點連線的,那麼在智算時代,網路之間聯接的外延和內生都在拓展,深入到了伺服器內部、伺服器與伺服器之間、資料中心之間,以及廣域網、園區網之間等等。”新華三集團高階副總裁、網路產品線總裁曾富貴談到,“多元化算力的異構性和大幅提升的計算機能需要更強的網路支撐,因此,新華三網路也迎來了全面進級,從‘算力+聯接’,演進到了‘算力×聯接’。”

新華三集團高階副總裁、網路產品線總裁曾富貴

可以說,“算力×聯接”是新華三“AI in All”、“AI for All”戰略落地的技術基礎。在算力需求爆發的背景下,資料中心內部、資料中心之間的聯接和海量的資料傳輸對網路提出了更嚴苛的要求,要實現資料在超長距離下的無損通訊。因此,高品質、確定性的網路聯接就顯得尤為重要,而這需要網路基礎設施、控制和管理層,以及運維服務層協同進級。更重要的是,要有一個“智慧大腦”對網路全域性進行視覺化的實時採集和分析,並使其靈活排程,不亂可靠。

依託於“算力×聯接”理念,新華三釋出了靈犀大模型,並透過全面融合AI能力的AD-NET 7.0承載靈犀大模型落地,支援其部署在雲端或本地,結合網路裝置內嵌的NAI(Native Artificial Intelligence)智原生技術,對資料中心、園區網、廣域網等場景能力均進行了升級。透過靈犀大模型對整個網路賦能,能夠讓資料中心以算力為目標,實現更高效率、更低能耗的算力生產;讓園區網以智快至簡為目標,實現超寬、隨時隨地線上的算力應用接入;讓廣域網以業務智享為目標,實現面向業務、精細化管理的算力傳送,滿足要不同地域上高效的算力排程。基於新華三的智算能力、行業知識和實踐經驗,AD-NET 7.0實現了從“應用驅動網路”向“雙A(Application+AI)驅動”的進化。

與此同時,模型引數的暴增讓加速卡也來到了數十萬張的量級,這種引數對硬體數量的非線性關係使得相應的網路裝置、埠、光模組等數量會升至百萬級的規模,資料中心的密度會越來越高,埠密度隨之提高,高密度使得一個埠要有多個連線芯數。此時,規模化帶來的第一個問題就是網路彈性,涉及技術、架構、能源等多方面的挑戰,例如路由器跨城域無損、資料中心網路無損等。

第二個要解決有限空間內的電力供應和成本,如果要支援1000個機櫃,需要數兆瓦的電力,電力和算網的成本同樣重要。

新華三集團副總裁、網路產品線副總裁、交換機產品線總經理李玉濤介紹稱,新華三在400G、800G交換機的研發過程中重點考慮了能耗的問題,支援LPO線性光模組,傳統400G光模組的能耗是10-12瓦,LPO光模組則是6.5瓦,規模降幅顯著。同時,新華三還推出了矽光交換機(CPO),省去了光模組的能源消耗,讓機房的長期運營大受裨益。

為了確保大模型在訓練過程中的網路可靠性,新華三的算網產品在出廠時就經過了各種嚴格的測試,透過專門的指導規範把光鏈路在上線後的故障率降到非常低的水平,並且在軟體層面利用負載均衡等技術,提供了充分的冗餘機制,在硬體故障時可以快速轉換。例如藉助DPSH協議,讓過去鏈路斷掉後的秒級或毫秒級轉換,變為現在的微秒級轉換,硬體可以自行感知鏈路狀態,甚至無需軟體介入。

可以看到,算力基礎設施、AD-NET 7.0、靈犀大模型,構成了新華三網路AI能力的正向迴圈,即以網強算、以算提智、以智增效。其中,以智增效是指加速AI技術在資料通訊領域的應用落地,AD-NET利用AIGC可實現高效的異常檢測、趨勢預測、故障診斷和智慧調優,靈犀助手就是典型的應用,其支援使用者以自然語言的方式獲取網路知識、配置、產品推薦等資訊,幫助各種複雜網路自動調優,同樣,AI也可以讓系統排障、防護更專業,網路執行更高效。以算提智,會基於新華三在ICT領域的知識語料積累,數萬名網路專家,利用算力訓練和微調獲取靈犀大模型,對統一運維能力進行進級。以網強算,這也是網路和算力融合的體現,由AD-NET提供算力產生和算力聯接的網路基礎設施,為AI模型的訓練帶來了高效算力,支撐了智慧化服務所需的聯接服務。

在提高算力的同時,還要透過網路的無損、大吞吐量等方式讓算力的利用率大幅提升,負載均衡就是很有代表性的技術,包括增強逐流均衡、逐包均衡、信元均衡等。智算資料中心內訓練的模型引數非常大,大模型下面的流量模型差異較大,過去,不同業務之間的流量是10G、20G的差別,現在的均衡差別可能是數百G,這就導致了按流負載會出現大面積不均衡的情況,產生擁塞和丟包,影響整個模型的效率,消耗過多的網路頻寬和訓練時間。如果是按包負載,雖然能做到包數量的均衡,但在網路末端有可能出現數據包的亂序,使得終端網絡卡或網路要對亂序包進行重組,否則應用就會出現問題。這一過程中,並不是所有網絡卡和網路末端都有重組排序的能力。對此,新華三的盒盒組網、框盒組網、DDC組網可以支援各種異構的算力、網路末端的標卡和智慧網絡卡,能夠根據客戶需求實施各類負載均衡的演算法,實現了全域性的負載均衡,無阻塞網路可以讓每條鏈路都得到利用。

“比如說一條400G的鏈路,平時在訓練過程中的流量資料很少,一旦訓練完要做集合計算的時候,資料就會出現鋸齒的形態,抖動非常大,流量頻寬幾乎都被佔滿了。如果多條鏈路同時再發的時候,一定會出現丟包,這就必需要用到負載均衡。我們可以預知不不亂因素,對流量進行排程,把丟包率降到最低。”李玉濤表示,“開放標準的乙太網要透過負載均衡技術把RoCE最大的無損能力發揮出來,無論是DLB仍是全域性路徑的規劃,還有配合Agent軟體,我們在網路鏈路中的效率提升是很明顯的。”新華三的負載均衡體系架構可以對不同智算場景提供適合的負載均衡技術組合,提升智算中心算力規模和效率。

新華三的多元化產品和技術組合打通了異構算力的有效聯接,支援開放的智算解決方案,還可以透過不同的組網形式和組網方案,讓客戶選擇自由解耦的方案,大幅節省智算中心的網路建設成本,為供應鏈的多樣性和持續的可靠性帶來了保障。資料中心方面,新華三推出了基於DDC架構(Disaggregated Distributed Chassis分散式解耦機框)的算力叢集核心交換機H3C S12500 AI系列,旨在為使用者提供更具擴充套件性、更易運維管理、更具成本效益的分散式解耦機框方案。H3C S12500 AI系列具備信元級負載均衡、原生無損、超大規模的特點,可為使用者構建天然零丟包的無損網路,提供自動化部署以及NCF與NCP的自組網能力,新增網元上線即可用,並且在網元失效時實現微秒級的拓撲收斂速度,適合異構GPU互聯的場景。

園區網方面,以太全光+PON融合的技術大幅提升了接入層使用者頻寬,進一步降低園區網的能耗和TCO,讓全網使用壽命得以提高。同時,新華三也在將更多的AI能力引入園區網,透過更精細化的粒度提升運維管理效率和體驗,打造智快至簡的園區網,讓算力隨時隨地可獲取和使用。為此,新華三進級了全光網路+Wi-Fi 7的解決方案,為基於AI的各類場景化應用提供了“最後一跳”的高質量接入體驗,並且對輕量化園區BRAS(Broadband Remote Access Server)、視覺化智慧管理運維等環節進行了創新。此外,新華三也在推進FTTD接入產品、場景化Wi-Fi 7 AP和工業交換機的新品上市速度,針對全光施工部署的實際需求,新華三推出了光纖速熔技術,大幅簡化佈線的工序數量和耗時。

“我們會關注結合AI技術的發展,讓園區智慧運維再升級,比如無線4i技術(iRadio、iStation、iEdge、iHeal),用AI演算法來最佳化軟硬體的結合,讓整體的網路體驗變得更好。”新華三集團副總裁、無線產品線總經理趙玉金說。基於此,新華三推出了融入無線4i技術的Central AC解決方案,加上輕量化園區BRAS,可以大幅簡化有線無線使用者策略的管理複雜度,降低運維工作量,提供隨需而動的園區策略管理和始終如一的園區使用者體驗。

《意見》中提到,以算力高質量發展賦能經濟高質量發展為主線,充分發揮全國一體化算力網路國家樞紐節點引領帶動作用,協同推進“東數西算”工程,形成跨地域、跨部門協同發展合力,統籌通用算力、智慧算力、超級算力協同計算,東中西地區及大中小城市協同佈局,算力、資料、演算法協同應用,算力和綠色電力協同建設,算力發展和安全協同保障,構建聯網排程、普惠易用、綠色安全的全國一體化算力網,助力網路強國、數字中國建設,打造中國式現代化的數字基座。

要想把核心樞紐算力網、跨區算力網、城市算力網統一起來,技術、成本、頻寬都很重要。對於廣域算力網路來說,頻寬、演算法和可靠性更是關鍵。以主力的CR19000、CR16000E-F等核心路由產品為例,新華三做了三點進級:其一,提供更高的400G轉發速率,並利用確定性網路技術大幅降低廣域網的延遲和抖動,藉助DetNet、DetNetOAM等技術,新華三路由器可實現城域1毫秒、區域5毫秒、核心20毫秒的超低傳輸延遲,以及低至15微秒網路抖動幅度,大幅提升算力網路品質;其二,將算力因子融入了網路裝置內嵌的路由演算法,使廣域網天然合用於傳輸算力;其三,讓使用者能夠按需構建專用算力通道,提供服務化的算力專線。透過引數可選、隨用隨建、自動化建網、用完即拆、頻寬動態調整等一系列特性,新華三路由器可進一步提升算力網路的資源利用率和網路SLA。

新華三集團路由器產品線總經理汪小勇稱:“透過產品的創新、全網路節能、大模型最佳化等方式,網路成本會進一步降低,與此同時,網路會更具靈活性和彈性,客戶自行操作也會更便捷。新華三的產品能做到從接入匯聚到核心網的端到端IPv6+的能力,把從城市算力網到核心算力網的技術底座全部打通。”

在AIGC的熱潮下,各行各業的智慧化都在加速,新華三網路的AD-NET也從Application驅動升級到了Application+AI的“雙AI階段”。“新華三在雲、網、安、算、存、端進行了深入佈局,去年推出了百業靈犀大模型,強調做私域部署,做專、做精。”新華三集團智慧管理與運維產品線總經理敖襄橋談到,“從網路端來看,我們有著多年的技術和經驗積累,堅定融入大模型的能力。AD-NET就是要以AIGC為抓手,逐步提升智慧化的水平,進一步強化其作為‘專家顧問’的能力。”如今,使用者可以透過自然語言的方式讓“靈犀助手”推薦方案和配置、自動組網,滿足各類知識問答的需求,同時,還能夠進行特定場景的故障預測,例如光模組診斷、流量預測等,並且Agent的能力還在提升。

可以說,算力和聯接在智算時代已加速融合、互為動力。深耕企業網領域二十餘年,新華三透過資料中心、園區、廣域的三大場景創新釋放了“算力×聯接”的乘數效應,為行業客戶提供了高品質的網路聯接,推動了行業智慧化的程序。“我們用AI技術對網路進行了新的賦能和升級,同時,我們的網路也對AI創新提供了堅實的基礎。我們希望新華三的網路能夠對算力的普惠化貢獻更多,這既是未來的技術趨勢,也是我們的使命。”曾富貴說。

(8713491)

在生成式AI爆發的時代,人們需要的不止是大規模的加速計算,高質量的智算中心建設更為關鍵。這一過程中,算力、網路、儲存、運維等環節缺一不可,要知道,大模型的推理和訓練需要成千上萬顆GPU,這些海量GPU連線後形成的超級計算叢集,離不開高可靠、低時延、有韌性的智算網路。尤其是對於中國算力產業的發展來說,計算叢集的並行化、協同化發展更為重要。例如,擁有1750億引數的ChatGPT-3由1萬個V100 GPU和28.5萬個CPU組成,每個GPU伺服器要有400Gb/s的網路效能才能滿足算力需求,更不要說萬億級引數的GPT-4。

國家發展改革委等部門印發的《關於深入實施“東數西算”工程加快構建全國一體化算力網的實施意見》(下稱“《意見》”)指出,到2025年底,普惠易用、綠色安全的綜合算力基礎設施體系初步成型,東西部算力協同排程機制逐步完善,通用算力、智慧算力、超級算力等多元算力加速集聚,國家樞紐節點地區各類新增算力佔全國新增算力的60%以上,國家樞紐節點算力資源使用率顯著超過全國平均水平。1ms時延城市算力網、5ms時延區域算力網、20ms時延跨國家樞紐節點算力網在示範區域內初步實現。算力電力雙向協同機制初步形成,國家樞紐節點新建資料中心綠電佔比超過80%。使用者使用各類算力的易用性明顯提高、成本明顯降低,國家樞紐節點間網路傳輸費用大幅降低。算力閘道器鍵核心技術基本實現安全可靠,以網路化、普惠化、綠色化為特徵的算力網高質量發展格局逐步形成。?

“如果說過去的網路是分析層級,是單點連線的,那麼在智算時代,網路之間聯接的外延和內生都在拓展,深入到了伺服器內部、伺服器與伺服器之間、資料中心之間,以及廣域網、園區網之間等等。”新華三集團高階副總裁、網路產品線總裁曾富貴談到,“多元化算力的異構性和大幅提升的計算機能需要更強的網路支撐,因此,新華三網路也迎來了全面進級,從‘算力+聯接’,演進到了‘算力×聯接’。”

新華三集團高階副總裁、網路產品線總裁曾富貴

可以說,“算力×聯接”是新華三“AI in All”、“AI for All”戰略落地的技術基礎。在算力需求爆發的背景下,資料中心內部、資料中心之間的聯接和海量的資料傳輸對網路提出了更嚴苛的要求,要實現資料在超長距離下的無損通訊。因此,高品質、確定性的網路聯接就顯得尤為重要,而這需要網路基礎設施、控制和管理層,以及運維服務層協同進級。更重要的是,要有一個“智慧大腦”對網路全域性進行視覺化的實時採集和分析,並使其靈活排程,不亂可靠。

依託於“算力×聯接”理念,新華三釋出了靈犀大模型,並透過全面融合AI能力的AD-NET 7.0承載靈犀大模型落地,支援其部署在雲端或本地,結合網路裝置內嵌的NAI(Native Artificial Intelligence)智原生技術,對資料中心、園區網、廣域網等場景能力均進行了升級。透過靈犀大模型對整個網路賦能,能夠讓資料中心以算力為目標,實現更高效率、更低能耗的算力生產;讓園區網以智快至簡為目標,實現超寬、隨時隨地線上的算力應用接入;讓廣域網以業務智享為目標,實現面向業務、精細化管理的算力傳送,滿足要不同地域上高效的算力排程。基於新華三的智算能力、行業知識和實踐經驗,AD-NET 7.0實現了從“應用驅動網路”向“雙A(Application+AI)驅動”的進化。

與此同時,模型引數的暴增讓加速卡也來到了數十萬張的量級,這種引數對硬體數量的非線性關係使得相應的網路裝置、埠、光模組等數量會升至百萬級的規模,資料中心的密度會越來越高,埠密度隨之提高,高密度使得一個埠要有多個連線芯數。此時,規模化帶來的第一個問題就是網路彈性,涉及技術、架構、能源等多方面的挑戰,例如路由器跨城域無損、資料中心網路無損等。

第二個要解決有限空間內的電力供應和成本,如果要支援1000個機櫃,需要數兆瓦的電力,電力和算網的成本同樣重要。

新華三集團副總裁、網路產品線副總裁、交換機產品線總經理李玉濤介紹稱,新華三在400G、800G交換機的研發過程中重點考慮了能耗的問題,支援LPO線性光模組,傳統400G光模組的能耗是10-12瓦,LPO光模組則是6.5瓦,規模降幅顯著。同時,新華三還推出了矽光交換機(CPO),省去了光模組的能源消耗,讓機房的長期運營大受裨益。

為了確保大模型在訓練過程中的網路可靠性,新華三的算網產品在出廠時就經過了各種嚴格的測試,透過專門的指導規範把光鏈路在上線後的故障率降到非常低的水平,並且在軟體層面利用負載均衡等技術,提供了充分的冗餘機制,在硬體故障時可以快速轉換。例如藉助DPSH協議,讓過去鏈路斷掉後的秒級或毫秒級轉換,變為現在的微秒級轉換,硬體可以自行感知鏈路狀態,甚至無需軟體介入。

可以看到,算力基礎設施、AD-NET 7.0、靈犀大模型,構成了新華三網路AI能力的正向迴圈,即以網強算、以算提智、以智增效。其中,以智增效是指加速AI技術在資料通訊領域的應用落地,AD-NET利用AIGC可實現高效的異常檢測、趨勢預測、故障診斷和智慧調優,靈犀助手就是典型的應用,其支援使用者以自然語言的方式獲取網路知識、配置、產品推薦等資訊,幫助各種複雜網路自動調優,同樣,AI也可以讓系統排障、防護更專業,網路執行更高效。以算提智,會基於新華三在ICT領域的知識語料積累,數萬名網路專家,利用算力訓練和微調獲取靈犀大模型,對統一運維能力進行進級。以網強算,這也是網路和算力融合的體現,由AD-NET提供算力產生和算力聯接的網路基礎設施,為AI模型的訓練帶來了高效算力,支撐了智慧化服務所需的聯接服務。

在提高算力的同時,還要透過網路的無損、大吞吐量等方式讓算力的利用率大幅提升,負載均衡就是很有代表性的技術,包括增強逐流均衡、逐包均衡、信元均衡等。智算資料中心內訓練的模型引數非常大,大模型下面的流量模型差異較大,過去,不同業務之間的流量是10G、20G的差別,現在的均衡差別可能是數百G,這就導致了按流負載會出現大面積不均衡的情況,產生擁塞和丟包,影響整個模型的效率,消耗過多的網路頻寬和訓練時間。如果是按包負載,雖然能做到包數量的均衡,但在網路末端有可能出現數據包的亂序,使得終端網絡卡或網路要對亂序包進行重組,否則應用就會出現問題。這一過程中,並不是所有網絡卡和網路末端都有重組排序的能力。對此,新華三的盒盒組網、框盒組網、DDC組網可以支援各種異構的算力、網路末端的標卡和智慧網絡卡,能夠根據客戶需求實施各類負載均衡的演算法,實現了全域性的負載均衡,無阻塞網路可以讓每條鏈路都得到利用。

“比如說一條400G的鏈路,平時在訓練過程中的流量資料很少,一旦訓練完要做集合計算的時候,資料就會出現鋸齒的形態,抖動非常大,流量頻寬幾乎都被佔滿了。如果多條鏈路同時再發的時候,一定會出現丟包,這就必需要用到負載均衡。我們可以預知不不亂因素,對流量進行排程,把丟包率降到最低。”李玉濤表示,“開放標準的乙太網要透過負載均衡技術把RoCE最大的無損能力發揮出來,無論是DLB仍是全域性路徑的規劃,還有配合Agent軟體,我們在網路鏈路中的效率提升是很明顯的。”新華三的負載均衡體系架構可以對不同智算場景提供適合的負載均衡技術組合,提升智算中心算力規模和效率。

新華三的多元化產品和技術組合打通了異構算力的有效聯接,支援開放的智算解決方案,還可以透過不同的組網形式和組網方案,讓客戶選擇自由解耦的方案,大幅節省智算中心的網路建設成本,為供應鏈的多樣性和持續的可靠性帶來了保障。資料中心方面,新華三推出了基於DDC架構(Disaggregated Distributed Chassis分散式解耦機框)的算力叢集核心交換機H3C S12500 AI系列,旨在為使用者提供更具擴充套件性、更易運維管理、更具成本效益的分散式解耦機框方案。H3C S12500 AI系列具備信元級負載均衡、原生無損、超大規模的特點,可為使用者構建天然零丟包的無損網路,提供自動化部署以及NCF與NCP的自組網能力,新增網元上線即可用,並且在網元失效時實現微秒級的拓撲收斂速度,適合異構GPU互聯的場景。

園區網方面,以太全光+PON融合的技術大幅提升了接入層使用者頻寬,進一步降低園區網的能耗和TCO,讓全網使用壽命得以提高。同時,新華三也在將更多的AI能力引入園區網,透過更精細化的粒度提升運維管理效率和體驗,打造智快至簡的園區網,讓算力隨時隨地可獲取和使用。為此,新華三進級了全光網路+Wi-Fi 7的解決方案,為基於AI的各類場景化應用提供了“最後一跳”的高質量接入體驗,並且對輕量化園區BRAS(Broadband Remote Access Server)、視覺化智慧管理運維等環節進行了創新。此外,新華三也在推進FTTD接入產品、場景化Wi-Fi 7 AP和工業交換機的新品上市速度,針對全光施工部署的實際需求,新華三推出了光纖速熔技術,大幅簡化佈線的工序數量和耗時。

“我們會關注結合AI技術的發展,讓園區智慧運維再升級,比如無線4i技術(iRadio、iStation、iEdge、iHeal),用AI演算法來最佳化軟硬體的結合,讓整體的網路體驗變得更好。”新華三集團副總裁、無線產品線總經理趙玉金說。基於此,新華三推出了融入無線4i技術的Central AC解決方案,加上輕量化園區BRAS,可以大幅簡化有線無線使用者策略的管理複雜度,降低運維工作量,提供隨需而動的園區策略管理和始終如一的園區使用者體驗。

《意見》中提到,以算力高質量發展賦能經濟高質量發展為主線,充分發揮全國一體化算力網路國家樞紐節點引領帶動作用,協同推進“東數西算”工程,形成跨地域、跨部門協同發展合力,統籌通用算力、智慧算力、超級算力協同計算,東中西地區及大中小城市協同佈局,算力、資料、演算法協同應用,算力和綠色電力協同建設,算力發展和安全協同保障,構建聯網排程、普惠易用、綠色安全的全國一體化算力網,助力網路強國、數字中國建設,打造中國式現代化的數字基座。

要想把核心樞紐算力網、跨區算力網、城市算力網統一起來,技術、成本、頻寬都很重要。對於廣域算力網路來說,頻寬、演算法和可靠性更是關鍵。以主力的CR19000、CR16000E-F等核心路由產品為例,新華三做了三點進級:其一,提供更高的400G轉發速率,並利用確定性網路技術大幅降低廣域網的延遲和抖動,藉助DetNet、DetNetOAM等技術,新華三路由器可實現城域1毫秒、區域5毫秒、核心20毫秒的超低傳輸延遲,以及低至15微秒網路抖動幅度,大幅提升算力網路品質;其二,將算力因子融入了網路裝置內嵌的路由演算法,使廣域網天然合用於傳輸算力;其三,讓使用者能夠按需構建專用算力通道,提供服務化的算力專線。透過引數可選、隨用隨建、自動化建網、用完即拆、頻寬動態調整等一系列特性,新華三路由器可進一步提升算力網路的資源利用率和網路SLA。

新華三集團路由器產品線總經理汪小勇稱:“透過產品的創新、全網路節能、大模型最佳化等方式,網路成本會進一步降低,與此同時,網路會更具靈活性和彈性,客戶自行操作也會更便捷。新華三的產品能做到從接入匯聚到核心網的端到端IPv6+的能力,把從城市算力網到核心算力網的技術底座全部打通。”

在AIGC的熱潮下,各行各業的智慧化都在加速,新華三網路的AD-NET也從Application驅動升級到了Application+AI的“雙AI階段”。“新華三在雲、網、安、算、存、端進行了深入佈局,去年推出了百業靈犀大模型,強調做私域部署,做專、做精。”新華三集團智慧管理與運維產品線總經理敖襄橋談到,“從網路端來看,我們有著多年的技術和經驗積累,堅定融入大模型的能力。AD-NET就是要以AIGC為抓手,逐步提升智慧化的水平,進一步強化其作為‘專家顧問’的能力。”如今,使用者可以透過自然語言的方式讓“靈犀助手”推薦方案和配置、自動組網,滿足各類知識問答的需求,同時,還能夠進行特定場景的故障預測,例如光模組診斷、流量預測等,並且Agent的能力還在提升。

可以說,算力和聯接在智算時代已加速融合、互為動力。深耕企業網領域二十餘年,新華三透過資料中心、園區、廣域的三大場景創新釋放了“算力×聯接”的乘數效應,為行業客戶提供了高品質的網路聯接,推動了行業智慧化的程序。“我們用AI技術對網路進行了新的賦能和升級,同時,我們的網路也對AI創新提供了堅實的基礎。我們希望新華三的網路能夠對算力的普惠化貢獻更多,這既是未來的技術趨勢,也是我們的使命。”曾富貴說。

(8713491)

上一篇:調查發現:男... 下一篇:借錢小額1000...
猜你喜歡
熱門閱讀
同類推薦