Čínští vědci přecházejí z inferenčního tréninku na výcvik AI modelů na akcelerátorech Huawei
Čínské čipy Huawei úspěšně dokončily posttrénink modelu DeepSeek‑V4‑Pro
*Podle zprávy South China Morning Post se v Číně podařilo použít čipy Huawei Ascend 910C k úplnému doladění velkého AI‑modelu DeepSeek‑V4‑Pro. Jedná se o důležitý krok ve vývoji domácí polovodičové průmyslu, který usiluje přejít od pouhého inferenčního zpracování k složitému tréninku v prostředí ztížujících amerických sankcí.*
Co se stalo
Fáze | Popis | Zahájení projektu
---|---|---
Výzkumná skupina Huawei Technologies a partnerů (Shenzhen Institute of Ring Roads, Shenzhen campus Harbin Institute of Technology, Shenzhen Big Data Research Institute) začala s cílem trénovat model DeepSeek‑V4‑Pro. | Velikost | Model obsahuje 1,6 bilionu parametrů a byl spuštěn na clusteru minimálně 1000 čipů Ascend 910C.
Posttrénink | Úplné „parametrické“ přetrenování: celá architektura modelu byla aktualizována bez kompromisů, nikoli jen jednotlivé vrstvy.
Proč je to důležité
* Do nedávna byly čínské čipy úspěšně využívány pro inferenci – proces, kdy model jednoduše odpovídá na dotazy.
* Díky novému projektu může model samoreflektovat a upravovat se během provozu, což přidává „složitější mosty a smyčky“ k dříve jednostrannému datovému toku. To zvyšuje výpočetní i komunikační nároky, ale činí systém autonomnějším.
Očekávané výsledky
* Město Shenzhen oznámilo, že výzkum pomůže zvýšit samostatnost čínského průmyslu umělé inteligence a posílí pozice domácích mikroprocesorů v prostředí externích omezení.
Komentáře (0)
Podělte se o svůj názor — prosím, buďte slušní a držte se tématu.
Přihlaste se pro komentování