中国の研究者は、Huaweiアクセラレータ上でAIモデルの推論から学習へ移行しています
中国のHuaweiチップがDeepSeek‑V4‑Proモデルのポストトレーニングを成功裏に完了
*South China Morning Postによると、中国はHuawei Ascend 910Cチップを用いて大型AIモデルDeepSeek‑V4‑Proを完全に再訓練することに成功した。これは、米国制裁が強化される中で単なる推論から高度な学習へ移行しようとする国内半導体産業の発展における重要な一歩となる。
何が起こったか
| フェーズ | 説明 | 開始プロジェクト |
|---|---|---|
| 研究グループ | Huawei Technologies とパートナー(深圳環状道路研究所、ハーバイン工科大学深圳キャンパス、大規模データ研究所)がDeepSeek‑V4‑Proを訓練するために立ち上げた。 | |
| スケール | モデルは1.6兆パラメータを含み、最低でも1000個のAscend 910Cチップで構成されたクラスターで稼働した。 | |
| ポストトレーニング | 完全に「パラメトリック」な再訓練:モデル全体が妥協なく更新され、単なる一部の層だけではない。 | |
重要性
* 以前は、中国チップは主に推論(モデルがクエリに答えるプロセス)で使用されていた。
* 新しいプロジェクトのおかげで、モデルは作業中に自己反省し調整できるようになり、従来の一方向データフローに「複雑なオーバーラップとループ」を追加した。これにより計算および通信要件が増大するが、システムはより自律的になる。
期待される結果
* 深圳政府は、この研究が中国のAI産業の自立性を高め、外部制限下で国内チップの地位を強化すると述べた。
コメント (0)
感想を共有してください。礼儀正しく、話題に沿ってお願いします。
コメントするにはログイン