Các nhà khoa học Trung Quốc chuyển từ suy luận sang đào tạo mô hình AI trên bộ tăng tốc của Huawei

Các nhà khoa học Trung Quốc chuyển từ suy luận sang đào tạo mô hình AI trên bộ tăng tốc của Huawei

20 hardware

Chip Huawei của Trung Quốc đã thành công trong việc hoàn thiện mô hình DeepSeek‑V4‑Pro

*Theo thông tin South China Morning Post, tại Trung Quốc đã áp dụng chip Huawei Ascend 910C để hoàn chỉnh toàn bộ mô hình AI lớn DeepSeek‑V4‑Pro. Đây là bước quan trọng trong phát triển ngành bán dẫn quốc nội, đang cố gắng chuyển từ chỉ inference sang đào tạo phức tạp trong bối cảnh các biện pháp trừng phạt của Mỹ ngày càng nghiêm ngặt.*

Điều gì đã xảy ra
Giai đoạn | Mô tả | Khởi động dự án
---|---|---
Nhóm nghiên cứu từ Huawei Technologies và các đối tác (Viện Đường vòng Quận Shenzhen, Khu công nghệ Harbin tại Shenzhen, Viện Nghiên cứu Dữ liệu lớn của Shenzhen) đã bắt đầu với mục tiêu đào tạo mô hình DeepSeek‑V4‑Pro. | Quy mô: Mô hình có 1,6 nghìn tỷ tham số và được triển khai trên một cụm gồm tối thiểu 1000 chip Ascend 910C. | Đào tạo lại: Đào tạo “định lượng” hoàn chỉnh; toàn bộ kiến trúc của mô hình đã được cập nhật mà không có bất kỳ sự thỏa hiệp nào, thay vì chỉ các lớp riêng lẻ.

Tại sao điều này quan trọng
* Trước đây, chip Trung Quốc chủ yếu được sử dụng cho inference – quá trình khi mô hình đơn giản trả lời yêu cầu.

* Giờ đây, nhờ dự án mới, mô hình có thể tự phản chiếu và điều chỉnh trong quá trình hoạt động, thêm “các lối đi phức tạp và vòng lặp” vào luồng dữ liệu một chiều trước đó. Điều này tăng nhu cầu tính toán và giao tiếp, nhưng làm cho hệ thống trở nên độc lập hơn.

Kết quả dự kiến
* Chính phủ Quận Shenzhen đã tuyên bố rằng nghiên cứu sẽ giúp nâng cao tính tự chủ của ngành công nghiệp AI Trung Quốc và củng cố vị thế của các chip trong điều kiện hạn chế từ bên ngoài.

Bình luận (0)

Chia sẻ ý kiến của bạn — vui lòng lịch sự và đúng chủ đề.

Chưa có bình luận nào. Hãy để lại bình luận và chia sẻ ý kiến của bạn!

Để bình luận, vui lòng đăng nhập.

Đăng nhập để bình luận