Οι κινεζικοί επιστήμονες μεταβαίνουν από την inference στην εκπαίδευση μοντέλων AI σε επιταχυντές της Huawei
Η Κινεζική εταιρεία Huawei ολοκλήρωσε επιτυχώς την εκπαίδευση μεταπροσαρμογής του μοντέλου DeepSeek‑V4‑Pro
*Σύμφωνα με το South China Morning Post, στην Κίνα κατάφερε να χρησιμοποιήσει τα επεξεργαστικά στοιχεία Huawei Ascend 910C για πλήρη βελτίωση ενός μεγάλου μοντέλου AI, DeepSeek‑V4‑Pro. Αυτό αποτελεί σημαντικό βήμα στην ανάπτυξη της εγχώριας ημιαγωγικής βιομηχανίας, που επιδιώκει να μεταβεί από απλή inference σε σύνθετη εκπαίδευση υπό αυστηρότερους αμερικανικούς περιορισμούς.*
Τι συνέβη
Η φάση Περιγραφή Έναρξη του έργου Η έρευνα ομάδα της Huawei Technologies και των συνεργατών (Το Ίνστιτοτ Ρόδας Σχεδίου, Το Κампύου Σενζέιν Σχολή Τεχνολογίας Χαρμπίν) ξεκίνησε με σκοπό την εκπαίδευση του μοντέλου DeepSeek‑V4‑Pro. Μέγεθος Το μοντέλο περιλαμβάνει 1,6 τριλιοντάρια παραμέτρων και εκκινήθηκε σε κλάστερ από ελάχιστο 1000 επεξεργαστές Ascend 910C. Εκπαίδευση Μεγάλη «παραμετρική» αναπροσαρμογή: όλη η αρχιτεκτονική του μοντέλου ενημερώθηκε χωρίς συμβιβασμούς, όχι μόνο μεμονωμένα επίπεδα.
Γιατί είναι σημαντικό
* Μέχρι πρόσφατα τα κινεζικά chips χρησιμοποιούνταν επιτυχώς για inference – διαδικασία όπου το μοντέλο απλώς απαντά σε ερωτήματα.
* Τώρα, χάρη στο νέο έργο, το μοντέλο μπορεί να αυτοαναλύεται και να διορθώνεται κατά τη λειτουργία, προσθέτοντας «πρόκληση σύνθετων διαδρόμων» στη μία κατεύθυνση ροής δεδομένων. Αυτό αυξάνει τις υπολογιστικές και επικοινωνιακές απαιτήσεις, αλλά κάνει το σύστημα πιο αυτόνομο.
Προσδοκώμενα αποτελέσματα
* Η κυβέρνηση της Σενζέιν δήλωσε ότι η έρευνα θα βοηθήσει στην αύξηση της αυτοτελειότητας της κινεζικής βιομηχανίας AI και θα ενισχύσει τις θέσεις των εγχώριων μικροεπεξεργαστών υπό εξωτερικούς περιορισμούς.
Σχόλια (0)
Μοιραστείτε τη γνώμη σας — παρακαλώ να είστε ευγενικοί και εντός θέματος.
Συνδεθείτε για να σχολιάσετε