Δωρεάν βιβλιοθήκη AI

Ήχος AI οδηγούςΔωρεάν για πάντα.

117 Απλοί Αγγλικοί οδηγοί, δομημένες διαδρομές μάθησης και μια ανοιχτή βιβλιοθήκη — χτισμένη από έναν ανεξάρτητο μη κερδοσκοπικό οργανισμό 501(c)(3), ώστε ο καθένας να μπορεί να κατανοήσει τη σύγχρονη τεχνητή νοημοσύνη.

117Δωρεάν οδηγοί
1Θεματικά κομμάτια
~2 minΑνά οδηγό
~4hΏρα ανάγνωσης

Ξεκινήστε εδώ

Πέντε μαθήματα βασισμένα στο αποτέλεσμα

Κάθε μάθημα περιλαμβάνει σαφή αποτελέσματα, χαρτογραφημένες ικανότητες, δραστηριότητες εξάσκησης και ένα εφαρμοσμένο ορόσημο.

02

Υπεύθυνος χρήστης AI

Χρησιμοποιήστε την τεχνητή νοημοσύνη παραγωγικά προστατεύοντας παράλληλα το απόρρητο, ελέγχοντας τα αποτελέσματα και διατηρώντας την ανθρώπινη ευθύνη.

  1. 1Prompt Engineering
  2. 2Ψευδαισθήσεις AI
  3. 3AI & Απόρρητο
  4. 4AI στην καθημερινή ζωή
~5h για να ολοκληρωθείΔείτε το μάθημα
03

AI στην εργασία

Αξιολογήστε περιπτώσεις χρήσης στο χώρο εργασίας, εκτελέστε ασφαλείς πιλότους, μετρήστε την αξία και κοινοποιήστε τις αλλαγές με υπευθυνότητα.

  1. 1Αυτοματισμός ροής εργασίας AI
  2. 2Σημεία αναφοράς AI
  3. 3AI & θέσεις εργασίας
  4. 4Διακυβέρνηση AI
~6h για να ολοκληρωθείΔείτε το μάθημα
05

Κατασκευή με συστήματα AI

Κατανοήστε τα γλωσσικά μοντέλα, την ανάκτηση, τους πράκτορες, την αξιολόγηση, το κόστος και τις διασφαλίσεις ανάπτυξης μέσω του πρακτικού σχεδιασμού του συστήματος.

  1. 1ChatGPT και LLM
  2. 2Ποιότητα ανάκτησης
  3. 3Πράκτορες AI
  4. 4Σημεία αναφοράς AI
~8h για να ολοκληρωθείΔείτε το μάθημα

Θεματικά κομμάτια

Περιήγηση ανά κομμάτι

Πήδα στην περιοχή που σε ενδιαφέρει. Κάθε κομμάτι έχει πολλούς απλούς αγγλικούς οδηγούς.

Πλήρης βιβλιοθήκη

Όλοι οι οδηγοί

117 του 1019 εμφανίζονται οδηγοί. Φιλτράρισμα ανά κομμάτι ή αναζήτηση παραπάνω.

Ήχος AI

Κωδικοποιητής ήχου Mimi Streaming

Το Mimi είναι ένας νευρωνικός κωδικοποιητής ήχου που συμπιέζει την ομιλία σε μια μικροσκοπική ροή διακριτών διακριτικών σε πραγματικό χρόνο, έτσι ώστε τα μοντέλα τεχνητής νοημοσύνης να μπορούν να ακούν και να μιλούν με πολύ χαμηλή…

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

Ακούστε Παρακολούθηση και ορθογραφία

Listen, Attend and Spell (LAS) είναι ένα νευρωνικό δίκτυο ορόσημο του 2015 που μεταγράφει την ομιλία απευθείας σε χαρακτήρες, χωρίς χειροποίητη προφορά…

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

SpecAugment για την αναγνώριση ομιλίας

Το SpecAugment είναι μια απλή αλλά ισχυρή μέθοδος αύξησης δεδομένων που καλύπτει και παραμορφώνει το φασματογράφημα της ομιλίας για να κάνει τα μοντέλα αναγνώρισης πιο ισχυρά.

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

Αυτόματη προσθήκη ετικετών μουσικής

Η αυτόματη προσθήκη ετικετών μουσικής χρησιμοποιεί μηχανική εκμάθηση για να ακούσει ένα τραγούδι και να επισυνάψει αυτόματα περιγραφικές ετικέτες όπως είδος, διάθεση, όργανα και τέμπο.

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

Μουσική Μεταφορά Χρόνου

Η μεταφορά χροιάς αναδιαμορφώνει το «τονικό χρώμα» του ήχου, έτσι ώστε ένα όργανο να ακούγεται σαν το άλλο, μετατρέποντας μια μελωδία που βουίζει σε βιολί ή γραμμή τρομπέτας…

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

Ταξινόμηση ακουστικής σκηνής

Η ταξινόμηση ακουστικών σκηνών (ASC) εκπαιδεύει τα μηχανήματα να αναγνωρίζουν το περιβάλλον στο οποίο έγινε η εγγραφή, έναν πολυσύχναστο δρόμο, ένα ήσυχο πάρκο, ένα τρένο, ένα καφέ…

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

NVIDIA Riva και NeMo Speech

Το NVIDIA Riva είναι ένα SDK με επιτάχυνση GPU για παραγωγή ομιλίας AI (ASR, TTS και μετάφραση), ενώ το NeMo είναι το κιτ εργαλείων ανοιχτού κώδικα για εκπαίδευση και τελειοποίηση…

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

Αρχιτεκτονική DeepSpeech

Το DeepSpeech είναι ένα μοντέλο αναγνώρισης ομιλίας από άκρο σε άκρο που εισήχθη από την Baidu το 2014 και αντιστοιχίζει ακατέργαστα χαρακτηριστικά ήχου απευθείας στο κείμενο χρησιμοποιώντας ένα επαναλαμβανόμενο νευρικό…

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

Ενσωματώσεις ηχείων X-Vector

Τα διανύσματα X είναι αριθμητικά αποτυπώματα σταθερού μήκους της φωνής ενός ομιλητή που παράγονται από ένα νευρωνικό δίκτυο, που χρησιμοποιούνται για να λένε ποιος μιλά ανεξάρτητα από το τι λένε.

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

Μονοτονική ευθυγράμμιση Glow-TTS

Το Glow-TTS είναι ένα μοντέλο μετατροπής κειμένου σε ομιλία που μαθαίνει να ευθυγραμμίζει από μόνο του το κείμενο με την ομιλία χρησιμοποιώντας ένα έξυπνο τέχνασμα αναζήτησης, καταργώντας την ανάγκη για ξεχωριστή ευθυγράμμιση.

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

Παράλληλος φωνοκωδικοποιητής WaveGAN

Το Parallel WaveGAN είναι ένας γρήγορος νευρωνικός φωνοκωδικοποιητής που μετατρέπει ένα φασματογράφημα mel σε μια ακατέργαστη ακουστική κυματομορφή χρησιμοποιώντας ένα μικρό GAN, δημιουργώντας όλα τα δείγματα ταυτόχρονα.

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

Κωδικοποιητής φωνής που βασίζεται σε ροή WaveGlow

Το WaveGlow είναι ένας νευρωνικός φωνοκωδικοποιητής που βασίζεται στη ροή της NVIDIA που συνθέτει κυματομορφές ομιλίας από φασματογράμματα mel σε ένα μόνο πέρασμα χωρίς αυτοπαλίνδρομο.

2 ελάχιστη ανάγνωσηΔιαβάστε

Τελειώσατε το διάβασμα; Αποδείξτε το.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.