Δωρεάν βιβλιοθήκη AI

Ήχος AI οδηγούςΔωρεάν για πάντα.

117 Απλοί Αγγλικοί οδηγοί, δομημένες διαδρομές μάθησης και μια ανοιχτή βιβλιοθήκη — χτισμένη από έναν ανεξάρτητο μη κερδοσκοπικό οργανισμό 501(c)(3), ώστε ο καθένας να μπορεί να κατανοήσει τη σύγχρονη τεχνητή νοημοσύνη.

117Δωρεάν οδηγοί
1Θεματικά κομμάτια
~2 minΑνά οδηγό
~4hΏρα ανάγνωσης

Ξεκινήστε εδώ

Πέντε μαθήματα βασισμένα στο αποτέλεσμα

Κάθε μάθημα περιλαμβάνει σαφή αποτελέσματα, χαρτογραφημένες ικανότητες, δραστηριότητες εξάσκησης και ένα εφαρμοσμένο ορόσημο.

02

Υπεύθυνος χρήστης AI

Χρησιμοποιήστε την τεχνητή νοημοσύνη παραγωγικά προστατεύοντας παράλληλα το απόρρητο, ελέγχοντας τα αποτελέσματα και διατηρώντας την ανθρώπινη ευθύνη.

  1. 1Prompt Engineering
  2. 2Ψευδαισθήσεις AI
  3. 3AI & Απόρρητο
  4. 4AI στην καθημερινή ζωή
~5h για να ολοκληρωθείΔείτε το μάθημα
03

AI στην εργασία

Αξιολογήστε περιπτώσεις χρήσης στο χώρο εργασίας, εκτελέστε ασφαλείς πιλότους, μετρήστε την αξία και κοινοποιήστε τις αλλαγές με υπευθυνότητα.

  1. 1Αυτοματισμός ροής εργασίας AI
  2. 2Σημεία αναφοράς AI
  3. 3AI & θέσεις εργασίας
  4. 4Διακυβέρνηση AI
~6h για να ολοκληρωθείΔείτε το μάθημα
05

Κατασκευή με συστήματα AI

Κατανοήστε τα γλωσσικά μοντέλα, την ανάκτηση, τους πράκτορες, την αξιολόγηση, το κόστος και τις διασφαλίσεις ανάπτυξης μέσω του πρακτικού σχεδιασμού του συστήματος.

  1. 1ChatGPT και LLM
  2. 2Ποιότητα ανάκτησης
  3. 3Πράκτορες AI
  4. 4Σημεία αναφοράς AI
~8h για να ολοκληρωθείΔείτε το μάθημα

Θεματικά κομμάτια

Περιήγηση ανά κομμάτι

Πήδα στην περιοχή που σε ενδιαφέρει. Κάθε κομμάτι έχει πολλούς απλούς αγγλικούς οδηγούς.

Πλήρης βιβλιοθήκη

Όλοι οι οδηγοί

117 του 1019 εμφανίζονται οδηγοί. Φιλτράρισμα ανά κομμάτι ή αναζήτηση παραπάνω.

Ήχος AI

Αναγνώριση τραγουδιού διασκευής

Η αναγνώριση τραγουδιού διασκευής ανιχνεύει πότε δύο ηχογραφήσεις με πολύ διαφορετικό ήχο είναι στην πραγματικότητα το ίδιο υποκείμενο τραγούδι — μια ζωντανή ακουστική έκδοση, ένα remix…

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

DDSP Διαφοροποιήσιμη σύνθεση ήχου

Το DDSP (Differentiable Digital Signal Processing) συνδυάζει κλασικά δομικά στοιχεία συνθεσάιζερ με νευρωνικά δίκτυα, έτσι ώστε η βαθιά εκμάθηση να μπορεί να ελέγχει τους ταλαντωτές…

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

VITS Σύνθεση Λόγου από άκρο σε άκρο

Το VITS είναι ένα μοντέλο μετατροπής κειμένου σε ομιλία που μετατρέπει το κείμενο απευθείας σε ακατέργαστες κυματομορφές ήχου σε ένα μόνο εκπαιδευμένο σύστημα, παρακάμπτοντας τη συνηθισμένη διοχέτευση δύο σταδίων.

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

Γρήγορη ομιλία και μη αυτοπαλινδρομικό TTS

Το FastSpeech δημιουργεί ένα ολόκληρο φασματόγραμμα ομιλίας παράλληλα και όχι ένα καρέ τη φορά, κάνοντας τη σύνθεση δραματικά ταχύτερη και πιο σταθερή.

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

TTS NaturalSpeech και Latent Diffusion

Το NaturalSpeech είναι μια σειρά έρευνας Microsoft TTS που στοχεύει στην ποιότητα ομιλίας σε ανθρώπινο επίπεδο, με νεότερες εκδόσεις να χρησιμοποιούν λανθάνουσα διάχυση για να δημιουργήσουν πλούσιο, φυσικό…

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

Αναγνώριση συναισθημάτων ομιλίας

Το Speech Emotion Recognition (SER) είναι η τεχνητή νοημοσύνη που ανιχνεύει τη συναισθηματική κατάσταση ενός ομιλητή - θυμό, χαρά, λύπη, απογοήτευση - από τον ήχο της φωνής του, όχι μόνο…

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

Ομιλία Moshi Full-Duplex

Το Moshi είναι ένα ανοιχτού κώδικα φωνητικής νοημοσύνης σε πραγματικό χρόνο από το Kyutai που μιλάει και ακούει ταυτόχρονα — full-duplex — αντί να κάνει αυστηρές στροφές.

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

Μετάφραση ομιλίας σε ομιλία

Η μετάφραση ομιλίας σε ομιλία (S2ST) λαμβάνει προφορικές λέξεις σε μια γλώσσα και παράγει προφορικές λέξεις σε μια άλλη — διατηρώντας ιδανικά τη φωνή του ομιλητή, τον τόνο…

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

HiFi-GAN και GAN Vocoders

Το HiFi-GAN είναι ένας γενεσιουργός-αντίπαλος κωδικοποιητής φωνής που μετατρέπει ένα φασματογράφημα mel σε ακατέργαστη κυματομορφή ήχου σχεδόν αμέσως, παράγοντας ομιλία ποιότητας στούντιο πολύ…

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

Μετατροπή γραφήματος σε φώνημα

Η μετατροπή γραφήματος σε φώνημα (G2P) μεταφράζει τα γραπτά γράμματα στους ήχους που πρέπει να προφέρει ένα σύστημα ομιλίας.

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

Κανονοποίηση κειμένου για ομιλία

Η κανονικοποίηση κειμένου είναι το μπροστινό βήμα που επαναγράφει το ακατέργαστο γραπτό κείμενο σε πλήρως εκφωνημένες λέξεις πριν το πει ένα σύστημα ομιλίας.

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

SoundStream Neural Codec

Το SoundStream είναι ο νευρωνικός κωδικοποιητής ήχου από άκρο σε άκρο του Google που συμπιέζει την ομιλία και τη μουσική σε εξαιρετικά χαμηλούς ρυθμούς bit διατηρώντας παράλληλα την ποιότητα.

2 ελάχιστη ανάγνωσηΔιαβάστε

Τελειώσατε το διάβασμα; Αποδείξτε το.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.