Δωρεάν βιβλιοθήκη AI

Ήχος AI οδηγούςΔωρεάν για πάντα.

117 Απλοί Αγγλικοί οδηγοί, δομημένες διαδρομές μάθησης και μια ανοιχτή βιβλιοθήκη — χτισμένη από έναν ανεξάρτητο μη κερδοσκοπικό οργανισμό 501(c)(3), ώστε ο καθένας να μπορεί να κατανοήσει τη σύγχρονη τεχνητή νοημοσύνη.

117Δωρεάν οδηγοί
1Θεματικά κομμάτια
~2 minΑνά οδηγό
~4hΏρα ανάγνωσης

Ξεκινήστε εδώ

Πέντε μαθήματα βασισμένα στο αποτέλεσμα

Κάθε μάθημα περιλαμβάνει σαφή αποτελέσματα, χαρτογραφημένες ικανότητες, δραστηριότητες εξάσκησης και ένα εφαρμοσμένο ορόσημο.

02

Υπεύθυνος χρήστης AI

Χρησιμοποιήστε την τεχνητή νοημοσύνη παραγωγικά προστατεύοντας παράλληλα το απόρρητο, ελέγχοντας τα αποτελέσματα και διατηρώντας την ανθρώπινη ευθύνη.

  1. 1Prompt Engineering
  2. 2Ψευδαισθήσεις AI
  3. 3AI & Απόρρητο
  4. 4AI στην καθημερινή ζωή
~5h για να ολοκληρωθείΔείτε το μάθημα
03

AI στην εργασία

Αξιολογήστε περιπτώσεις χρήσης στο χώρο εργασίας, εκτελέστε ασφαλείς πιλότους, μετρήστε την αξία και κοινοποιήστε τις αλλαγές με υπευθυνότητα.

  1. 1Αυτοματισμός ροής εργασίας AI
  2. 2Σημεία αναφοράς AI
  3. 3AI & θέσεις εργασίας
  4. 4Διακυβέρνηση AI
~6h για να ολοκληρωθείΔείτε το μάθημα
05

Κατασκευή με συστήματα AI

Κατανοήστε τα γλωσσικά μοντέλα, την ανάκτηση, τους πράκτορες, την αξιολόγηση, το κόστος και τις διασφαλίσεις ανάπτυξης μέσω του πρακτικού σχεδιασμού του συστήματος.

  1. 1ChatGPT και LLM
  2. 2Ποιότητα ανάκτησης
  3. 3Πράκτορες AI
  4. 4Σημεία αναφοράς AI
~8h για να ολοκληρωθείΔείτε το μάθημα

Θεματικά κομμάτια

Περιήγηση ανά κομμάτι

Πήδα στην περιοχή που σε ενδιαφέρει. Κάθε κομμάτι έχει πολλούς απλούς αγγλικούς οδηγούς.

Πλήρης βιβλιοθήκη

Όλοι οι οδηγοί

117 του 1019 εμφανίζονται οδηγοί. Φιλτράρισμα ανά κομμάτι ή αναζήτηση παραπάνω.

Ήχος AI

DiffWave Diffusion Vocoder

Το DiffWave είναι ένας φωνοκωδικοποιητής βασισμένος στη διάχυση που συνθέτει ήχο με επαναληπτική αποθορυβοποίηση του τυχαίου θορύβου σε μια κυματομορφή, που εξαρτάται από ένα φασματογράφημα mel.

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

Μοντέλο ήχου Bark Generative

Το Bark είναι ένα μοντέλο ανοιχτού κώδικα κειμένου σε ήχο από τη Suno που παράγει όχι μόνο ομιλία, αλλά γέλιο, αναστεναγμούς, μουσική και ηχητικά εφέ απευθείας από μηνύματα προτροπής κειμένου.

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

Autoregressive Synthesis TTS Tortoise

Το Tortoise TTS είναι ένα ανοιχτού κώδικα σύστημα μετατροπής κειμένου σε ομιλία που βραβεύεται για ασυνήθιστα φυσικές, συναισθηματικά πλούσιες φωνές και ισχυρή κλωνοποίηση φωνής από λίγα μόλις…

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

XTTS Cross-lingual Voice Cloning

Το XTTS είναι το πολύγλωσσο μοντέλο μετατροπής κειμένου σε ομιλία της Coqui που μπορεί να κλωνοποιήσει μια φωνή από ένα σύντομο κλιπ και στη συνέχεια να μιλήσει σε πολλές διαφορετικές γλώσσες διατηρώντας…

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

Παράλληλη παραγωγή ήχου SoundStorm

Το SoundStorm είναι ένα μοντέλο παραγωγής ήχου Google που παράγει ομιλία και ήχο παράλληλα και όχι ένα διακριτικό τη φορά, κάνοντας σύνθεση ήχου υψηλής ποιότητας…

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

AudioGen Σύνθεση κειμένου σε ήχο

Το AudioGen είναι ένα μοντέλο Meta που μετατρέπει τις περιγραφές κειμένου σε ρεαλιστικούς περιβαλλοντικούς ήχους και ηχητικά εφέ, όπως «γαυγίζει σκύλος ενώ κελαηδούν τα πουλιά.

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

Σταθερή λανθάνουσα διάχυση ήχου

Το Stable Audio είναι το σύστημα μετατροπής κειμένου σε ήχο της Stability AI που χρησιμοποιεί λανθάνουσα διάχυση για τη δημιουργία μουσικής και ηχητικών εφέ, με ρητό έλεγχο της διάρκειας του κλιπ.

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

Εργαλειοθήκη αναγνώρισης ομιλίας Kaldi

Το Kaldi είναι μια δωρεάν εργαλειοθήκη ανοιχτού κώδικα που έγινε η κυρίαρχη ερευνητική πλατφόρμα για τη δημιουργία συστημάτων αναγνώρισης ομιλίας.

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

Wav2Letter Συνελικτικό ASR

Το Wav2Letter είναι ένα σύστημα αναγνώρισης ομιλίας από άκρο σε άκρο από το Facebook AI που χρησιμοποιούσε μόνο συνελικτικά νευρωνικά δίκτυα, χωρίς επανάληψη.

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

Jasper και QuartzNet ASR

Το Jasper και το QuartzNet είναι τα μοντέλα συνελικτικής αναγνώρισης ομιλίας από άκρο σε άκρο της NVIDIA, με το QuartzNet να είναι ένας δραματικά μικρότερος, αποτελεσματικός επανασχεδιασμός…

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

Μοντέλα διάχυσης για ήχο

Τα μοντέλα διάχυσης παράγουν ήχο μαθαίνοντας να αντιστρέφουν μια βήμα προς βήμα διαδικασία θορύβου, μετατρέποντας τον τυχαίο θόρυβο σε συνεκτική ομιλία, μουσική ή ηχητικά εφέ.

2 ελάχιστη ανάγνωσηΔιαβάστε
Ήχος AI

Ανίχνευση συμβάντων ήχου

Η ανίχνευση συμβάντων ήχου (SED) προσδιορίζει ποιοι ήχοι εμφανίζονται σε μια ροή ήχου και πότε ακριβώς ξεκινούν και σταματούν.

2 ελάχιστη ανάγνωσηΔιαβάστε

Τελειώσατε το διάβασμα; Αποδείξτε το.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.