এআই ফাউন্ডেশন
AI কী, সিস্টেমগুলি কীভাবে শেখে, কোথায় ব্যর্থ হয় এবং হাইপ ছাড়াই কীভাবে দাবির বিচার করা যায় তা বুঝুন।
বিনামূল্যে এআই লাইব্রেরি
117 প্লেইন-ইংরেজি গাইড, স্ট্রাকচার্ড শেখার পাথ, এবং একটি উন্মুক্ত লাইব্রেরি — একটি স্বাধীন 501(c)(3) অলাভজনক দ্বারা নির্মিত যাতে যে কেউ আধুনিক AI বুঝতে পারে৷
এখানে শুরু করুন
প্রতিটি কোর্সে সুস্পষ্ট ফলাফল, ম্যাপ করা দক্ষতা, অনুশীলন কার্যক্রম এবং একটি প্রয়োগকৃত ক্যাপস্টোন অন্তর্ভুক্ত থাকে।
AI কী, সিস্টেমগুলি কীভাবে শেখে, কোথায় ব্যর্থ হয় এবং হাইপ ছাড়াই কীভাবে দাবির বিচার করা যায় তা বুঝুন।
গোপনীয়তা রক্ষা, আউটপুট পরীক্ষা এবং মানুষের জবাবদিহিতা রক্ষা করার সময় AI উত্পাদনশীলভাবে ব্যবহার করুন।
কর্মক্ষেত্রে ব্যবহারের ক্ষেত্রে মূল্যায়ন করুন, নিরাপদ পাইলট চালান, মান পরিমাপ করুন এবং দায়িত্বের সাথে পরিবর্তনগুলি যোগাযোগ করুন।
অধিকার, ইক্যুইটি, গভর্নেন্স, সুরক্ষা এবং জনস্বার্থের ফলাফলের মাধ্যমে এআই সিস্টেমগুলি বিশ্লেষণ করুন।
ব্যবহারিক সিস্টেম ডিজাইনের মাধ্যমে ভাষার মডেল, পুনরুদ্ধার, এজেন্ট, মূল্যায়ন, খরচ এবং স্থাপনার সুরক্ষাগুলি বুঝুন।
বিষয় ট্র্যাক
আপনার পছন্দের এলাকায় ঝাঁপ দাও। প্রতিটি ট্র্যাকে একাধিক প্লেইন-ইংরেজি গাইড রয়েছে৷
সম্পূর্ণ লাইব্রেরি
117 এর 1019 গাইড দেখানো হয়েছে। ট্র্যাক দ্বারা ফিল্টার করুন বা উপরে অনুসন্ধান করুন।
ডিফওয়েভ হল একটি ডিফিউশন-ভিত্তিক ভোকোডার যেটি একটি মেল-স্পেকট্রোগ্রামে শর্তযুক্ত একটি তরঙ্গরূপ এলোমেলো শব্দকে পুনরাবৃত্তি করে অডিওকে সংশ্লেষিত করে।
অডিও এআইবার্ক হল সুনোর একটি ওপেন-সোর্স টেক্সট-টু-অডিও মডেল যা সরাসরি টেক্সট প্রম্পট থেকে শুধু বক্তৃতা নয় হাসি, দীর্ঘশ্বাস, সঙ্গীত এবং সাউন্ড ইফেক্ট তৈরি করে।
অডিও এআইTortoise TTS হল একটি ওপেন-সোর্স টেক্সট-টু-স্পিচ সিস্টেম যা অস্বাভাবিকভাবে প্রাকৃতিক, আবেগগতভাবে সমৃদ্ধ ভয়েস এবং অল্প অল্প থেকে শক্তিশালী ভয়েস ক্লোনিংয়ের জন্য মূল্যবান...
অডিও এআইXTTS হল Coqui এর বহুভাষিক টেক্সট-টু-স্পিচ মডেল যা একটি ছোট ক্লিপ থেকে একটি ভয়েস ক্লোন করতে পারে এবং তারপর সংরক্ষণ করার সময় বিভিন্ন ভাষায় কথা বলতে পারে...
অডিও এআইSoundStorm হল একটি Google অডিও জেনারেশন মডেল যা উচ্চ-মানের অডিও সংশ্লেষণ তৈরি করে, একই সময়ে একটি টোকেনের পরিবর্তে সমান্তরালে বক্তৃতা এবং শব্দ তৈরি করে...
অডিও এআইAudioGen হল একটি Meta মডেল যা পাঠ্যের বর্ণনাকে বাস্তবসম্মত পরিবেশগত শব্দ এবং শব্দ প্রভাবে পরিণত করে, যেমন 'পাখির কিচিরমিচির সময় কুকুরের ঘেউ ঘেউ।
অডিও এআইস্থিতিশীল অডিও হল স্থায়িত্ব AI এর টেক্সট-টু-অডিও সিস্টেম যা ক্লিপ দৈর্ঘ্যের উপর সুস্পষ্ট নিয়ন্ত্রণ সহ সঙ্গীত এবং শব্দ প্রভাব তৈরি করতে সুপ্ত প্রসারণ ব্যবহার করে।
অডিও এআইKaldi হল একটি বিনামূল্যের, ওপেন-সোর্স টুলকিট যা বক্তৃতা শনাক্তকরণ সিস্টেম তৈরির জন্য প্রভাবশালী গবেষণা প্ল্যাটফর্ম হয়ে উঠেছে।
অডিও এআইWav2Letter হল Facebook AI-এর একটি এন্ড-টু-এন্ড স্পিচ রিকগনিশন সিস্টেম যা শুধুমাত্র কনভোল্যুশনাল নিউরাল নেটওয়ার্ক ব্যবহার করে, কোনো পুনরাবৃত্তি হয় না।
অডিও এআইJasper এবং QuartzNet হল NVIDIA-এর এন্ড-টু-এন্ড কনভোলিউশনাল স্পিচ রিকগনিশন মডেল, কোয়ার্টজনেট নাটকীয়ভাবে ছোট, দক্ষ রিডিজাইন...
অডিও এআইডিফিউশন মডেলগুলি ধাপে ধাপে নয়েজিং প্রক্রিয়াকে বিপরীত করতে শেখার মাধ্যমে অডিও তৈরি করে, এলোমেলো শব্দকে সুসঙ্গত বক্তৃতা, সঙ্গীত বা শব্দ প্রভাবে পরিণত করে।
অডিও এআইসাউন্ড ইভেন্ট ডিটেকশন (SED) শনাক্ত করে যে কোন অডিও স্ট্রীমে কোন শব্দ আসে এবং ঠিক কখন শুরু হয় এবং বন্ধ হয়।
Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.