এআই ফাউন্ডেশন
AI কী, সিস্টেমগুলি কীভাবে শেখে, কোথায় ব্যর্থ হয় এবং হাইপ ছাড়াই কীভাবে দাবির বিচার করা যায় তা বুঝুন।
বিনামূল্যে এআই লাইব্রেরি
117 প্লেইন-ইংরেজি গাইড, স্ট্রাকচার্ড শেখার পাথ, এবং একটি উন্মুক্ত লাইব্রেরি — একটি স্বাধীন 501(c)(3) অলাভজনক দ্বারা নির্মিত যাতে যে কেউ আধুনিক AI বুঝতে পারে৷
এখানে শুরু করুন
প্রতিটি কোর্সে সুস্পষ্ট ফলাফল, ম্যাপ করা দক্ষতা, অনুশীলন কার্যক্রম এবং একটি প্রয়োগকৃত ক্যাপস্টোন অন্তর্ভুক্ত থাকে।
AI কী, সিস্টেমগুলি কীভাবে শেখে, কোথায় ব্যর্থ হয় এবং হাইপ ছাড়াই কীভাবে দাবির বিচার করা যায় তা বুঝুন।
গোপনীয়তা রক্ষা, আউটপুট পরীক্ষা এবং মানুষের জবাবদিহিতা রক্ষা করার সময় AI উত্পাদনশীলভাবে ব্যবহার করুন।
কর্মক্ষেত্রে ব্যবহারের ক্ষেত্রে মূল্যায়ন করুন, নিরাপদ পাইলট চালান, মান পরিমাপ করুন এবং দায়িত্বের সাথে পরিবর্তনগুলি যোগাযোগ করুন।
অধিকার, ইক্যুইটি, গভর্নেন্স, সুরক্ষা এবং জনস্বার্থের ফলাফলের মাধ্যমে এআই সিস্টেমগুলি বিশ্লেষণ করুন।
ব্যবহারিক সিস্টেম ডিজাইনের মাধ্যমে ভাষার মডেল, পুনরুদ্ধার, এজেন্ট, মূল্যায়ন, খরচ এবং স্থাপনার সুরক্ষাগুলি বুঝুন।
বিষয় ট্র্যাক
আপনার পছন্দের এলাকায় ঝাঁপ দাও। প্রতিটি ট্র্যাকে একাধিক প্লেইন-ইংরেজি গাইড রয়েছে৷
সম্পূর্ণ লাইব্রেরি
117 এর 1019 গাইড দেখানো হয়েছে। ট্র্যাক দ্বারা ফিল্টার করুন বা উপরে অনুসন্ধান করুন।
বিমফর্মিং একটি নির্বাচিত দিক থেকে শোনার জন্য একাধিক মাইক্রোফোন ব্যবহার করে, অন্য সবকিছুকে দমন করার সময় একটি লক্ষ্য থেকে শব্দকে প্রশস্ত করে।
অডিও এআইরিফিউশন হল একটি চতুর হ্যাক যা শব্দকে ছবি হিসাবে ব্যবহার করে সঙ্গীত তৈরি করে: এটি স্পেকট্রোগ্রাম আঁকার জন্য স্টেবল ডিফিউশন ইমেজ মডেলকে সূক্ষ্ম সুর করে, তারপর…
অডিও এআইশিখুন কিভাবে Google MusicLM টেক্সট প্রম্পটগুলিকে সুসংগত সঙ্গীতে পরিণত করতে শ্রেণীবদ্ধ শব্দার্থিক এবং শাব্দিক টোকেন, সাউন্ডস্ট্রিম এবং MuLan ব্যবহার করে।
অডিও এআইNoise2Noise হল একটি ট্রেনিং ট্রিক যা একটি মডেলকে আলাদাভাবে-গোলমালের জোড়া থেকে শেখার মাধ্যমে একটি পরিষ্কার রেফারেন্স না দেখেই শব্দ অপসারণ করতে শিখতে দেয়...
অডিও এআইConv-TasNet হল একটি নিউরাল নেটওয়ার্ক যা মিশ্র অডিওকে আলাদা করে (যেমন দু'জন লোক একসাথে কথা বলে) পরিবর্তে কাঁচা শব্দ তরঙ্গের উপর সরাসরি কাজ করে...
অডিও এআইডুয়াল-পাথ RNN (DPRNN) হল একটি অডিও বিভাজন আর্কিটেকচার যা অডিও বৈশিষ্ট্যগুলির একটি খুব দীর্ঘ ক্রমকে ছোট ওভারল্যাপিং অংশগুলিতে বিভক্ত করে এবং সেগুলিকে প্রক্রিয়া করে...
অডিও এআইOpen-Unmix (UMX) হল একটি ওপেন-সোর্স ডিপ লার্নিং সিস্টেম যা একটি গানকে তার অংশে বিভক্ত করে: ভোকাল, ড্রামস, বেস এবং অন্যান্য যন্ত্র।
অডিও এআইহুইস্পার শব্দের প্রান্তিককরণ অডিওতে প্রতিটি প্রতিলিপি করা শব্দকে একটি সঠিক শুরু এবং শেষ সময়ে পিন করে।
অডিও এআইমিউজিক ট্যাগিং একটি গান শোনার জন্য ট্রান্সফরমার মডেল ব্যবহার করে এবং জেনার, মুড, যন্ত্র এবং টেম্পোর মতো বর্ণনামূলক লেবেলগুলির পূর্বাভাস দেয়।
অডিও এআইঅডিও সিগন্যালে নোট, বীট বা শব্দ শুরু হলে সূচনা সনাক্তকরণ সঠিক মুহূর্তগুলি খুঁজে পায়।
অডিও এআইMelGAN হল একটি সম্পূর্ণ কনভোল্যুশনাল GAN-ভিত্তিক ভোকোডার যেটি মেল-স্পেকট্রোগ্রামগুলিকে একটি একক ফাস্ট ফরোয়ার্ড পাসে কাঁচা অডিও ওয়েভফর্মে পরিণত করে।
অডিও এআইUnivNet হল একটি GAN ভোকোডার যা বিভিন্ন STFT রেজোলিউশনে গণনা করা একাধিক স্পেকট্রোগ্রাম ব্যবহার করে তৈরি করা অডিও বিচার করে, উচ্চ-ফ্রিকোয়েন্সি বিশদকে তীক্ষ্ণ করে।
Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.