এআই ফাউন্ডেশন
AI কী, সিস্টেমগুলি কীভাবে শেখে, কোথায় ব্যর্থ হয় এবং হাইপ ছাড়াই কীভাবে দাবির বিচার করা যায় তা বুঝুন।
বিনামূল্যে এআই লাইব্রেরি
117 প্লেইন-ইংরেজি গাইড, স্ট্রাকচার্ড শেখার পাথ, এবং একটি উন্মুক্ত লাইব্রেরি — একটি স্বাধীন 501(c)(3) অলাভজনক দ্বারা নির্মিত যাতে যে কেউ আধুনিক AI বুঝতে পারে৷
এখানে শুরু করুন
প্রতিটি কোর্সে সুস্পষ্ট ফলাফল, ম্যাপ করা দক্ষতা, অনুশীলন কার্যক্রম এবং একটি প্রয়োগকৃত ক্যাপস্টোন অন্তর্ভুক্ত থাকে।
AI কী, সিস্টেমগুলি কীভাবে শেখে, কোথায় ব্যর্থ হয় এবং হাইপ ছাড়াই কীভাবে দাবির বিচার করা যায় তা বুঝুন।
গোপনীয়তা রক্ষা, আউটপুট পরীক্ষা এবং মানুষের জবাবদিহিতা রক্ষা করার সময় AI উত্পাদনশীলভাবে ব্যবহার করুন।
কর্মক্ষেত্রে ব্যবহারের ক্ষেত্রে মূল্যায়ন করুন, নিরাপদ পাইলট চালান, মান পরিমাপ করুন এবং দায়িত্বের সাথে পরিবর্তনগুলি যোগাযোগ করুন।
অধিকার, ইক্যুইটি, গভর্নেন্স, সুরক্ষা এবং জনস্বার্থের ফলাফলের মাধ্যমে এআই সিস্টেমগুলি বিশ্লেষণ করুন।
ব্যবহারিক সিস্টেম ডিজাইনের মাধ্যমে ভাষার মডেল, পুনরুদ্ধার, এজেন্ট, মূল্যায়ন, খরচ এবং স্থাপনার সুরক্ষাগুলি বুঝুন।
বিষয় ট্র্যাক
আপনার পছন্দের এলাকায় ঝাঁপ দাও। প্রতিটি ট্র্যাকে একাধিক প্লেইন-ইংরেজি গাইড রয়েছে৷
সম্পূর্ণ লাইব্রেরি
117 এর 1019 গাইড দেখানো হয়েছে। ট্র্যাক দ্বারা ফিল্টার করুন বা উপরে অনুসন্ধান করুন।
মিমি হল একটি নিউরাল অডিও কোডেক যা রিয়েল টাইমে বিচ্ছিন্ন টোকেনগুলির একটি ক্ষুদ্র প্রবাহে বক্তৃতাকে সংকুচিত করে, তাই এআই মডেলগুলি খুব কম সময়ে শুনতে এবং কথা বলতে পারে…
অডিও এআইListen, Attend and Spell (LAS) হল একটি ল্যান্ডমার্ক 2015 নিউরাল নেটওয়ার্ক যা সরাসরি অক্ষরগুলিতে বক্তৃতা প্রতিলিপি করে, কোন হাতে তৈরি উচ্চারণ ছাড়াই...
অডিও এআইSpecAugment হল একটি সহজ কিন্তু শক্তিশালী ডেটা অগমেন্টেশন পদ্ধতি যা স্বীকৃতির মডেলগুলিকে আরও শক্তিশালী করার জন্য বক্তৃতার স্পেকট্রোগ্রামকে মুখোশ এবং বিকৃত করে।
অডিও এআইমিউজিক অটো-ট্যাগিং একটি গান শোনার জন্য মেশিন লার্নিং ব্যবহার করে এবং স্বয়ংক্রিয়ভাবে বর্ণনামূলক লেবেল যেমন জেনার, মুড, যন্ত্র এবং টেম্পো সংযুক্ত করে।
অডিও এআইটিমব্রে ট্রান্সফার অডিওর 'টোন কালার'কে নতুন আকার দেয় তাই একটি যন্ত্র অন্য যন্ত্রের মতো শোনায়, একটি গুঞ্জন করা সুরকে বেহালা বা ট্রাম্পেট লাইনে পরিণত করে...
অডিও এআইঅ্যাকোস্টিক সিন ক্লাসিফিকেশন (ASC) যন্ত্রগুলিকে পরিবেশ চিনতে প্রশিক্ষণ দেয় যেখানে একটি রেকর্ডিং করা হয়েছিল, একটি ব্যস্ত রাস্তা, একটি শান্ত পার্ক, একটি ট্রেন, একটি ক্যাফে…
অডিও এআইNVIDIA Riva হল প্রোডাকশন স্পিচ এআই (ASR, TTS, এবং অনুবাদ) এর জন্য একটি GPU-এক্সিলারেটেড SDK, যখন NeMo হল প্রশিক্ষণ এবং ফাইন-টিউনিংয়ের জন্য ওপেন-সোর্স টুলকিট...
অডিও এআইDeepSpeech হল একটি এন্ড-টু-এন্ড স্পিচ রিকগনিশন মডেল যা 2014 সালে Baidu দ্বারা প্রবর্তিত হয়েছিল যা একটি পুনরাবৃত্ত নিউরাল ব্যবহার করে সরাসরি পাঠ্যের সাথে কাঁচা অডিও বৈশিষ্ট্য ম্যাপ করে...
অডিও এআইএক্স-ভেক্টরগুলি একটি স্নায়ু নেটওয়ার্ক দ্বারা উত্পাদিত একটি স্পিকারের ভয়েসের নির্দিষ্ট দৈর্ঘ্যের সংখ্যাসূচক আঙ্গুলের ছাপ, যা তারা যা বলুক না কেন কে কথা বলছে তা বলতে ব্যবহৃত হয়।
অডিও এআইGlow-TTS হল একটি টেক্সট-টু-স্পীচ মডেল যা একটি চতুর সার্চ ট্রিক ব্যবহার করে, একটি আলাদা অ্যালাইনারের প্রয়োজনীয়তা দূর করে টেক্সট-টু-স্পিচের সাথে নিজের মতো করে সারিবদ্ধ করতে শেখে।
অডিও এআইসমান্তরাল ওয়েভগান হল একটি দ্রুত নিউরাল ভোকোডার যা একটি মেল-স্পেকট্রোগ্রামকে একটি ছোট GAN ব্যবহার করে একটি কাঁচা অডিও তরঙ্গরূপে পরিণত করে, একযোগে সমস্ত নমুনা তৈরি করে।
অডিও এআইWaveGlow হল NVIDIA-এর একটি ফ্লো-ভিত্তিক নিউরাল ভোকোডার যা অটোরিগ্রেশন ছাড়াই মেল-স্পেকট্রোগ্রাম থেকে স্পিচ ওয়েভফর্মগুলিকে একক পাসে সংশ্লেষিত করে।
Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.