এআই ফাউন্ডেশন
AI কী, সিস্টেমগুলি কীভাবে শেখে, কোথায় ব্যর্থ হয় এবং হাইপ ছাড়াই কীভাবে দাবির বিচার করা যায় তা বুঝুন।
বিনামূল্যে এআই লাইব্রেরি
117 প্লেইন-ইংরেজি গাইড, স্ট্রাকচার্ড শেখার পাথ, এবং একটি উন্মুক্ত লাইব্রেরি — একটি স্বাধীন 501(c)(3) অলাভজনক দ্বারা নির্মিত যাতে যে কেউ আধুনিক AI বুঝতে পারে৷
এখানে শুরু করুন
প্রতিটি কোর্সে সুস্পষ্ট ফলাফল, ম্যাপ করা দক্ষতা, অনুশীলন কার্যক্রম এবং একটি প্রয়োগকৃত ক্যাপস্টোন অন্তর্ভুক্ত থাকে।
AI কী, সিস্টেমগুলি কীভাবে শেখে, কোথায় ব্যর্থ হয় এবং হাইপ ছাড়াই কীভাবে দাবির বিচার করা যায় তা বুঝুন।
গোপনীয়তা রক্ষা, আউটপুট পরীক্ষা এবং মানুষের জবাবদিহিতা রক্ষা করার সময় AI উত্পাদনশীলভাবে ব্যবহার করুন।
কর্মক্ষেত্রে ব্যবহারের ক্ষেত্রে মূল্যায়ন করুন, নিরাপদ পাইলট চালান, মান পরিমাপ করুন এবং দায়িত্বের সাথে পরিবর্তনগুলি যোগাযোগ করুন।
অধিকার, ইক্যুইটি, গভর্নেন্স, সুরক্ষা এবং জনস্বার্থের ফলাফলের মাধ্যমে এআই সিস্টেমগুলি বিশ্লেষণ করুন।
ব্যবহারিক সিস্টেম ডিজাইনের মাধ্যমে ভাষার মডেল, পুনরুদ্ধার, এজেন্ট, মূল্যায়ন, খরচ এবং স্থাপনার সুরক্ষাগুলি বুঝুন।
বিষয় ট্র্যাক
আপনার পছন্দের এলাকায় ঝাঁপ দাও। প্রতিটি ট্র্যাকে একাধিক প্লেইন-ইংরেজি গাইড রয়েছে৷
সম্পূর্ণ লাইব্রেরি
117 এর 1019 গাইড দেখানো হয়েছে। ট্র্যাক দ্বারা ফিল্টার করুন বা উপরে অনুসন্ধান করুন।
কভার গান শনাক্তকরণ সনাক্ত করে যখন দুটি খুব ভিন্ন-শব্দের রেকর্ডিং আসলে একই অন্তর্নিহিত গান হয় — একটি লাইভ অ্যাকোস্টিক সংস্করণ, একটি রিমিক্স…
অডিও এআইDDSP (ডিফারেনশিয়াবল ডিজিটাল সিগন্যাল প্রসেসিং) ক্লাসিক সিন্থেসাইজার বিল্ডিং ব্লককে নিউরাল নেটওয়ার্কের সাথে ফিউজ করে, তাই গভীর শিক্ষা অসিলেটর নিয়ন্ত্রণ করতে পারে...
অডিও এআইVITS হল একটি টেক্সট-টু-স্পিচ মডেল যা সাধারণ দুই-পর্যায়ের পাইপলাইন এড়িয়ে একটি একক প্রশিক্ষিত সিস্টেমে পাঠ্যকে সরাসরি কাঁচা অডিও ওয়েভফর্মে পরিণত করে।
অডিও এআইফাস্টস্পিচ এক সময়ে একটি ফ্রেমের পরিবর্তে সমান্তরালে একটি সম্পূর্ণ স্পিচ স্পেকট্রোগ্রাম তৈরি করে, যা সংশ্লেষণকে নাটকীয়ভাবে দ্রুত এবং আরও স্থিতিশীল করে তোলে।
অডিও এআইন্যাচারাল স্পিচ হল Microsoft TTS গবেষণার একটি লাইন যা মানব-স্তরের বক্তৃতা গুণমানকে লক্ষ্য করে, পরবর্তী সংস্করণগুলি সমৃদ্ধ, প্রাকৃতিক উৎপন্ন করতে সুপ্ত প্রসারণ ব্যবহার করে...
অডিও এআইস্পিচ ইমোশন রিকগনিশন (SER) হল AI যা একজন স্পিকারের মানসিক অবস্থা — রাগ, আনন্দ, দুঃখ, হতাশা — তাদের কণ্ঠের শব্দ থেকে শনাক্ত করে, শুধু…
অডিও এআইMoshi হল Kyutai-এর একটি ওপেন-সোর্স, রিয়েল-টাইম ভয়েস AI যেটি একই সময়ে কথা বলে এবং শোনে — ফুল-ডুপ্লেক্স — কঠোর বাঁক নেওয়ার পরিবর্তে।
অডিও এআইস্পিচ-টু-স্পিচ ট্রান্সলেশন (S2ST) একটি ভাষায় কথ্য শব্দ গ্রহণ করে এবং অন্য ভাষায় কথ্য শব্দ তৈরি করে — আদর্শভাবে স্পিকারের কণ্ঠস্বর, স্বর সংরক্ষণ করে...
অডিও এআইHiFi-GAN হল একটি জেনারেটিভ-অ্যাডভারসারিয়াল ভোকোডার যা একটি মেল-স্পেকট্রোগ্রামকে প্রায় সঙ্গে সঙ্গে একটি কাঁচা অডিও ওয়েভফর্মে পরিণত করে, স্টুডিও-গুণমানের স্পিচ তৈরি করে...
অডিও এআইগ্রাফিম-টু-ফোনমে (G2P) রূপান্তর লিখিত অক্ষরগুলিকে এমন শব্দগুলিতে অনুবাদ করে যা একটি বক্তৃতা সিস্টেমকে আসলে উচ্চারণ করা উচিত।
অডিও এআইটেক্সট নর্মালাইজেশন হল ফ্রন্ট-এন্ড স্টেপ যা একটি বক্তৃতা সিস্টেম বলার আগে কাঁচা লিখিত টেক্সটকে সম্পূর্ণভাবে বলা শব্দে পুনর্লিখন করে।
অডিও এআইসাউন্ডস্ট্রীম হল Google-এর এন্ড-টু-এন্ড নিউরাল অডিও কোডেক যা স্পিচ এবং মিউজিককে অত্যন্ত কম বিটরেটে সংকুচিত করে এবং গুণমান রক্ষা করে।
Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.