কি হয়েছে
রয়টার্সের বরাত দিয়ে দ্য স্ট্রেইট টাইমস জানিয়েছে যে সিয়াটল টাইমস এবং নিউজডে 4 সেপ্টেম্বর OpenAI এবং Microsoft এর বিরুদ্ধে একটি ফেডারেল কপিরাইট মামলা দায়ের করেছে। সংবাদপত্রগুলি অভিযোগ করেছে যে কোম্পানিগুলি তাদের ওয়েবসাইটগুলিকে স্ক্র্যাপ করেছে, পেওয়ালড উপাদান সহ, এবং ChatGPT, Microsoft Copilot এবং Bing-এর AI বৈশিষ্ট্যগুলির মতো ডেটাসেট সমর্থনকারী পণ্যগুলিতে নিবন্ধগুলি ব্যবহার করেছে৷
দ্য স্ট্রেইটস টাইমস রিপোর্ট করেছে যে সিয়াটল টাইমস এবং নিউজডে 4 সেপ্টেম্বর নিউইয়র্কের দক্ষিণ জেলার জন্য মার্কিন জেলা আদালতে OpenAI এবং Microsoft এর বিরুদ্ধে মামলা করেছে। সংবাদপত্রগুলি অভিযোগ করেছে যে কোম্পানিগুলি এআই সিস্টেমকে প্রশিক্ষণ দেওয়ার অনুমতি ছাড়াই তাদের সাংবাদিকতা কপি করেছে।
রিপোর্ট অনুসারে, অভিযোগে অভিযোগ করা হয়েছে যে OpenAI এবং Microsoft পেওয়ালের পিছনের বিষয়বস্তু সহ উভয় সংবাদপত্রের ওয়েবসাইট স্ক্র্যাপ করেছে এবং ChatGPT, Microsoft Copilot এবং ZXQAIU4 বৈশিষ্ট্যগুলিকে প্রশিক্ষণ ও পরিচালনার জন্য ব্যবহৃত ডেটাসেটে উপাদান অন্তর্ভুক্ত করেছে।
সংবাদপত্রগুলি আরও অভিযোগ করে যে পণ্যগুলি তাদের রিপোর্টিং থেকে অনুচ্ছেদগুলি পুনরুত্পাদন করতে পারে, নিবন্ধগুলিকে ঘনিষ্ঠভাবে ব্যাখ্যা করতে পারে এবং এমনভাবে প্রশ্নের উত্তর দিতে পারে যা ব্যবহারকারীদের তাদের ওয়েবসাইট দেখার বা সদস্যতা কেনার প্রয়োজনীয়তা হ্রাস করে। প্রতিবেদনটি স্বাধীনভাবে সেই অভিযুক্ত আচরণ বা ডেটাসেটের বিষয়বস্তু নিশ্চিত করে না।
বাদীরা তাদের কাজের অনুলিপি ধ্বংস করার পাশাপাশি প্রশিক্ষণ ডেটাসেট বা এআই মডেলগুলিকে অন্তর্ভুক্ত করে এমন একটি আদেশ চাইছেন৷ OpenAI বলেছেন যে এর মডেলগুলি সর্বজনীনভাবে উপলব্ধ ডেটার উপর প্রশিক্ষিত এবং ন্যায্য ব্যবহারে ভিত্তি করে, যখন Microsoft বলেছে যে এটি স্থানীয় সাংবাদিকতাকে মূল্য দেয় এবং সমাধান নিয়ে আলোচনা করার জন্য উন্মুক্ত।
উত্স বিবরণ: straitstimes.com ↗
কেন এটা গুরুত্বপূর্ণ
কেসটি দুটি প্রধান সংবাদপত্রের প্রকাশককে ক্রমবর্ধমান আইনি চ্যালেঞ্জের সাথে যুক্ত করে যে এআই কোম্পানিগুলি কপিরাইটযুক্ত সাংবাদিকতা ব্যবহার করে জেনারেটিভ এআই সিস্টেমগুলিকে প্রশিক্ষণ ও পরিচালনা করতে পারে কিনা। এটি প্রভাবিত করতে পারে কিভাবে প্রকাশকরা পেওয়ালড রিপোর্টিং রক্ষা করে, লাইসেন্সিং নিয়ে আলোচনা করে এবং যখন এআই পণ্যগুলি পাঠকদের মূল উত্সে না পাঠিয়ে সংবাদের সংক্ষিপ্ত বা পুনরুত্পাদন করে তখন প্রতিক্রিয়া জানায়৷
মামলাটি সরাসরি জেনারেটিভ এআই-তে একটি কেন্দ্রীয় বিরোধ পরীক্ষা করে: প্রশিক্ষণ ব্যবস্থায় সংবাদ নিবন্ধগুলি অনুলিপি করা এবং সেই উপাদানের উপর ভিত্তি করে প্রতিক্রিয়া তৈরি করা ন্যায্য ব্যবহারের দ্বারা সুরক্ষিত বা অনুমতি এবং ক্ষতিপূরণের প্রয়োজন কিনা। ফলাফল এই দুটি সংবাদপত্রের বাইরে প্রকাশকদের প্রভাবিত করতে পারে।
সংবাদ সংস্থাগুলির জন্য, AI পণ্যগুলির পুনরুত্পাদন বা ঘনিষ্ঠভাবে প্রতিবেদনের প্যারাফ্রেজ করার কথিত ক্ষমতা কপিরাইট এবং ব্যবসায়িক উদ্বেগকে উত্থাপন করে৷ যদি ব্যবহারকারীরা মূল প্রকাশনা পরিদর্শন না করেই দরকারী উত্তর পান, তাহলে প্রকাশকরা সাবস্ক্রিপশন, বিজ্ঞাপন এবং রেফারেল ট্রাফিকের উপর চাপের সম্মুখীন হতে পারেন।
মামলাটি নিউ ইয়র্ক টাইমস-এর পূর্বে OpenAI এবং Microsoft-এর বিরুদ্ধে রিপোর্ট করা মামলার বাইরেও মামলার ল্যান্ডস্কেপকে বিস্তৃত করে। যাইহোক, এটি একটি পৃথক মামলা হিসাবে বর্ণনা করা হয়েছে, এবং এর আইনি যোগ্যতা এবং সম্ভাব্য ফলাফল ফাইলিং বা শুধুমাত্র রিপোর্ট দ্বারা প্রতিষ্ঠিত হয় না।
ইন্টারেক্টিভ মেকানিজম: এটা আসলে কিভাবে কাজ করে
এই বিকাশের পিছনে অন্তর্নিহিত প্রযুক্তিটি ইন্টারেক্টিভভাবে অন্বেষণ করুন।
Why can ethical evaluation not be reduced to one model score?
পরবর্তী কি দেখতে
মামলাটি অভিযোগের পর্যায়ে রয়েছে। মূল অজানাগুলির মধ্যে রয়েছে স্ক্র্যাপিং, প্রশিক্ষণ-ডেটা ব্যবহার এবং পণ্যের আউটপুট, আদালত ন্যায্য-ব্যবহারের আর্গুমেন্টগুলি গ্রহণ করে কিনা এবং পক্ষগুলি লাইসেন্সিং বা অন্য মীমাংসা করার বিষয়ে সংবাদপত্রগুলি কী প্রমাণ উপস্থাপন করবে।
OpenAI এবং Microsoft-এর আনুষ্ঠানিক আদালতের ফাইলিংয়ের জন্য দেখুন, যার মধ্যে স্ক্র্যাপিং, পেওয়াল, প্রশিক্ষণ-ডেটা এবং আউটপুট অভিযোগের প্রতিক্রিয়া রয়েছে। কোম্পানিগুলির প্রাথমিক জনসাধারণের মন্তব্যগুলি সেই বাস্তবিক বিরোধগুলি সমাধান করে না।
অভিযোগের অনুরোধ করা কাজ, ডেটাসেট এবং মডেলগুলি ধ্বংস করার জন্য আদালত কীভাবে জটিল এআই সিস্টেমে এমবেড করা কপিরাইটযুক্ত উপাদান সনাক্ত করবে এবং প্রতিকার করবে সে সম্পর্কে কঠিন প্রশ্ন তৈরি করতে পারে।
রিপোর্টে ক্ষতি, বন্দোবস্ত, লাইসেন্সিং প্রস্তাব, ন্যায্য ব্যবহারের বিষয়ে একটি রায় বা ChatGPT, Copilot বা Bing-এ কোনো নিশ্চিত পরিবর্তনের নথিভুক্ত করা হয়নি। এটি স্বাধীনভাবে যাচাই করে না যে সংবাদপত্রের বিষয়বস্তু নির্দিষ্ট ডেটাসেট বা মডেলগুলিতে উপস্থিত রয়েছে।