ব্লগ

লেখক: Kevin

ChatGPT কি নিজেই ফ্যাক্ট চেক করতে পারে? ৬ ধাপের চেকলিস্ট

ChatGPT নিজের কিছু ভুল ধরতে পারে, আবার সেগুলো পুনরাবৃত্তিও করতে পারে। এআইয়ের উত্তর আসল উৎসের সঙ্গে মেলানোর ৬ ধাপের চেকলিস্ট এখানে।

টেবিলের ওপর সোজা দাঁড় করানো পুরোনো বইয়ের একটি সারি, পাশ থেকে তোলা

ChatGPT আংশিকভাবে নিজেই ফ্যাক্ট চেক করতে পারে। কোনো উত্তর আবার পড়ে যে দাবিগুলো নিয়ে সে নিশ্চিত নয় সেগুলো চিহ্নিত করতে বললে সে কিছু ভুল ধরবে। কিন্তু যাচাইটা আসছে সেই একই মডেল থেকে যে উত্তরটি লিখেছিল, তাই সে একই ভুল আরও আত্মবিশ্বাসে দোহরাতে পারে, আর যে উৎস তার কাছে নেই তা খুলে দেখতেও পারে না। যা আপনি পাঠাবেন, প্রকাশ করবেন বা যার ওপর ভরসা করবেন, তার জন্য তার নিজের যাচাইকে প্রথম ধাপ ধরুন, তারপর নাম, সংখ্যা, তারিখ আর উদ্ধৃতি বাইরের উৎসে মিলিয়ে নিন।

ChatGPT-কে ফ্যাক্ট চেক করতে বললে কী হয়

২০২৩ সালে PolitiFact নিজেদের ৪০টি ফ্যাক্ট-চেকে ChatGPT-কে পরীক্ষা করেছিল। মডেলটি প্রায় অর্ধেক ক্ষেত্রে PolitiFact-এর রেটিংয়ের সঙ্গে মিলেছিল। প্রশ্ন কীভাবে করা হয়েছে তার ওপর উত্তর বদলে গেছে, কখনো সে দাবি রেট করতে অস্বীকার করেছে, দেখানোর মতো কোনো উৎস তার ছিল না, আর একটি হিসাবের ভুলে একটি সিদ্ধান্ত উল্টে গেছে। PolitiFact-এর বিশেষজ্ঞরা মডেলটিকে মাঝেমধ্যে সহায়ক, কিন্তু নির্ভরযোগ্য ফ্যাক্ট-চেকার থেকে অনেক দূরে বলে বর্ণনা করেছিলেন।

সেই পরীক্ষা হয়েছিল একটি পুরোনো ফ্রি ভার্সনে, আর তারপর মডেল উন্নত হয়েছে, বিশেষ করে যখন তারা ওয়েবে সার্চ করতে পারে। তবু যে শিক্ষাটা টিকে আছে তা ভার্সনের নয়, পদ্ধতির: যে মডেল নিজের খাতা নিজে দেখে, তার অন্ধ জায়গাগুলোও একই থাকে। এ কারণেই নিচের ধাপগুলো আপনাকে চ্যাটের বাইরের উৎসে পাঠায়।

এআইয়ের উত্তর যাচাইয়ের ৬ ধাপের চেকলিস্ট

  1. যাচাইযোগ্য দাবিগুলোর তালিকা করুন। উত্তরটি পড়তে পড়তে প্রতিটি নাম, সংখ্যা, তারিখ, উদ্ধৃতি, "গবেষণায় দেখা গেছে" ধরনের লাইন, আইন, দাম আর জায়গার নিচে দাগ দিন। মতামত আর পরামর্শে এটা লাগে না। তথ্যে লাগে।
  2. ভুল হলে ক্ষতি কত, সেই অনুযায়ী সাজান। একটি ভুল বিশেষণ ক্ষতিকর নয়। ক্লায়েন্ট রিপোর্টে ভুল পরিসংখ্যান বা বায়োতে ভুল তারিখ ক্ষতিকর। আগে বেশি ক্ষতির দাবিগুলো ধরুন।
  3. মডেলের কাছে তার সম্মতি নয়, সন্দেহ চান। নিচের প্রম্পটটি ব্যবহার করুন। "এটা কি ঠিক?" জিজ্ঞেস করলে প্রায়ই হ্যাঁ মেলে। দাবিগুলো আত্মবিশ্বাস অনুযায়ী ভাগ করতে বললে আপনি পিছু নেওয়ার মতো একটি ছোট তালিকা পান।
  4. প্রতিটি দাবির প্রাথমিক উৎস খুঁজুন। মানে গবেষণাটি নিজে, কোম্পানির নিজের পেজ, সরকারি বা মানক ডেটাবেস, কিংবা মূল প্রবন্ধ, তার পুনরাবৃত্তি করা অন্য কোনো সাইট নয়। তিনটি ব্লগ যে দাবি বলছে, সেগুলো সবই হয়তো একটি ভুল থেকেই এসেছে।
  5. মডেল যত রেফারেন্স দিয়েছে, প্রতিটি খুলুন। দেখুন লিংক কাজ করছে কি না, পেজটি আছে কি না, আর উত্তরে যা বলা হয়েছে সেখানে তাই লেখা আছে কি না। একটি রেফারেন্স নিখুঁত দেখতে হয়েও না থাকতে পারে। খুঁজে না পেলে দাবিটি বাদ দিন বা এমন একটি দাবি দিয়ে বদলান যার উৎস আপনি পান।
  6. টেক্সট ঠিক করুন, তারপর আবার পড়ুন। ভুল দাবি শুধরান, যেগুলো নিশ্চিত করতে পারেননি সেগুলো "অনিশ্চিত" লিখুন বা মুছে দিন, আর যে উৎস রাখতে চান তা যোগ করুন। তারপর পুরোটা আরও একবার পড়ুন, কারণ সংশোধনের পর প্রায়ই অদ্ভুত জোড়া থেকে যায়।

সন্দেহ চাওয়া প্রম্পট

যে উত্তরটি যাচাই করতে চান, তার পরে এটি পেস্ট করুন:

তোমার শেষ উত্তরের প্রতিটি তথ্যগত দাবি একটি ক্রমিক তালিকায় লেখো। প্রতিটিকে নিশ্চিত, অনিশ্চিত বা অনুমান হিসেবে চিহ্নিত করো। অনিশ্চিত ও অনুমানের দাবির জন্য বলো কোন ধরনের উৎস সেটি নিশ্চিত করবে। নতুন কোনো দাবি যোগ করবে না, আর আগের শব্দচয়নের পক্ষে সাফাই গাইবে না।

এতে উত্তরটি সত্য হয়ে যায় না। কিন্তু দুর্বল জায়গাগুলো চোখে পড়ে, ফলে আপনার সময় সঠিক লাইনগুলোতে খরচ হয়। "নিশ্চিত"-কে পাস ভাববেন না, ভাবুন এমন দাবি যেটা মাঝেমধ্যে দেখে নিতে হবে।

একটি বাস্তব উদাহরণ

এখানে এআই-স্টাইলের একটি ছোট অনুচ্ছেদ, যাতে তিনটি দাবি আছে:

আইফেল টাওয়ার ১৮৮৭ সালে প্যারিসের বিশ্বমেলার জন্য সম্পূর্ণ হয়েছিল। একজন প্রাপ্তবয়স্ক মানুষের শরীরে ২০৬টি হাড় থাকে। বেশিরভাগ মানুষ তাদের মস্তিষ্কের মাত্র প্রায় ১০ শতাংশ ব্যবহার করে।

দাবিযাচাইয়ে কী মেলেকরণীয়
১৮৮৭ সালে সম্পূর্ণটাওয়ারটি ১৮৮৯ সালে, ১৮৮৯ সালের বিশ্বমেলার জন্য সম্পূর্ণ হয়। নির্মাণ শুরু হয় ১৮৮৭ সালে।তারিখ ঠিক করুন
প্রাপ্তবয়স্কের ২০৬টি হাড়শারীরবিদ্যার রেফারেন্সে প্রচলিত সংখ্যারাখুন, রেফারেন্স যোগ করুন
মস্তিষ্কের ১০ শতাংশদীর্ঘদিনের একটি ভুল ধারণাবাদ দিন, বা এটি ভুল ধারণা বলে জানান

খেয়াল করুন, ভুল তারিখ আর ভুল ধারণা দুটোই মসৃণভাবে পড়া যায়। সুর দেখে কিছুই বোঝা যায় না, আর সেই কারণেই যাচাই করতে হয় দাবি ধরে ধরে, আন্দাজে নয়।

Unflag-এ এটা কীভাবে করবেন

প্রতিটি দাবি হাতে খুঁজতে না চাইলে ফ্যাক্ট চেক আপনার হয়ে খাটুনিটা করে দেয়:

  1. ফ্যাক্ট চেক খুলুন এবং সাইন ইন করুন। এটি Unflag Plus-এর অংশ, তাই ফ্রি অ্যাকাউন্টে চালানো যায় না। ওয়েবে অন্তত ৫০ শব্দ লাগে, আর Plus-এ প্রতি ইনপুটে ১০,০০০ অক্ষর পর্যন্ত চলে।
  2. এআইয়ের উত্তর বা আপনার খসড়া পেস্ট করে যাচাই করুন চাপুন।
  3. Unflag আপনার টেক্সট থেকে দাবিগুলো বের করে, প্রতিটির জন্য ওয়েবে খোঁজে, আর কনফিডেন্স স্কোরসহ একটি সামগ্রিক ফলাফল, একটি সারাংশ, প্রতিটি দাবির বিশ্লেষণ এবং উৎস ফেরত দেয়।
  4. প্রতিটি দাবি একটি রায় পায়: সত্য, মিথ্যা, আংশিক সত্য, বিভ্রান্তিকর বা যাচাই অযোগ্য।
  5. যে দাবি গুরুত্বপূর্ণ, তার পেছনের উৎসগুলো খুলুন। রায় হলো নিশ্চিত করার একটি সূত্র, উৎস পড়ার বিকল্প নয়।
  6. টেক্সট ঠিক করুন, তারপর সংশোধিত খসড়াটি নিজের মতো করে তুলতে পুনরায় লিখুন (যেমন লেখা উন্নত করুন) বা এআই হিউম্যানাইজ করুন ব্যবহার করুন। এআই হিউম্যানাইজ করুন দাম আর শতাংশের মতো সংখ্যা রেখে দেওয়ার চেষ্টা করে, তবু যেকোনো রিরাইটের পর আপনার সংখ্যাগুলো আবার দেখে নিন।

২০২৬ সালের অক্টোবর অনুযায়ী, ওয়েবে Unflag Plus মাসে $8.99 বা বছরে $45.99। অ্যাপগুলোর বিল স্টোরের মাধ্যমে সাপ্তাহিক বা বার্ষিকভাবে হয়।

মডেল সবচেয়ে বেশি কোথায় ভুল করে

এগুলোতে বাড়তি সতর্ক থাকুন:

  • রেফারেন্স আর লিংক। শিরোনাম, লেখক, জার্নাল আর URL এমনভাবে বানানো হতে পারে যে আসল মনে হয়।
  • নির্দিষ্ট সংখ্যা। শতাংশ, দাম, তারিখ আর গণনা সামান্য এদিক-ওদিক হওয়া সহজ।
  • উদ্ধৃতি। মডেল কোনো উদ্ধৃতি আর বক্তার নাম দিলে সেটি মূল উৎসে খুঁজে দেখুন।
  • সাম্প্রতিক ঘটনা। মডেলের ট্রেনিং ডেটার পরের যেকোনো কিছু, সে সার্চ না করলে, বাদ পড়তে বা ভুল হতে পারে।
  • বিশেষ বা স্থানীয় তথ্য। ছোট কোম্পানি, স্থানীয় আইন আর বিশেষায়িত ক্ষেত্রের পেছনে ট্রেনিং ডেটা কম থাকে।
  • চিকিৎসা, আইন ও অর্থ-সংক্রান্ত পরামর্শ। প্রশ্ন তৈরি করতে মডেল ব্যবহার করুন, আর উত্তরের জন্য যোগ্য পেশাদার বা সরকারি উৎসের কাছে যান।

এই চেকলিস্ট যা পারে না

কোনো টুল, Unflag-সহ, প্রতিটি ভুল ধরা পড়বে এমন কথা দিতে পারে না। ওয়েবে খোঁজা ফ্যাক্ট চেকার যা পায় তার মধ্যেই সীমাবদ্ধ, আর "যাচাই অযোগ্য" মানে ঠিক সেটাই, "মিথ্যা" নয়। তথ্য যাচাই আর লেখার ধরন যাচাই আলাদা কাজও: আপনার চিন্তা যদি এআই খসড়া পড়তে কেমন লাগে তা নিয়ে হয়, তাহলে এআই ডিটেক্টরের স্কোরের মানে কী এবং আপনার স্কুল কোনটি ব্যবহার করে তা কীভাবে জানবেন নিয়ে আমাদের লেখাটি সেই দিকটা দেখে। আর আপনার কোর্স বা কর্মস্থলে এআই নীতি থাকলে তা মেনে চলুন, এআইয়ের সাহায্য জানানোর যেকোনো নিয়মসহ।

আমরা এটা কীভাবে তৈরি করেছি

আমরা PolitiFact-এর প্রকাশিত পরীক্ষা পড়েছি, ধাপগুলো প্রোডাক্ট ও তার কোডে Unflag-এর নিজস্ব ফ্যাক্ট চেক ফ্লোর সঙ্গে মিলিয়েছি, আর ২০২৬ সালের অক্টোবর অনুযায়ী Unflag-এর দাম দেখেছি। উদাহরণটি এই লেখার জন্যই লেখা। এর সঙ্গে কোনো টুলের কোনো আউটপুট জুড়ে দেওয়া নেই।

সংক্ষেপে: ChatGPT-কে তার সন্দেহগুলো তালিকা করতে দিন, তারপর জরুরি দাবিগুলো প্রাথমিক উৎসে যাচাই করুন, আর ফ্যাক্ট চেক রাখুন সেই সময়ের জন্য যখন সামলানোর মতো অনেক দাবি থাকে।

সচরাচর জিজ্ঞাসিত প্রশ্ন

ChatGPT কি নিজেই ফ্যাক্ট চেক করতে পারে?

আংশিকভাবে। উত্তরটি আবার পড়ে সন্দেহজনক দাবি চিহ্নিত করতে বললে সে কিছু ভুল ধরতে পারে, বিশেষ করে স্পষ্ট অসংগতি। কিন্তু যাচাইটা আসছে একই মডেল থেকে, তাই সে একই ভুল আরও আত্মবিশ্বাসে দোহরাতে পারে। একে প্রথম ধাপ হিসেবে নিন, তারপর নাম, সংখ্যা, উদ্ধৃতি আর তারিখ বাইরের উৎসে মিলিয়ে নিন।

ChatGPT কেন ভুয়া উৎস বানায়?

ভাষা মডেল সবচেয়ে সম্ভাব্য পরের শব্দগুলো লেখে, আর বিশ্বাসযোগ্য একটি রেফারেন্স দেখতে একজন লেখক, একটি শিরোনাম আর একটি সালের মতো। সার্চ টুল চালু না থাকলে সে কিছু খুঁজে দেখে না। তাই একটি রেফারেন্স পুরোপুরি ঠিক পড়া গেলেও আসলে নাও থাকতে পারে। লিংক নিজে খুলুন বা শিরোনাম নিজে সার্চ করুন।

ChatGPT-কে দিয়ে নিজের উত্তর ফ্যাক্ট চেক করানোর ভালো প্রম্পট কী?

তাকে বলুন শেষ উত্তরের প্রতিটি যাচাইযোগ্য দাবির তালিকা করতে, প্রতিটিকে নিশ্চিত, অনিশ্চিত বা অনুমান হিসেবে চিহ্নিত করতে, আর কোন ধরনের উৎস সেটি নিশ্চিত করবে তা বলতে। 'এটা কি ঠিক?' জিজ্ঞেস করবেন না, এতে প্রায়ই হ্যাঁ মেলে। তারপর অনিশ্চিত আর অনুমানের দাবিগুলো নিজে যাচাই করুন।

এআইয়ের লেখা আর্টিকেল প্রকাশের আগে কীভাবে ফ্যাক্ট চেক করব?

প্রতিটি নাম, সংখ্যা, তারিখ, উদ্ধৃতি আর 'গবেষণায় দেখা গেছে' ধরনের লাইন আলাদা করুন, তারপর প্রতিটি প্রাথমিক উৎসে মিলিয়ে নিন, যেমন মূল গবেষণা, কোম্পানির নিজের পেজ বা সরকারি ডেটাবেস। যা নিশ্চিত করতে পারবেন না তা ঠিক করুন বা বাদ দিন। তারপর খসড়াটি এডিট করুন যাতে সেটা আপনার নিজের মতো শোনায়।

Unflag কি এআই টেক্সট ফ্যাক্ট চেক করে?

হ্যাঁ। Unflag Plus-এ থাকা ফ্যাক্ট চেক আপনার টেক্সট থেকে দাবিগুলো বের করে, প্রতিটির জন্য ওয়েবে খোঁজে, আর রায়, কনফিডেন্স স্কোর ও উৎস ফেরত দেয়। সেও ভুল করতে পারে, তাই কোনো রায়ের ওপর ভরসা করার আগে দেওয়া উৎসগুলো খুলে দেখুন। ফ্রি অ্যাকাউন্টে এটি ব্যবহার করা যায় না।

পরিসংখ্যান আর উদ্ধৃতির জন্য ChatGPT-কে বিশ্বাস করা কি নিরাপদ?

না, যাচাই ছাড়া নয়। পরিসংখ্যান, উদ্ধৃতি, আইনি বা চিকিৎসা-সংক্রান্ত তথ্য, সাম্প্রতিক ঘটনা এবং নির্দিষ্ট সংখ্যা আছে এমন যেকোনো কিছুতেই মডেল সবচেয়ে বেশি ভুল করে। প্রতিটিকে একটি সূত্র হিসেবে ধরুন, মূল উৎস খুঁজে বের করুন, আর উৎসও একই কথা বললে তবেই রাখুন।

Unflag থেকে আরও

সব দেখুন