هذا المقال يتطلب مستوى: مبتدئ
لو النموذج ردّ عليك باسم كتاب أو مرجع أو حكم قضائي وهو واثق تمامًا، وبعدين اكتشفت إنه مش موجود أصلًا، إنت شفت الهلوسة. بعد الخمس دقائق دي هتعرف ليه بتحصل، وتقدر تقلّلها بخطوة عملية واحدة بدل ما تثق في كل كلمة يقولها النموذج.
الهلوسة في الذكاء الاصطناعي: ليه بيخترع معلومات بثقة؟
المشكلة باختصار
نماذج اللغة زي ChatGPT وClaude وGemini بتديك إجابة سليمة الشكل حتى لو المعلومة غلط. المشكلة مش إنها بتكذب عن قصد. المشكلة إنها مصمّمة تكمّل الكلام بأكثر صيغة محتملة، مش تتأكد إن الكلام حقيقي. ده اسمه الهلوسة (Hallucination): نص طليق ومقنع، لكنه مخترع.
المفهوم بمثال بسيط الأول
تخيّل صاحبك اللي عمره ما بيقول "مش عارف". تسأله عن مطعم في حي مش رايحه، يرد على طول: "آه، مطعم الأصيل، تالت شارع على اليمين، بيفتح 9 الصبح". بثقة كاملة. المشكلة إن المطعم ده ممكن يكون مش موجود. صاحبك مش بيكذب، هو بس بيملأ الفراغ بأكثر إجابة "بتشبه" الإجابة الصح، عشان محرج يقول مش عارف.
النموذج بيعمل نفس الحاجة بالظبط. لما تطلب منه مرجع أو رقم مش متأكد منه، هو بيولّد كلام "شكله" مرجع: اسم مؤلف معقول، سنة معقولة، عنوان معقول. كله معقول، وكله ممكن يكون مخترع.
الشرح العلمي بعد المثال
النموذج بيشتغل بمبدأ واحد: توقّع الكلمة (التوكن) التالية الأكثر احتمالًا بناءً على الكلام اللي قبلها. هو مادرسش قاعدة بيانات حقيقة وقت الإجابة، وماعندوش زر "تأكّد من المصدر". لو أكثر تسلسل محتمل بعد كلمة "المرجع:" هو اسم بيبان علمي، هيكتبه، سواء كان موجود أو لأ.
الافتراض المهم هنا: النموذج بيحسّن "احتمالية النص"، مش "صحة النص". الاتنين بيتقابلوا كتير، فبيبان دقيق. لكن لما يفترقوا، بتطلع الهلوسة.
سيناريو واقعي بالأرقام
في 2023، محامي في نيويورك قدّم للمحكمة مذكرة فيها 6 أحكام قضائية طلبها من ChatGPT. الأحكام الستة كانت مخترعة بالكامل: أسماء قضايا وأرقام واقتباسات مش موجودة. القاضي غرّم المحامي وشريكه 5000 دولار. ده مش خيال، ده حكم موثّق (قضية Mata ضد Avianca).
وعلى مستوى القياس: لوحة Vectara لقياس الهلوسة بتحطّ أفضل النماذج في تلخيص النصوص عند نسبة هلوسة حوالي 1.5% إلى 3%، وبعض النماذج الأضعف بتعدّي 15%. يعني حتى الأحسن مش صفر. الرقم ده بيقولك حاجة عملية: عامل كل إجابة على إنها "احتمال"، مش "حقيقة".
خطوة عملية تقلّل الهلوسة (كود شغّال)
أبسط تحسين بيجيب نتيجة فورية: نزّل درجة الحرارة لصفر، واطلب صراحةً إن النموذج يقول "لا أعرف" بدل ما يخمّن، وامنعه يخترع مصادر. جرّب الكود ده:
from openai import OpenAI
client = OpenAI() # محتاج مفتاح API
SYSTEM = (
"أجب فقط من معلومات متأكد منها. "
"لو مش متأكد أو المعلومة مش عندك، قل صراحة: لا أعرف. "
"ممنوع اختراع مصادر أو أرقام أو أسماء. "
"لو ذكرت مرجعًا، اذكر فقط ما تتأكد أنه حقيقي."
)
resp = client.chat.completions.create(
model="gpt-4o-mini",
temperature=0, # يقلّل العشوائية = تخمين أقل
messages=[
{"role": "system", "content": SYSTEM},
{"role": "user", "content": "اذكر لي مرجعًا أكاديميًا عن موضوع نادر جدًا."},
],
)
print(resp.choices[0].message.content)