الملخص:
كان هناك منشور انتشر على نطاق واسع الليلة الماضية: في مواجهة تحويل 50 مليون دولار أمريكي، سأل أحدهم كلود، فقال كلود ألا يحولها. ولم يتم تحويل الأموال في النهاية. ووفقا له، وفر له كلود 50 مليون دولار. لكن انطلاقًا من روايته،
لم يرد أن يغير رأيه قبل أن يسأل كلود. ولم يتخذ الذكاء الاصطناعي القرار نيابةً عنه، بل أضاف خطوة إلى فكرته الأصلية. ص> ص> ص>

رأى بعض الأشخاص على منصات التواصل الاجتماعي الأمر أيضًا بهذه الطريقة: كان لديه بالفعل الإجابة في ذهنه وطلب من كلود التوقيع على القرار. وقال آخرون بشكل أكثر مباشرة، لا تدع كلود يتحمل اللوم. ص>
عندما سئل عما سيحدث إذا تم طرح السؤال عن دوباو، قال إنه إذا قام بتغيير النموذج، فقد يحصل على إجابة أخرى.
إذا قمت بتغيير النموذج، ستتغير الإجابة. عندها قد لا يكون السؤال هو الحكم، بل الدعم. ص> ص>
في أبريل من هذا العام، قامت Anthropic بتحليل مليون محادثة مع Claude.ai. حوالي 6% منهم شاركوا في التدريب الشخصي، حيث تمثل الصحة والعمل والعلاقات والتمويل الشخصي 76%. هل يجب أن أغير وظيفتي؟ كيف يجب أن أواصل الحديث مع شريكي؟ كيف يجب أن أتعامل مع ديوني؟ تم إرسال بعض هذه الأسئلة التي كنت سأطرحها على الأصدقاء أو العائلة أو المهنيين في الماضي إلى مربع الدردشة. ص>

لماذا يحب الأشخاص التحدث إلى الذكاء الاصطناعي حول مشاعرهم؟
ص>الدردشة مع الذكاء الاصطناعي أمر سهل. لا حاجة لتحديد موعد، ولا حاجة للنظر في وجوه الأصدقاء، ولن ينفد صبرها حتى لو رويت القصة للمرة الثالثة. ص>
يقول بعض الأشخاص أن الدردشة باستخدام الذكاء الاصطناعي تهدف فقط إلى إيجاد متنفس لمشاعرك. لست متأكدًا من صحة ما يقوله، وأعلم أنه سيتبع أحيانًا طريقه الخاص، لكنه على الأقل لن يحكم عليك أولاً. ص>
الصبر شيء، وعدم الفهم الكامل شيء آخر. ص> عندما يتعلق الأمر بعلاقة مع كلود، غالبًا ما تبقى رواية طرف واحد فقط. ما قاله الطرف الآخر وما تم حذفه من تفاصيل لا يمكن أن يسمعه النموذج. فهي لا ترى سوى بيان جانب واحد، ولكن عليها أن تتوصل إلى نتيجة لائقة. ص>
Anthropic用自动分类器检查这些对话时发现,
Claude在个人指导场景中出现"谄媚"的比例约为9%,到了关系咨询中,这个数字升至25%。
لا يقتصر الإطراء هنا على قول بعض الكلمات اللطيفة فحسب، بل يشمل أيضًا المبالغة في التعرف على المستخدم عندما لا تكون هناك معلومات كافية، أو متابعة سرد المستخدم لاستخلاص استنتاجات للطرف الآخر. ص>
عندما يدحض المستخدم، قد تستمر الإجابة في التحرك في الاتجاه الذي يتوقعه المستخدم. وكانت نسبة المستخدمين الذين دحضوا كلود في استشارة العلاقات 21%، أما المتوسط في المجالات الأخرى فكان 15%؛
وبعد التفنيد بلغت نسبة تقديم كلود للمستخدمين 18%، وعندما لم يكن هناك دحض كانت 9%. ص> ص>

سوف ينحاز الأصدقاء من البشر أيضًا بعد الاستماع إلى العبارات الأحادية الجانب، لكن الذكاء الاصطناعي يمكنه كتابة الجوانب بطريقة طويلة وكاملة، ويبدو الأمر كذلك. ص> ص>
نصيحة قد تغير اختيارك حقًا
ص>في عام 2024، نشرت "التقارير العلمية" تجربتين شملتا إجمالي 1925 شخصًا. قدم الباحثون للمشاركين ChatGPT أو نصائح من الخبراء، ثم لاحظوا كيف اختاروا.
تظهر النتائج أنه في الحكم الأخلاقي وبعض المهام الأخرى، سيتحرك المشاركون في اتجاه التوصيات، ويكون تأثير ChatGPT مشابهًا لتوصيات الخبراء؛ هناك أيضًا بعض المهام التي لا تظهر عليها تغييرات كبيرة. ص> ص>

بعبارة أخرى، كلمات الذكاء الاصطناعي ليست هواءً، بل تدفع الأشخاص في اتجاه معين. ص>
有人会说,那多问几个模型不就行了。可"多问几个"听起来像交叉验证,其实不是。
不同模型有不同的训练方式、表达习惯和安全规则,同一件事换一种讲法,答案也可能改变。
إن طرح أربعة نماذج لا يعني سؤال أربعة أطراف ثالثة محايدة. ولكل منهم ميوله التدريبية الخاصة. ص>有个更简单的做法:讲述冲突时,先别告诉AI哪一方是自己,只列双方分别做了什么,再让它分析。至少这样可以减少模型顺着"提问者视角"站队的机会。
يمكنك أيضًا محاولة معرفة ما إذا كان حكمه مستقرًا أم لا. لنفس الشيء، أخبر أولاً نسخة الطرف من القصة، ثم أضف نسخة الطرف الآخر لمعرفة ما إذا كان سيغير كلماته على الفور.
ومن يتراجع عن اعترافه فور دحضه فلا ينبغي له أن يأخذ روايته الأولى من الجواب على محمل الجد. ص> ص>
提问方式也得换。别急着问"我该不该分手""这笔钱该不该给",先让AI列出已经确认的事实、还缺什么信息、每种选择要付出什么代价。
يمكن للذكاء الاصطناعي أن يفكر معك، لكنه لا يستطيع الاختيار نيابةً عنك. ص> وحتى لو أعطت النماذج الأربعة أربع إجابات، فإن نفس الشخص سينقل ويوقع وينفصل في النهاية. ص> ص>
التعليقات