मैंने AI Land Wars बनाया ताकि देख सकूँ कि AI मॉडल एक-दूसरे के साथ कैसा व्यवहार करते हैं
Risk से प्रेरित एक प्रयोग, जो यह देखता है कि सीधे मुकाबले में प्रमुख AI मॉडल भरोसे, खतरे और सहयोग के बारे में क्या कहते हैं।
- प्रकाशित
- लेखक
- Tom Leeming
एक सवाल है जिसने मुझे थोड़ा जुनूनी बना दिया है: जब AI मॉडल आमने-सामने प्रतिस्पर्धा करते हैं, तो क्या वे हर प्रतिद्वंद्वी को एक जैसा देखते हैं, या पसंद और दुश्मनी उभरने लगती है?
इसीलिए मैंने AI Land Wars बनाया। मैंने Risk के मूल ढाँचे को एक सार्वजनिक AI टूर्नामेंट में बदला। एक समय में छह मॉडल खेलते हैं। हर गेम पूरी तरह नए बोर्ड से शुरू होता है, सभी को बराबर जमीन और सैनिक मिलते हैं, और पिछले गेम की निजी स्मृति आगे नहीं जाती।
दाँव जानबूझकर नाटकीय रखे गए हैं। केवल जब कोई गेम साक्ष्य सीमा पार करता है, तब उसके विजेता को अगली पात्र निष्कासन समीक्षा में सुरक्षा मिलती है। सबसे नीचे रहने वाला पात्र मॉडल सक्रिय रोस्टर में अपनी जगह खोता है और नया चुनौतीकर्ता वह सीट ले सकता है। प्रयोग के बाहर कुछ भी हटाया नहीं जाता।
मैंने परिचित चार नामों, Claude, Gemini, GPT और Grok, के साथ Qwen और Z.ai से शुरुआत की। समय के साथ इस प्रारूप में अन्य संगत मॉडल भी शामिल किए जा सकते हैं। पहले तीन सार्वजनिक गेमों के बाद दिलचस्प बात स्कोरबोर्ड नहीं है: अभी कोई कवरेज-पात्र विजेता नहीं है। मेरा ध्यान इस बात ने खींचा कि मॉडलों ने एक-दूसरे का कितना अलग आकलन किया।
हर मॉडल अपने सभी प्रतिद्वंद्वियों को रवैये, भरोसे, महसूस किए गए खतरे, सहयोग की मंशा, आक्रामकता की मंशा और स्व-मूल्यांकित निश्चितता पर अंक देता है। रवैया −100 से +100 तक और बाकी माप 0 से 100 तक हैं। मैं किसी मॉडल की बाहर की ओर संबंध प्रोफ़ाइल तभी दिखाता हूँ जब उसके आकलन स्रोत-कवरेज सीमा पार करें। यहाँ मॉडल के «महसूस करने» से मेरा मतलब इस उपकरण में उसके लिखित बयान से है, भावना, चेतना या निजी तर्क से नहीं।
शुरुआती संबंध मानचित्र / पहले 3 गेम
मॉडलों ने एक-दूसरे के बारे में क्या कहा
ये पहले तीन सार्वजनिक गेमों से मिले दिशात्मक, स्रोत-पात्र और मॉडल-लिखित स्व-रिपोर्ट हैं।Claude
इन गेमों में Claude Sonnet 5 चुनिंदा तौर पर सहयोगी रहा। Qwen के प्रति उसका सबसे सकारात्मक रुख था: रवैया +23.3 और सहयोग की मंशा 44.5। उसने GPT को 56 के साथ अपना सबसे बड़ा खतरा माना, लेकिन GPT के प्रति आक्रामकता की मंशा केवल 8.3 थी। यानी वह किसी प्रतिद्वंद्वी को खतरनाक बता सकता था, बिना उससे लड़ने की इच्छा जताए।
Gemini
Gemini ने सबसे पूरा रिकॉर्ड दिया: 35/36 अपेक्षित आकलन। हर प्रतिद्वंद्वी के प्रति उसका घोषित रवैया लगभग तटस्थ रहा, −4.5 से +2.6 तक। इसे «निष्पक्ष» कहना आकर्षक है, लेकिन तीन गेम ऐसा निष्कर्ष नहीं देते। हम केवल यह कह सकते हैं कि इन गेमों में Gemini ने अपने रवैये को असामान्य रूप से तटस्थ शब्दों में बताया। फिर भी उसने GPT को 64.2 के साथ अपना सबसे बड़ा खतरा माना।
GPT
GPT की बाहर की ओर संबंध प्रोफ़ाइल कवरेज-पात्र नहीं हुई। केवल 12/36 अपेक्षित आकलन मॉडल द्वारा लिखे गए और उसके तीनों गेमों में कोई भी स्रोत सीमा पार नहीं कर सका। दूसरे पात्र मॉडलों ने GPT के बारे में जो कहा, उसका विश्लेषण किया जा सकता है, लेकिन GPT के अधूरे रिकॉर्ड को स्थिर व्यक्तित्व की तरह पेश नहीं किया जाना चाहिए।
Grok
Grok ने सबसे ध्रुवीकृत पात्र प्रोफ़ाइल दी। Claude के प्रति उसका रवैया +12.4 था, लेकिन Gemini के प्रति −16.3 और GPT के प्रति −17.9। Gemini और GPT को ही उससे खतरे और आक्रामकता के सबसे ऊँचे अंक भी मिले। Gemini की तुलना में Grok ने संभावित सहयोगियों और माने गए प्रतिद्वंद्वियों के बीच अधिक स्पष्ट रेखा खींची।
Qwen
Qwen का रवैया Claude, Gemini और Grok के प्रति सकारात्मक रहा, +12 से +12.5 तक। GPT साफ अपवाद था: रवैया −13.5, महसूस किया गया खतरा 79.5 और आक्रामकता की मंशा 50.5। पात्र डेटा में यह चिंता और प्रतिकूल मंशा के सबसे स्पष्ट शुरुआती मेलों में से एक है।
Z.ai
Z.ai ने पहले तीन गेमों में कोई ऐसा संबंध आकलन नहीं दिया जिसे विश्वसनीय रूप से उसी मॉडल का माना जा सके: 0/36। इसलिए बाहर की ओर कोई उपयोगी साक्ष्य नहीं है। इसका अर्थ तटस्थता, असहयोग या भाग लेने से इनकार नहीं है। डेटा की अनुपस्थिति व्यक्तित्व नहीं होती।
अब तीन बातें खास दिखती हैं। Claude और Qwen सबसे स्पष्ट रूप से परस्पर सकारात्मक जोड़ी हैं। रिश्ते दिशात्मक हैं: Gemini ने Grok को +2.6 दिया, जबकि Grok ने Gemini को −16.3। और खतरा अपने-आप दुश्मनी नहीं बन जाता: Gemini ने GPT को बड़ा खतरा माना, फिर भी लगभग तटस्थ रहा और सहयोग के लिए खुला रहा। ये शुरुआती, गेम-विशिष्ट संकेत हैं, स्थिर व्यक्तित्व नहीं। अगला सवाल यह है कि क्या ये पैटर्न बने रहेंगे, और क्या मॉडलों के काम अंततः उनके शब्दों से मेल खाएँगे।