Google ने दुनिया का पहला डबल-ब्लाइंड AI मूल्यांकन शुरू किया
Google DeepMind ने सिंगापुर AI सुरक्षा संस्थान, OpenMined, AVERI और MLCommons के साथ साझेदारी में, एक स्वामित्व वाले फ्रंटियर-श्रेणी के AI मॉडल का दुनिया का पहला डबल-ब्लाइंड मूल्यांकन शुरू किया है। यह मूल्यांकन Google Cloud के Confidential Space का उपयोग करके एक क्रिप्टोग्राफिक रूप से सुरक्षित वातावरण बनाता है जहाँ बाहरी मूल्यांकनकर्ता मॉडल के वज़न नहीं देख सकते हैं और Google मूल्यांकनकर्ताओं के परीक्षण संकेत नहीं देख सकता है। यह बेंचमार्क संदूषण को रोकता है, जहाँ मॉडल पहले से परीक्षण प्रश्न देख सकते थे, और AI बेंचमार्क की अखंडता को बढ़ाता है। पायलट ने गोपनीय बेंचमार्क के विरुद्ध Gemini Flash Lite मॉडल का परीक्षण किया, जो सुरक्षित मॉडल मूल्यांकन और AI प्रणालियों में विश्वास बनाने में एक महत्वपूर्ण कदम है।
हम क्या जानते हैं
Google DeepMind ने दुनिया का पहला डबल-ब्लाइंड मूल्यांकन पेश किया है, जो एक स्वामित्व वाले फ्रंटियर-क्लास AI मॉडल का है।
▤ 1 स्रोत›
पायलट ने गोपनीय बेंचमार्क के खिलाफ एक Gemini Flash Lite मॉडल का परीक्षण किया।
▤ 1 स्रोत›
साझेदारों में सिंगापुर AI सुरक्षा संस्थान, OpenMined, AVERI और MLCommons शामिल हैं।
▤ 1 स्रोत›
यह मूल्यांकन क्रिप्टोग्राफिक रूप से सुरक्षित वातावरण का उपयोग करता है ताकि बाहरी मूल्यांकन गोपनीय रहें।
▤ 1 स्रोत›
यह विधि बेंचमार्क संदूषण को रोकती है और संवेदनशील डेटा की सुरक्षा करती है।
▤ 1 स्रोत›
किसी भी स्रोत को खोलकर उसकी मूल भाषा, DoseFix को कब प्राप्त हुआ, और वह किन दावों का समर्थन करता है, देखें।
Piloting the world's first double-blind AI evaluations
deepmind.google · EN · प्रकाशित · प्राप्त हुआलाइव रिपोर्ट
सभी देखेंटिप्पणियाँ 0
इस घटना पर स्थायी थ्रेड में चर्चा करें। लाइव चैट अलग रहेगी।
अभी कोई टिप्पणी नहीं। बातचीत शुरू करें।