Home تقنية تشتري شركات الذكاء الاصطناعي عددًا كبيرًا من الكتب القديمة لأنها خالية من...

تشتري شركات الذكاء الاصطناعي عددًا كبيرًا من الكتب القديمة لأنها خالية من الذكاء الاصطناعي | itg-ar.com

2
0
تشتري شركات الذكاء الاصطناعي عددًا كبيرًا من الكتب القديمة لأنها خالية من الذكاء الاصطناعي
| itg-ar.com

تشتري شركات الذكاء الاصطناعي عددًا كبيرًا من الكتب القديمة لأنها خالية من الذكاء الاصطناعي

يقتبس قارئ مجهول تقريرًا من 404 Media: بينما تبحث شركات الذكاء الاصطناعي عن المزيد من بيانات التدريب لتحسين نماذجها، تقدم إحدى الشركات كتبًا مطبوعة قديمة كمصدر مثالي لأنها مضمونة لتكون خالية من نفس أخطاء الذكاء الاصطناعي التي تنتجها شركات الذكاء الاصطناعي. تقول ISBNdb، وهي الشركة التي تنتج ما تدعي أنها “أكبر قاعدة بيانات للكتب في العالم”، والتي تقدم خدمات الحصول على الكتب بكميات كبيرة لشركات الذكاء الاصطناعي، على موقعها: “إن أفضل بيانات تدريب الذكاء الاصطناعي في العالم موجودة على الرف”. “تمثل الكتب المعرفة الإنسانية المنسقة والمراجعة من قبل النظراء والمحددة في مجال معين، وهي منظمة بطريقة لا يمكن لزحف الويب تكرارها. كثيفة ومحررة وموثوقة.” يوضح ISBNdb في أحد المقالات على موقعه أن الكتب المطبوعة المنشورة قبل عام 2022 مثالية لبيانات تدريب الذكاء الاصطناعي لأنها لا تتضمن نصًا تم إنشاؤه بواسطة الذكاء الاصطناعي. وكما يشير المقال بشكل صحيح، فإن الكثير من البيانات التي يمكن لشركات الذكاء الاصطناعي استخراجها من الإنترنت اليوم من المرجح أن تتضمن نصًا تم إنشاؤه بواسطة الذكاء الاصطناعي، مما قد يؤدي إلى “انهيار النموذج”، وهي العملية التي من خلالها تؤدي نماذج الذكاء الاصطناعي التي تم تدريبها على البيانات التي تم إنشاؤها بواسطة الذكاء الاصطناعي إلى نماذج أسوأ وأكثر عرضة للأخطاء. تشير المقالة أيضًا إلى أن مؤلفي الكتب الذين يعترضون على خدش كتاباتهم لأغراض التدريب يمكنهم الآن بسهولة تسميم نماذج الذكاء الاصطناعي من خلال إنتاج كتابات مصممة للتلاعب بنماذج الذكاء الاصطناعي الناتجة وتخريبها. “الكتب المطبوعة من حقبة ما قبل ماجستير العلوم مضمونة من الناحية الهيكلية لتكون خالية من هذا التلوث. وهذا وحده يعد ميزة كبيرة (…) “الكتب المطبوعة قبل هذا التاريخ (قبل عام 2022) نظيفة من الناحية الهيكلية من أدوات التسمم الحديثة.” (…) يعلن ISBNdb أنه يمكنه الحفاظ على سرية هوية شركات الذكاء الاصطناعي. يقول موقع ISBNdb: “اتفاقية عدم الإفصاح الصارمة (اتفاقية عدم الإفصاح) في كل مشاركة”. “يبدأ كل مشروع بعقد قانوني اتفاقية عدم الإفصاح الملزمة. لا يتم الكشف عن هويتك واستراتيجيتك وأهداف الاستحواذ أبدًا.” يشير ISBNdb إلى أن شركات الذكاء الاصطناعي قد لا ترغب في أن يتم القبض عليها وهي تدمر الكتب المطبوعة أثناء عملية المسح. يقول موقع ISBNdb: “مشكلة البصريات حقيقية”. “شركة الذكاء الاصطناعي تدمر مليوني كتاب” ليس عنوانًا رئيسيًا يولد التعاطف.”


تم النشر: 2026-07-21 21:10:00

مصدر: news.slashdot.org