ضربه محکم دادگاه به سازندگان هوش مصنوعی: آموزش مدلها با زحمت تحریریهای دیگران «استفاده منصفانه» نیست!
دادگاه تجدیدنظر آمریکا در حکمی سرنوشتساز اعلام کرد آموزش هوش مصنوعی با خلاصهها و یادداشتهای تحریریهای دیگران نقض قانون است و استفاده منصفانه به حساب نمیآید. این تصمیم پیام واضح و تکاندهندهای برای توسعهدهندگان دارد: نمیتوان با دیتایتر و تمیز دیگران، برای خودشان رقیب تجاری ساخت!

در یک نگاه (نکات کلیدی خبر)
خلاصه مهمترین نکات و تحولات این گزارش برای مطالعه سریع
- دادگاه تجدیدنظر آمریکا با رد ادعای استارتاپ Ross اعلام کرد که استفاده از خلاصهها و یادداشتهای تحریریهای وستلاو برای آموزش هوش مصنوعی، بههیچوجه «استفاده منصفانه» (Fair Use) به حساب نمیآید.
- استارتاپ مدعی بود کاربران مستقیماً این دادهها را ندیدهاند و فقط مصرف داخلی داشته، اما قاضی پرونده آب پاکی را روی دستشان ریخت: هدف شما ساخت رقیب تجاری با دیتای آماده دیگران بوده است!
- این حکم زنگ خطری حیاتی برای توسعهدهندگان است؛ حتی اگر اسناد اصلی عمومی باشند، حاشیهنویسیها، برچسبها و خلاصهسازیهای انسانی کپیرایت دارند و نمیتوان آنها را مجانی در مدلها بلعید.
دادگاه تجدیدنظر حوزه سوم فدرال آمریکا حکم داده که استفاده استارتاپ Ross Intelligence از یادداشتهای اختصاصی وستلاو برای آموزش هوش مصنوعی، به بازار فعلی و حتی بازار آینده واگذاری مجوز (لایسنس) این شرکت لطمه جدی زده است.
دادگاه تجدیدنظر حوزه سوم آمریکا رسماً تأیید کرد که اقدام استارتاپ Ross Intelligence در استفاده از یادداشتهای تحریریهای وستلاو (Westlaw) برای آموزش پلتفرم رقیب جستجوی حقوقی هوش مصنوعی، بههیچوجه مصداق «استفاده منصفانه» یا همان Fair Use نیست. این رأی که در واقع مهر تأییدی بر حکم دادگاه بدوی است، یک هشدار مستقیم و ملموس برای تمام توسعهدهندگان هوش مصنوعی دارد که سرویسهای خود را روی دادههای ساختاریافته و دستچینشده تحریریهای میسازند: منبع و کاربرد دادههای آموزشی شما وزن قانونی سنگینی دارند و همهچیز فقط به خروجی نهایی که کاربر میبیند ختم نمیشود!
خلاصه تحریریهای، متن حکم دادگاه نیست!
مرز باریک میان حکم دادگاه (که متعلق به حوزه عمومی است) و خلاصهای که یک ویراستار انسانی برای آن نوشته، هسته اصلی و کلیدی این پرونده جنجالی به حساب میآید.
آرا و احکام قضایی متعلق به مالکیت عمومی هستند؛ یعنی هر کسی میتواند آزادانه آنها را بخواند، کپی کند و با استفاده از آنها ابزار بسازد. اما داستان «هدنوتها» یا همان خلاصههای وستلاو کاملاً فرق میکند.
هدنوت (Headnote) در واقع یک چکیده کوتاه و تخصصی است که در کنار متن اصلی رأی دادگاه قرار میگیرد. این تفاوت را مثل فرق بین یک دیتاست خام و فهرست تخصصی و طبقهبندیشدهای در نظر بگیرید که یک شرکت برای قابلجستجو شدن آن دادهها با زحمت فراوان میسازد؛ دادههای خام ممکن است کاملاً رایگان باشند، اما این شاخص و ساختار ساختهشده رایگان نیست! ویراستاران حقوقی وستلاو با ساعتها کار فکری، نکات حقوقی مهم را دستچین میکنند، زمینه تحلیلی و وقایع پرونده را تعیین مینمایند و در نهایت آن را بهقدری چکیده و شفاف مینویسند تا یک وکیل بتواند ظرف چند ثانیه بخش مربوطه را پیدا کند.
از نگاه قضات دادگاه تجدیدنظر، همین هنر و زحمت ویراستاری دقیقاً همان «جرقه خلاقیت» (Creative Spark) موردنیاز قانون کپیرایت را تأمین میکند. دادگاه با استناد به حداقل آستانه اصالت در حقوق مالکیت فکری، تشخیص داد که انتخابها، سبک طبقهبندی و ارائه این خلاصهها حاصل خلاقیت و کار مستقل ویراستاران بوده است.
در آن سو، استارتاپ Ross Intelligence با همکاری شرکت LegalEase Solutions بستههای آموزشی اختصاصی ساخت تا سؤالات حقوقی کاربران را به بخشهای مرتبط از احکام دادگاه پیوند دهد. این دادههای آموزشی مستقیماً از یادداشتهای وستلاو استفاده میکردند؛ آن هم نه به شکلی اتفاقی و گذرا، بلکه این یادداشتها نقشی حیاتی در کارکرد محصول نهایی ایفا میکردند.
«شواهد غیرقابلانکار نشان میدهد که محتوای شرکت تامسون رویترز واجد جرقه خلاقیت است و استارتاپ ROSS قصد داشته با استفاده از همین محتوا برای هدفی کاملاً مشابه، به رقیب مستقیم آن تبدیل شود.» این را قاضی تامیکا مونتگومری-ریوز در متن رأی دادگاه تجدیدنظر حوزه سوم تأکید کرده است.
استدلال دادگاه یک خط قرمز شفاف ترسیم میکند: قرار گرفتن یک متن خام در مالکیت عمومی، هرگز به این معنی نیست که خلاصهها، تحلیلها یا دستهبندیهای اختصاصی که دیگران با زحمت برای آن ساختهاند هم به صورت خودکار عمومی و رایگان میشوند!
استفاده داخلی هم استارتاپ راس را نجات نداد
استدلال شرکت راس مبنی بر اینکه کاربران هرگز خلاصهها را در خروجی ندیدهاند رد شد؛ دادگاه دقیقاً روی این نکته دست گذاشت که دادههای کپیشده به محصول رقیب چه قدرتی بخشیدهاند.
تیم وکلای راس ادعا میکردند که از این خلاصهها فقط به عنوان دادههای آموزشی در پشت صحنه (استفاده داخلی) بهره بردهاند و این محتوا هرگز به همان شکلِ یادداشتهای وستلاو به کاربران نشان داده نشده است. اما این استدلال در برابر دادگاه کاری از پیش نبرد.
قضات دادگاه این استفاده را در بهترین حالت «حداقل تغییر شکلدهی» (Minimally Transformative) توصیف کردند. شاید فرآیند فنی کار با نحوه نمایش یادداشتها به مشترکان وستلاو فرق داشته باشد، اما هدف تجاری هر دو دقیقاً یکی بوده است: کمک به کاربران برای انجام پژوهش و جستجوی حقوقی. از این رو، تغییر فرمت ظاهری یا مخفی نگه داشتن دیتای آموزشی در خروجی چتبات، خودبهخود کاربری شما را به یک کاربری تحولآفرین و منصفانه بدل نمیکند.
به گزارش بلومبرگ لاو، قاضی مونتگومری-ریوز در بخشی از رأی خود مینویسد: «ظاهر ماجرا شاید فریبنده باشد، اما در حقیقت این پرونده چیزی فراتر از یک نقض حق کپیرایتِ عادی نیست.»
علاوه بر این، دادگاه به دو نوع آسیب به بازار توجه کرد: کپیبرداری استارتاپ راس هم بازار فعلی سرویسهای پژوهش حقوقی وستلاو را به خطر انداخته بود و هم به بازاری بالقوه لطمه میزد که تامسون رویترز میتوانست در آن یادداشتهای تحریریهای خود را مستقیماً لایسنس کند و به توسعهدهندگان هوش مصنوعی بفروشد. هر دوی این فاکتورها به ضرر دفاعیه استفاده منصفانه تمام شد.
این حکم شامل چه مواردی نمیشود؟
تصمیم دادگاه تجدیدنظر بر پایه شرایط بسیار خاص این پرونده اتخاذ شده و به معنای ممنوعیت سراسری و مطلق آموزش هوش مصنوعی با دادههای دارای کپیرایت نیست.
تحلیل دادگاه کاملاً به شرایط جزئی این دعوا وابسته بود: محتوای تحریریهایِ قابلحمایت با کپیرایت، رقابت تجاری مستقیم، کپیبرداری از حجم زیادی از یادداشتها و ساخت محصولی که دقیقاً همان بازار هدف را نشانه رفته است. تمام این فاکتورها قدمبهقدم تحلیل استفاده منصفانه را شکل دادند.
در جریان این دادرسی، بنیاد مرزهای الکترونیکی (EFF) و گروهی دیگر از فعالان حقوق دیجیتال به نفع راس استدلال کرده و هشدار دادند که چنین احکامی میتواند کنترل بیش از حدی روی دادههای واقعی و کاربردی به مالکان بدهد. این نگرانی در شرایطی که دادگاههای دیگر نیز با اختلافات دادههای آموزشی دستوپنجه نرم میکنند، همچنان داغ و زنده است.
اگرچه استارتاپ Ross Intelligence اکنون تعطیل و منحل شده است، اما این حکم پیام بسیار مهمی برای تمام توسعهدهندگانی دارد که مشغول گردآوری دیتاستهای آموزشی از پایگاههای داده ساختاریافته، آرشیوهای خبری، متون علمی حاشیهنویسیشده یا سرویسهای داده تجاری هستند.
خلاصهها، یادداشتها، برچسبها و متادادههایی که روی اطلاعات عمومی ساخته میشوند، در صورتی که حاوی اصالت و خلاقیت انسانی باشند، تحت حمایت قانون کپیرایت قرار میگیرند. سیگنال نهایی این دادگاه برای جامعه هوش مصنوعی کاملاً روشن و قاطع است: آنچه برای دادگاه اهمیت دارد این است که محتوای آموزشی چه توانایی و قدرتی به مدل شما بخشیده و آیا این محصول نهایی به رقیبی برای خودِ منبع داده تبدیل شده است یا خیر.
برچسب های مرتبط
مطالب مرتبط و پیشنهادی

زنگ خطر برای دیپفیکهای انتخاباتی؛ پای هوش مصنوعی به دادگاه و پروندههای کیفری باز شد!
با داغتر شدن تنور رقابتهای انتخاباتی، استفاده گسترده از دیپفیکهای هوش مصنوعی برای تخریب رقبا حسابی جنجالبرانگیز شده و پای وکلا را به میان کشیده است. در شرایطی که هنوز قانون فدرال مشخصی برای مهار این محتواها تصویب نشده، کاندیداهای هدف با اخطاریههای حقوقی و حتی شکایتهای کیفری به جنگ ویدیوهای جعلی رفتهاند.

انقلاب حریم خصوصی گوگل در Gboard: آموزش مدلهای هوش مصنوعی به سرورهای فوقامنیتی TEE منتقل شد
گوگل در اقدامی تازه، شیوه آموزش مدلهای هوش مصنوعی کیبورد Gboard را متحول کرده و به جای پردازش روی گوشی کاربران، از محیطهای ابری فوقامنیتی موسوم به TEE استفاده میکند. این معماری جدید با ترکیب رمزنگاری دادهها و حریم خصوصی تفاضلی، سرعت آموزش هوش مصنوعی را به شکل چشمگیری افزایش میدهد و خیال کاربران را از محرمانه ماندن اطلاعات شخصی کاملاً راحت میسازد.

پایان افت کیفیت تصاویر در ادیتهای پیاپی؛ عرضه مدل Ideogram 4.5 در هیگزفیلد
مدل هوش مصنوعی جدید Ideogram 4.5 با هدف حل یکی از بزرگترین چالشهای تولید تصویر، یعنی افت کیفیت و بههمریختگی پیکسلها در ادیتهای پیاپی، به پلتفرم هیگزفیلد آمد. این مدل با تثبیت پیکسلهای دستنخورده، امکان ویرایش متن، تغییر نورپردازی و اصلاح جزئیات عکسها را با بالاترین دقت و بدون افت کیفیت فراهم میکند.
دیدگاه ها و گفتگوی تخصصی
نظرات خود را با جامعه مخاطبان وایر ای آی در میان بگذارید
هنوز دیدگاهی برای این مطلب ثبت نشده است
اولین نفری باشید که دیدگاه، تحلیل یا دیدگاه خود را درباره این موضوع با دیگران به اشتراک می گذارد.