تردید کارشناسان درباره نقش کپیبرداری از Fable در موفقیت مدل Kimi K3
مقامات آمریکایی ادعا میکنند مدل قدرتمند Kimi K3 با کپیبرداری از مدل Fable شرکت Anthropic ساخته شده، اما کارشناسان میگویند تقطیر به تنهایی نمیتواند چنین جهشی ایجاد کند. این مناقشه نشاندهنده رقابت شدید و ابعاد سیاسی توسعه هوش مصنوعی است.
جهان هوش مصنوعی این روزها شاهد یک اتهامزنی جدید است: مقامات دولت آمریکا میگویند مدل زبانی بزرگ و متنباز Kimi K3 که توسط شرکت چینی Moonshot AI عرضه شده، حاصل کپیبرداری غیرقانونی از مدل Fable شرکت Anthropic است. اما بررسیهای فنی و نظر متخصصان، این ادعا را زیر سوال میبرد.
Michael Kratsios، مشاور علمی کاخ سفید، در توییتی مدعی شد که Moonshot با استفاده از تراشههای ممنوعه صادراتی به چین، مدل Fable را کپی کرده است. او این اقدام را «تقطیر صنعتی مخفیانه در مقیاس بزرگ با هدف سرقت فناوری آمریکا» خواند. Scott Bessent، وزیر خزانهداری آمریکا نیز از وجود «واترمارکهای مدلهای زبانی آمریکایی» در مدلهای چینی خبر داد، اما جزئیات بیشتری ارائه نکرد.
با این حال، متخصصان هوش مصنوعی درباره نقش تقطیر (distillation) در موفقیت Kimi K3 تردید دارند. به گزارش TechCrunch، Braden Hancock، محقق موسسه Laude و یکی از بنیانگذاران Snorkel AI، میگوید: «فکر نمیکنم بتوانید مدلی به این قدرتمندی و به این سرعت را فقط با تقطیر از روی Fable بسازید. اصلاً زمان کافی وجود ندارد. Fable تنها از اول جولای به صورت عمومی در دسترس بوده و شما نمیتوانید آن حجم داده را در دو هفته تقطیر کنید، مدل را آموزش دهید و منتشر کنید.»
Nathan Lambert، محقق هوش مصنوعی در موسسه Allen AI نیز در پادکستی تاکید کرد که اهمیت تقطیر با نزدیکتر شدن مدلهای چینی به مرزهای فناوری و تغییر رژیم آموزشی به سمت یادگیری تقویتی (reinforcement learning) کمتر شده است. او توضیح داد که اگر تقطیر به تنهایی کافی بود، همه میتوانستند با استفاده از دادههای Kimi K3 به سرعت به آن برسند، اما این اتفاق نیفتاده است.
تقطیر فرآیندی است که در آن یک آزمایشگاه به طور سیستماتیک مدل هدف را کوئری میزند تا دادههایی برای آموزش مدل جدید تولید کند. گاهی این کار شامل درخواست از مدل برای توضیح زنجیره تفکر (chain-of-thought) است. اما به گفته کارشناسان، برای کپی کردن قابلیتهای پیشرفتهای مانند Fable، به تکنیکهای یادگیری تقویتی نیاز است که به زیرساخت عظیمی نیاز دارد. اجرای این فرآیند از طریق API یک آزمایشگاه پیشرو «بسیار گران و احتمالاً با گلوگاه زمانی مواجه خواهد بود و حتی ممکن است بهبود عملکردی هم به همراه نداشته باشد.»
پیش از این نیز شرکت Anthropic شرکتهای Moonshot، DeepSeek و MiniMax را به تقطیر سیستماتیک مدلهایش متهم کرده بود. اما واقعیت این است که تقطیر در صنعت هوش مصنوعی امری رایج است؛ Elon Musk هم امسال شهادت داد که شرکتش برای ساخت Grok از مدلهای OpenAI تقطیر کرده است.
Hancock همچنین تاکید میکند که تخصص فنی تیمهای چینی دستکم گرفته میشود: «یکی از بنیانگذاران Moonshot دانشجوی دکتری دانشگاه CMU بوده است. اینها محققان و مهندسان واقعی هستند که کار درست انجام میدهند. اگر پیشرفت مدلهای آمریکایی متوقف شود، فکر میکنم پیشرفت چین کند میشود، اما همچنان ادامه خواهد یافت. آنها فقط سوار بر موج نیستند.»
بخش دیگری از اتهامات Kratsios به دستیابی Moonshot به تراشههای پیشرفته Nvidia Grace Blackwell 300 و سرورهای مجهز به GB300 در تایلند اشاره دارد. صادرات این تراشهها به چین ممنوع است، اما بازار سیاهی برای آنها وجود دارد. در ماه می، بنیانگذار شرکت Supermicro به اتهام قاچاق تراشههای پیشرفته به چین متهم شد. Sam Bresnick، پژوهشگر مرکز امنیت و فناوریهای نوظهور جورجتاون، خواستار قوانین «مشتری خود را بشناس» برای دیتاسنترها در سراسر جهان است تا از استفاده غیرمجاز سختافزارهای پیشرفته جلوگیری شود.
این ماجرا برای ایران نیز درسآموز است: کشوری که با تحریمهای شدید در حوزه فناوری روبروست، توسعه هوش مصنوعی بومی با اتکا به توان داخلی و دور زدن تحریمها از مسیرهای پرخطر، چالشهای مشابهی را پیش رو دارد. تجربه چین نشان میدهد که حتی با وجود محدودیتهای صادراتی، پیشرفت با تکیه بر تخصص و نوآوری امکانپذیر است، اما مسیرهای غیرقانونی نیز وسوسهانگیز هستند.
در نهایت، به نظر میرسد ادعاهای مقامات آمریکایی بیشتر با انگیزههای سیاسی و رقابتی مطرح شده تا شواهد فنی قطعی. در حالی که جنگ تجاری و فناوری بین آمریکا و چین شدت گرفته، کاربران و توسعهدهندگان هوش مصنوعی در سراسر جهان باید با آگاهی از این فضای ملتهب، به سراغ انتخاب ابزارهای خود بروند.