از میز پوکر تا بورس وال استریت: هوش مصنوعی دیپمایند ۵۰۰ میلیون دلار ارزش گذاری شد
سه پژوهشگر پیشین دیپمایند که با هوش مصنوعی پوکر جهان را شگفتزده کردند، اکنون فناوری یادگیری تقویتی را به معاملات مالی آوردهاند و استارتاپ آنها با ارزشگذاری بیش از ۵۰۰ میلیون دلار، توجه سرمایهگذاران را جلب کرده است.
سه پژوهشگر سابق دیپمایند که روزگاری با ساخت یک هوش مصنوعی پوکر، قهرمانان انسانی را شکست دادند، حالا همان فناوری را به بازارهای مالی آوردهاند و نتیجه شرطبندیشان موفقیتآمیز بوده است.
به گزارش تککرانچ، آزمایشگاه هوش مصنوعی EquiLibre Technologies که در پراگ مستقر است و توسط مارتین اشمید، رودولف کادلچ و ماتی موراوچیک تأسیس شده، اکنون با ارزش گذاری بیش از ۵۰۰ میلیون دلار پس از جذب سرمایه سری A، به یکی از نمونههای برجسته کاربرد یادگیری تقویتی در معاملات مالی تبدیل شده است. این دور سرمایهگذاری توسط شرکت سرمایهگذاری خطرپذیر Creandum رهبری شد و به گفته کامرون سلرز، معاون این شرکت، بزرگترین سرمایهگذاری تکمرحلهای تاریخ این firm بوده است.
اتصال میان پوکر و وال استریت، تکنیک یادگیری تقویتی است؛ روشی که در آن مدلهای خودآموز با دریافت پاداش، استراتژیهای بهینه را کشف میکنند. مارتین اشمید، مدیرعامل EquiLibre میگوید: «نکته جالب درباره معاملات و بازارها این است که ارزیابی عملکرد بسیار ساده است: عامل هوش مصنوعی چقدر پول درآورده؟»
البته این فقط بازی نیست. الگوریتمهای EquiLibre با همکاری شرکت سهامدار Tower Research Capital، روزانه میلیاردها دلار در شاخصهای S&P 500 و نزدک معامله میکنند. این استارتاپ ادعا میکند که از زمان راهاندازی در بازارهای رمزارز در سال ۲۰۲۵ و اکنون در بورسهای سهام، «رکورد کاملی از ماههای بدون ضرر» داشته است؛ یعنی هر ماه با سود خالص به پایان رسیده است.
این موفقیت توجه سرمایهگذاران را جلب کرده است. کامرون سلرز از Creandum معتقد است بازار معاملات مالی یکی از بزرگترین بازارهای قابل دسترس است و صندوقهای سهامی در طول سالها سودهای نجومیای کسب کردهاند که موفقیتهای استارتاپی را کوچک جلوه میدهد. با این حال EquiLibre خود را «یک آزمایشگاه، نه یک شرکت مالی» تعریف میکند. اشمید تأکید میکند که انگیزه آنها ساختن چیزهای جدید است، نه صرفاً کارآمد کردن بازارها.
موسسان EquiLibre دانشجویان دکتری مهمان در دفتر تحقیقاتی دیپمایند در ادمونتون کانادا بودند (که گوگل آن را در ۲۰۲۳ تعطیل کرد). آنها در آنجا DeepStack را ساختند، اولین برنامه هوش مصنوعی که بازیکنان حرفهای پوکر بدون محدودیت را شکست داد. آنها همچنین با اساتیدی همکاری داشتند که اکنون در هیئت مشاوران استارتاپ حضور دارند؛ از جمله ریچ ساتن، برنده جایزه تورینگ ۲۰۲۴ برای کار بر روی یادگیری تقویتی.
برای ساخت استارتاپ، این سهنفر به کشور خود، جمهوری چک بازگشتند. اشمید میگوید انتخاب پراگ به حفظ استعدادها کمک کرده است: «اینجا هر دو ماه یک استارتاپ جذاب هوش مصنوعی جدید ظاهر نمیشود، بنابراین حفظ افراد خوب آسانتر است.» این شرکت اکنون ۲۵ کارمند دارد و برنامه دارد یکی از بزرگترین خوشههای محاسباتی در اروپای مرکزی و شرقی را راهاندازی کند.
با این حال رقابت تنگاتنگ است. غول معاملاتی Jane Street نیز از یادگیری تقویتی با مدلهای زبانی بزرگ استفاده میکند و دهها هزار GPU در اختیار دارد. اما EquiLibre روی بهرهوری بیشتر از تراشههای کمتر تمرکز دارد. اشمید میگوید: «این بازار برندههمهچیز نیست.»