تحلیل علمی و شایعات درباره Midjourney v7 و تکنولوژی تبدیل فکر به تصویر، با بررسی همکاریهای نوروتک و امکانات جدید.
1. چرا زبان برای هنر کافی نیست؟ (مشکل پرامپتها) زبان انسان، ابزاری خطی و محدود است. یک تصویر هزار کلمه است، اما ما مجبوریم آن را در ۵۰ کلمه پرامپت خلاصه کنیم. در نسخههای فعلی (v6)، ما یاد گرفتهایم با
"زبان ماشین" صحبت کنیم: --ar 16:9 --stylize 500 . این مهندسی است، نه هنر خالص. فلسفه پشت Midjourney v7 این است که "واسطه" را حذف کند. اگر هوش مصنوعی بتواند مستقیماً به مرکز بینایی مغز (Visual Cortex) وصل
شود، دیگر نیازی نیست بگویید "یک غروب غمگین". هوش مصنوعی دقیقاً همان طیف رنگی و همان حس غمگینی که در نورونهای شما جریان دارد را بازسازی میکند. 2. پروژه "تلهپاتی": تکنولوژی Mind-to-Image چگونه کار میکند؟
شاید فکر کنید این جادوگری است، اما این علم محض است. مغز انسان هنگام تصور کردن یک سیب، الگوی الکتریکی خاصی تولید میکند. این الگو برای یک ماشین، فقط یک "دیتای رمزگذاری شده" است. مراحل تبدیل فکر به پیکسل:
دریافت سیگنال (EEG/fMRI): امواج مغزی توسط سنسورها خوانده میشود. دیکد کردن (Decoding): یک مدل هوش مصنوعی (مثل Stable Diffusion) یاد میگیرد که کدام الگوی مغزی مربوط به کدام تصویر است. بازسازی (Reconstruction):
هوش مصنوعی نویزهای مغزی را به تصویر واضح تبدیل میکند. شایعات میگویند میدجرنی در حال همکاری با استارتاپهای نوروتک (Neurotech) است تا مدلی بسازد که بتواند این سیگنالها را به عنوان "پرامپت ورودی" بپذیرد.
3. شواهد علمی: وقتی هوش مصنوعی ذهن را خواند این ایده فقط تئوری نیست. در سال ۲۰۲۳، محققان دانشگاه ملی سنگاپور و دانشگاه هنگکنگ با استفاده از دستگاه fMRI و مدل هوش مصنوعی MinD-Vis توانستند تصاویری که افراد
به آنها نگاه میکردند را با دقت ۸۵٪ بازسازی کنند. وقتی سوژه به عکس یک گربه نگاه میکرد، هوش مصنوعی بدون دیدن عکس، یک گربه ترسیم کرد. میدجرنی v7 احتمالاً اولین محصول تجاری خواهد بود که سعی میکند نسخهای
ادامه مطلب در سایت