Majid Ghorbaninazhad

پایان عصر کیبورد و پرامپت: میدجرنی v7 و شایعه قابلیت ترسناک «تبدیل فکر به تصویر» (Mind-to-Image)؛ آیا ماتریکس واقعی می‌شود؟

تحلیل علمی و شایعات درباره Midjourney v7 و تکنولوژی تبدیل فکر به تصویر، با بررسی همکاری‌های نوروتک و امکانات جدید.

1. چرا زبان برای هنر کافی نیست؟ (مشکل پرامپت‌ها) زبان انسان، ابزاری خطی و محدود است. یک تصویر هزار کلمه است، اما ما مجبوریم آن را در ۵۰ کلمه پرامپت خلاصه کنیم. در نسخه‌های فعلی (v6)، ما یاد گرفته‌ایم با

"زبان ماشین" صحبت کنیم: --ar 16:9 --stylize 500 . این مهندسی است، نه هنر خالص. فلسفه پشت Midjourney v7 این است که "واسطه" را حذف کند. اگر هوش مصنوعی بتواند مستقیماً به مرکز بینایی مغز (Visual Cortex) وصل

شود، دیگر نیازی نیست بگویید "یک غروب غمگین". هوش مصنوعی دقیقاً همان طیف رنگی و همان حس غمگینی که در نورون‌های شما جریان دارد را بازسازی می‌کند. 2. پروژه "تله‌پاتی": تکنولوژی Mind-to-Image چگونه کار می‌کند؟

شاید فکر کنید این جادوگری است، اما این علم محض است. مغز انسان هنگام تصور کردن یک سیب، الگوی الکتریکی خاصی تولید می‌کند. این الگو برای یک ماشین، فقط یک "دیتای رمزگذاری شده" است. مراحل تبدیل فکر به پیکسل:

دریافت سیگنال (EEG/fMRI): امواج مغزی توسط سنسورها خوانده می‌شود. دی‌کد کردن (Decoding): یک مدل هوش مصنوعی (مثل Stable Diffusion) یاد می‌گیرد که کدام الگوی مغزی مربوط به کدام تصویر است. بازسازی (Reconstruction):

هوش مصنوعی نویزهای مغزی را به تصویر واضح تبدیل می‌کند. شایعات می‌گویند میدجرنی در حال همکاری با استارتاپ‌های نوروتک (Neurotech) است تا مدلی بسازد که بتواند این سیگنال‌ها را به عنوان "پرامپت ورودی" بپذیرد.

3. شواهد علمی: وقتی هوش مصنوعی ذهن را خواند این ایده فقط تئوری نیست. در سال ۲۰۲۳، محققان دانشگاه ملی سنگاپور و دانشگاه هنگ‌کنگ با استفاده از دستگاه fMRI و مدل هوش مصنوعی MinD-Vis توانستند تصاویری که افراد

به آن‌ها نگاه می‌کردند را با دقت ۸۵٪ بازسازی کنند. وقتی سوژه به عکس یک گربه نگاه می‌کرد، هوش مصنوعی بدون دیدن عکس، یک گربه ترسیم کرد. میدجرنی v7 احتمالاً اولین محصول تجاری خواهد بود که سعی می‌کند نسخه‌ای

ادامه مطلب در سایت