حوزه تولید تصویر با هوش مصنوعی شاهد یک ارتقای بزرگ دیگر است. غول تولید تصویر با هوش مصنوعی، میدجرنی، اخیراً از راهاندازی اولین مدل ویرایش تصویر V8.2 خود برای تست عمومی خبر داده است. این بهروزرسانی با هدف شکستن محدودیتهای قبلی در تولید صرفاً متنی تصاویر، قابلیتهای جدیدی مانند تنظیم دقیق دستورالعمل، ارجاع چند تصویر و بازسازی موضعی (inpainting) را ادغام کرده است.
قابلیتهای کلیدی مدل ویرایش تصویر میدجرنی V8.2
مدل جدید V8.2 میدجرنی، تجربه خلاقانهتری را برای کاربران فراهم میکند. این مدل بر خلاف نسخههای قبلی که تنها بر اساس متن تصویر تولید میکردند، اکنون امکان ویرایش دقیقتر و کنترلشدهتر را ارائه میدهد. قابلیتهای اصلی این بهروزرسانی عبارتند از:
- ویرایش قدرتمند با دستورالعمل: کاربران میتوانند با استفاده از دستورات متنی، تصاویر موجود را مستقیماً ویرایش کنند.
- ارجاع چند تصویر: مکانیزم جدیدی برای ارجاع همزمان حداکثر چهار تصویر، جایگزین کامل ارجاع پانورامای قبلی شده است.
- بازسازی و گسترش بوم: قابلیتهای بازسازی موضعی (inpainting) و گسترش بوم (outpainting) امکان تنظیم دقیق جزئیات و افزایش ابعاد تصویر را بهراحتی فراهم میکند.
- سازگاری کامل با تنظیمات شخصی: این نسخه با تنظیمات شخصی، مودبوردها و ارجاعات سبکی (srefs) سازگاری کامل دارد.
نحوه استفاده از مدل جدید
برای تسهیل گردش کار کاربران، روشهای مختلفی برای استفاده از این مدل در نظر گرفته شده است. کاربران میتوانند تصویر را مستقیماً در جعبه ورودی پرامپت بکشند و گزینه “Attach to Prompt” را انتخاب کنند. همچنین امکان ویرایش از طریق دکمه “Edit” در گوشه پایین سمت راست پیشنمایش یا بارگذاری تصویر از طریق تب “Edit” در نوار ناوبری چپ وجود دارد. فراخوانی مستقیم مدل با وارد کردن دستورات در کانال دیسکورد نیز پشتیبانی میشود.
بهبود رابط کاربری و جمعآوری بازخورد
وبسایت رسمی میدجرنی و سایت تست alpha.midjourney.com نیز بهروزرسانی شدهاند. این نسخه در مراحل اولیه تست قرار دارد و رابط کاربری آن به دلیل بهینهسازیهای آزمایشی مکرر، بهسرعت تغییر خواهد کرد. تیم توسعه میدجرنی از کاربران خواسته است تا در صورت مواجهه با چالشها یا نتایج غیرمنتظره، از طریق ایموجیها، شناسه تسک (task ID) یا کانالهای ارتباطی رسمی، بازخورد خود را به اشتراک بگذارند.
