پہلی بار جب کسی نے مجھ سے "ہمیں ایک ساتھ Photoshop کر دیں" کہا، تو وہ 2019 تھا۔ Pasadena کی ایک دلہن، منگیتر ورک ویزا کی الجھن میں Manila میں پھنسا ہوا، شادی میں چھ ہفتے باقی اور کوئی منگنی کی تصویریں نہیں۔ اُس نے مجھے — ایک پیشہ ور پورٹریٹ شوٹر — اِس لیے ادائیگی کی کہ دونوں کی ایک اچھی تصویر بناؤں تاکہ اُس کے والدین اِسے دیوار پر لگا سکیں۔
میں نے اِس پر چار گھنٹے صرف کیے۔ ہاتھ غلط تھے۔ اُس کے چہرے پر روشنی 5500K تھی اور اُس کی 3200K۔ مجھے یاد ہے رات 2 بجے فائل کو گھورتے ہوئے سوچ رہی تھی: یہ اگلی دہائی کی سب سے عام درخواست ہوگی، اور تقریباً کوئی نہیں جانتا کہ اِسے کیسے کرنا ہے۔
میں طلب کے بارے میں درست تھی۔ میں اِس بارے میں غلط تھی کہ کون کرے گا۔ چھ سال بعد میں DuoPortrait چلاتی ہوں، جو دراصل اُس 2019 کی رات 2 بجے کی فائل کا چھوٹا اسٹوڈیو ورژن ہے، سوائے اِس کے کہ AI چالیس سیکنڈ میں وہ کرتا ہے جس میں مجھے چار گھنٹے لگے، اور یہ ہاتھ مجھ سے بہتر بناتا ہے۔
یہ ہے جو میں دراصل جانتی ہوں کہ جوڑے کی تصویر کیسے بنائی جائے جب دونوں افراد کبھی ایک ہی کمرے میں نہ رہے ہوں — دستی طریقے سے بھی اور AI کی مدد سے بھی۔
تقریباً ہر "ایک ساتھ Photoshop کی گئی" تصویر غلط کیوں لگتی ہے
جب آپ دو افراد کی حقیقی تصویر دیکھتے ہیں، تو آپ کی آنکھ تین چیزیں پڑھ رہی ہوتی ہے جنہیں آپ آسانی سے جعلی نہیں بنا سکتے:
- روشنی دونوں چہروں پر ایک جیسی ہے۔ وہی رنگ کا درجہ حرارت، وہی سمت، وہی نرمی۔ دو چہروں کے درمیان وائٹ بیلنس میں 1°C کی تبدیلی "غلط" کے طور پر پڑھی جاتی ہے چاہے آپ وجہ بتا نہ سکیں۔
- نظر کی سمتیں ایک ہی کمرے سے تعلق رکھتی ہیں۔ قریب کھڑے دو افراد دونوں سیدھے لینس میں نہیں دیکھتے — ایک عام طور پر تین سے آٹھ ڈگری زاویے پر ہوتا ہے۔ اگر دونوں افراد iPhone سیلفی موڈ میں کھینچے گئے ہوں، تو دونوں کی نظریں سیدھی کیمرے کی طرف آتی ہیں اور نتیجہ ایک yearbook لے آؤٹ جیسا محسوس ہوتا ہے۔
- جلد کے رنگ ہم آہنگ ہیں۔ مختلف ذرائع سے روشن ہونے والے دو چہرے جلد کو مختلف طور پر دکھاتے ہیں۔ cyan-magenta محور قاتل ہے — زیادہ تر شوقیہ کمپوزٹس میں ایک شخص گرم-magenta ہوتا ہے اور دوسرا ٹھنڈا-cyan، اور آپ اِسے "یہ حقیقی نہیں" کے طور پر شعوری طور پر پروسیس کرنے سے پہلے پڑھ لیتے ہیں۔
جب میں منگنی-تصویر کی ورکشاپس پڑھاتی تھی، تو پورا نصاب اِسی میں سمٹ جاتا تھا: ایک جیسی روشنی، ایک جیسی نظر، ایک جیسی جلد۔
دستی لمبی دوری کا ورک فلو (جب AI کوئی آپشن نہ ہو)
اگر آپ کو یہ AI کے بغیر کرنا ہو — کسی کام کے لیے، کسی پورٹ فولیو ٹکڑے کے لیے، کسی ایسے شخص کے لیے جو اصرار کرتا ہے — تو یہ وہ ضبط ہے جو میں استعمال کرتی تھی:
مرحلہ 1۔ پہلے منظر چنیں، افراد نہیں۔ کسی بھی شخص سے سیلفی کھینچنے کو کہنے سے پہلے اپنا پس منظر اور روشنی کی سمت چنیں۔ انہیں بتائیں: "ہم ایک اتوار کی صبح، باورچی خانے کی کھڑکی کی روشنی کا ہدف رکھ رہے ہیں، آپ دائیں طرف تین چوتھائی بائیں دیکھتے ہوئے۔" اِس کے بغیر، آپ کو دو غیر متعلق تصویریں اور ایک مسئلہ ملتا ہے۔
مرحلہ 2۔ انہیں دن کے ایک ہی وقت پر کھینچنے دیں۔ اگر آپ شخص A کو "شام 4 بجے کھینچیں" اور شخص B کو "صبح 9 بجے کھینچیں" کہیں، تو اُن کی کھڑکیوں کے باہر آسمان کا رنگ مختلف ہوتا ہے، اندرونی incandescent بھرائی کی گرماہٹ مختلف ہوتی ہے، اور آپ انہیں ایک ساتھ لانے میں گھنٹے صرف کریں گے۔ میں دونوں افراد سے کہتی ہوں کہ اگر اُن کے ٹائم زون اجازت دیں تو تیس منٹ کے وقفے کے اندر کھینچیں۔
مرحلہ 3۔ ایک ہی کیمرہ، مثالی طور پر۔ دو مختلف فون سینسر جلد کو مختلف طور پر دکھاتے ہیں — Pixel کی جلد iPhone کے مقابلے میں مشہور طور پر سرخ کی طرف مائل ہوتی ہے، اور iPhone کا کمپیوٹیشنل HDR midtones کو ایسے ہموار کرتا ہے جو pro موڈ میں کھینچے گئے ایک فلیگ شپ Android شاٹ سے میل نہیں کھاتا۔ اگر آپ ایک ہی فون استعمال نہیں کر سکتے، تو دونوں کو 5200K پر دستی وائٹ بیلنس پر لاک کریں اور RAW میں کھینچیں۔
مرحلہ 4۔ پس منظر افراد سے زیادہ اہم ہے۔ میں پس منظر کا پلیٹ الگ سے کھینچتی ہوں، ایک حقیقی مقام پر، حقیقی لینس کمپریشن کے ساتھ (ایک 85mm مساوی)۔ افراد کو کاٹ کر اُس پلیٹ میں رکھا جاتا ہے، کسی عام gradient کے سامنے کھڑے ہونے کے بجائے۔ یہی ایک گُر "Photoshop کے کام" کو ایک قابلِ یقین تصویر سے الگ کرتا ہے۔
مرحلہ 5۔ آخر میں grain کو میچ کریں۔ دونوں چہروں پر وہی noise پیٹرن وہی شدت پر لگایا جاتا ہے۔ اِس کے بغیر، ایک چہرہ 2024 کے فون اسنیپ جیسا لگتا ہے اور دوسرا 1998 کے چھٹیوں کے پرنٹ جیسا، چاہے آپ نے باقی سب کچھ درست کر لیا ہو۔
یہ تقریباً ایک چھ گھنٹے کا کام ہے، فی تصویر، اچھی طرح کیا گیا۔ میں نے 2020 میں $400 لیے اور یہ ایمانداری سے محنت کے لحاظ سے کم قیمت تھا۔
AI نے کیا بدلا (اور کیا نہیں)
ماڈلز کی وہ قسم جو اچھے جوڑے-تصویر synthesis کو طاقت دیتی ہے وہ InstantID / PuLID نسب ہے — شناخت محفوظ رکھنے والا diffusion۔ آپ اِسے فی شخص ایک حوالہ چہرہ، علاوہ ایک ہدف منظر دیتے ہیں، اور یہ ایک ایسی تصویر بناتا ہے جس میں دونوں چہرے قابلِ شناخت طور پر اصل افراد ہیں، نئے منظر کے اندر مستقل طور پر pose اور روشن کیے گئے۔
یہ 2026 تک دراصل کیا اچھا کرتا ہے:
- روشنی کا انسجام حل ہو گیا۔ ماڈل دونوں چہروں کو ایک ہی ذریعے سے روشن کرتا ہے کیونکہ یہ آپ کے دو embeddings کے گرد صفر سے ایک واحد تصویر بنا رہا ہے، دو کٹ آؤٹس کو چپکا نہیں رہا۔
- نظر کی سمتیں حل ہو گئیں۔ ماڈل جانتا ہے کہ پھولوں کے اسٹال کے پاس کھڑے دو افراد کہاں دیکھ رہے ہیں۔ آپ کو انہیں ہدایت دینے کی ضرورت نہیں۔
- جلد کے رنگ ہم آہنگ ہیں۔ وہی diffusion، وہی رنگ سائنس۔
AI اب بھی کیا حل نہیں کرتا:
- ہاتھوں میں ہاتھ تھامنا۔ اگر پرامپٹ اِسے مانگے، تو آپ کو ہاتھ ملتے ہیں۔ وہ 2026 میں عام طور پر ٹھیک ہوتے ہیں، لیکن پرنٹ کرنے سے پہلے انگلیاں اور انگوٹھیاں چیک کریں۔
- لمبے اور چھوٹے جوڑوں پر بال-سے-کندھے کی جیومیٹری۔ ماڈلز اپنے دو افراد کو تقریباً ایک جیسی قد کا ترجیح دیتے ہیں۔ اگر آپ میں سے ایک 195cm ہے اور دوسرا 152cm، تو آپ کو چند جنریشنز ملیں گی جو قد کو دھندلا کرتی ہیں۔ بس دوبارہ بنائیں۔
- لباس کی وفاداری۔ ماڈل لباس ایجاد کرے گا جب تک آپ اِنہیں بیان نہ کریں۔ یہ بعض اوقات ایک خصوصیت ہے — نیچے لباس کے اصول دیکھیں۔
لمبی دوری کی شوٹ کے لیے لباس کے اصول (دستی یا AI)
دونوں افراد کو ایسا لگنا چاہیے جیسے انہوں نے ایک ہی شام کے لیے تیار ہوئے ہوں۔ یہ سب سے بڑی نشانی ہے جب جوڑے کی تصویر غلط محسوس ہوتی ہے:
- دو یا تین رنگوں کا پیلیٹ چنیں، میچنگ لباس نہیں۔ کریم + camel + navy ناقابلِ شکست ہے۔
- دونوں افراد پر خالص سفید قمیض سے گریز کریں — سفید مختلف جلد کے رنگوں کے خلاف مختلف طور پر بھڑک جاتا ہے اور آپ کو "یونیفارم" والا تاثر ملتا ہے۔
- لوگوز سے گریز کریں۔ ماڈل اِنہیں hallucinate کرے گا؛ دستی ترمیم اِن سے لڑے گی۔
- ساخت رنگ سے زیادہ اہم ہے۔ ایک لینن، ایک knit، ایک کاٹن — یہ امتزاج ہمیشہ ایک-ساتھ-کھینچا-گیا کے طور پر پڑھا جاتا ہے، چاہے رنگ مختلف ہوں۔
میں نے ساخت کا اصول کسی styling کتاب سے زیادہ Magnum Photos آرکائیو سے سیکھا۔ عظیم جوڑے پورٹریٹس دیکھیں — Capa کے، Arnold کے، Bresson کے — اور افراد رنگ میں تقریباً کبھی میچ نہیں کرتے لیکن ہمیشہ کپڑے کے وزن میں ہم آہنگ ہوتے ہیں۔
AI کب درست انتخاب ہے اور کب نہیں
ایماندارانہ جواب، اِس کے دونوں اطراف پر چھ سال کے بعد:
AI درست ہے جب تصویر بصورتِ دیگر موجود نہ ہوتی۔ مختلف براعظموں پر لمبی دوری کے ساتھی۔ وہ دوست جو رابطہ کھو بیٹھے اور ایک اچھی یاد چاہتے ہیں۔ ایک دادی/نانی اور وہ پوتا/نواسا جو اُن کے گزرنے کے بعد پیدا ہوا۔ یہ ایسی تصویریں ہیں جو دنیا پیدا نہیں کر سکتی تھی؛ انہیں سافٹ ویئر سے پیدا کرنا کوئی اخلاقی سمجھوتہ نہیں، یہ ایک چھوٹی سی رحمت ہے۔
AI غلط ہے جب آپ صرف سفر کر سکتے ہوں۔ اگر آپ ایک ہی ملک میں ہیں اور ہفتے کو ایک دوسرے کے پاس گاڑی چلا کر جا سکتے ہیں — جائیں۔ ایک حقیقی دوپہر کی حقیقی تصویر ہمیشہ بہترین synthesis سے بہتر ہوتی ہے۔ میں آپ کو یہ ایک AI تصویر اسٹوڈیو کی بانی کے طور پر بتاؤں گی کیونکہ یہ سچ ہے۔
اگر آپ اِسے آزمانا چاہتے ہیں
اگر اِس موسم میں حقیقی شوٹ ممکن نہ ہو، تو DuoPortrait خاص طور پر اِسی صورت کے لیے بنایا گیا ہے۔ فی شخص ایک سیلفی اپلوڈ کریں، ایک اسٹائل چنیں (بہار میں کیوٹو میری ذاتی پسندیدہ ہے — Fuji 400H grain، نرم bokeh، ناقص سورس تصویروں کے لیے بہت معاف کرنے والا)، اور آپ کے پاس ایک منٹ سے کم میں کچھ قابلِ پرنٹ ہوگا۔ پہلی تصویر مفت ہے؛ ہم سورس فائلیں سات دن بعد حذف کر دیتے ہیں؛ ہم کبھی آپ کے چہروں پر تربیت نہیں کرتے۔
اِس کہانی کے آغاز کی 2019 کی دلہن — میں نے ویزا صاف ہونے کے بعد 2020 میں اُس کی حقیقی شادی کھینچی۔ اُس کے پاس اب بھی چار گھنٹے کا Photoshop پرنٹ اُس کے دالان میں، حقیقی شادی کی تصویر کے ساتھ فریم شدہ ہے۔ وہ کہتی ہے کہ جعلی والی وہ ہے جسے اُس کے والدین ہمیشہ سب سے پہلے دیکھتے ہیں۔
Mia Tanaka ایک پورٹریٹ فوٹوگرافر سے بصری-AI ڈیزائنر بنیں جو Los Angeles میں مقیم ہیں۔ وہ DuoPortrait کی بانی ہیں۔
