ملٹی موڈل
AIEZZ ٹول ٹیگ
“ملٹی موڈل” ٹیگ والی اے آئی مصنوعات دیکھی جا رہی ہیں؛ 5 مماثل نتائج ہیں۔
ShieldstralAI سوال و جوابShieldstral – Mistral AI کا اوپن سورس ملٹی موڈل مواد کی حفاظت کا درجہ بند ماڈل، Mistral AI کا تیار کردہ 3B پیرامیٹرز پر مشتمل اوپن سورس ملٹی موڈل مواد کی حفاظت کا درجہ بند ماڈل ہے، جو Ministral-3B پر مبنی ہے۔ یہ ماڈل روایتی مقررہ زمروں پر مبنی مواد کی جانچ کو بائنری سوال و جواب کے کام میں تبدیل کرتا ہے، قدرتی زبان کے سوالات کے ذریعے حقیقی وقت میں جانچ کی پالیسیاں متعین کرنے کی سہولت دیتا ہے، اور دوبارہ تربیت کے بغیر مختلف حالات کے مطابق ڈھل سکتا ہے۔ ماڈل نے متنی حفاظتی بینچ مارک پر اوسط F1 اسکور 84.9% اور ملٹی موڈل حفاظت پر F1 اسکور 83.8% حاصل کیا، دونوں SOTA ہیں۔ اسے صرف ایک 16GB GPU پر تعینات کیا جا سکتا ہے اور یہ 12 زبانوں کو سپورٹ کرتا ہے۔ بنیادی خصوصیات میں پالیسی کے مطابق ڈھلنے والی جانچ، ملٹی موڈل متحدہ شناخت، خلاف ورزیوں کی باریک سطح پر شناخت، کیلیبریٹڈ حفاظتی اسکورنگ اور ہلکی پھلکی اینڈ ڈیوائس تعیناتی شامل ہیں۔ یہ سوشل پلیٹ فارم کے مواد کے خطرے کے کنٹرول، AI گفتگو کے حفاظتی تحفظ، اشتہارات اور مارکیٹنگ کی تعمیل، آن لائن تعلیمی مواد کی فلٹرنگ اور کاروباری دستاویزات کے حفاظتی آڈٹ جیسے حالات کے لیے موزوں ہے۔00
HOMIEAI ویڈیو جنریشنHOMIE ہانگ کانگ یونیورسٹی آف سائنس اینڈ ٹیکنالوجی کا اوپن سورس ڈیجیٹل ہیومن ویڈیو جنریشن فریم ورک ہے، جو Wan2.1-T2V-14B بیک بون نیٹ ورک پر مبنی ہے اور Qwen3-VL ملٹی موڈل بڑے ماڈل کو مربوط کرتا ہے۔ یہ فریم ورک ڈیجیٹل انسان، مصنوعات، Logo اور متن کے چار عناصر کو یکجا طور پر ہینڈل کرتا ہے، ...00
SenseNova U1.5-Lite-Preview – شانتانگ کا اوپن سورس ہلکا پھلکا ملٹی موڈل ماڈلAI بڑا ماڈلSenseNova U1.5-Lite-Preview – شانتانگ کا اوپن سورس ہلکا پھلکا ملٹی موڈل ماڈل NEO-Unify آرکیٹیکچر پر مبنی ہے اور 8B-MoT پیرامیٹرز کے ذریعے بصری فہم، استدلال، جنریشن اور ایڈیٹنگ کو مقامی طور پر یکجا کرتا ہے۔ ماڈل مقامی طور پر 4K الٹرا ہائی ڈیفینیشن تصاویر تیار کرتا ہے، باریک ساخت، حقیقی احساس اور چینی و انگریزی میں پیچیدہ لے آؤٹ کے متن کی رینڈرنگ کی صلاحیت رکھتا ہے۔ اس میں Prompt Enhance Skill شامل ہے، جو تخلیق کی رکاوٹ کم کرتا ہے، طویل قدرتی زبان اور ساختی بصری ہدایات کو درست طور پر نافذ کرتا ہے اور مسلسل تکراری ایڈیٹنگ کی معاونت فراہم کرتا ہے۔ ڈیزائنرز، ڈویلپرز اور مواد تخلیق کاروں کے لیے یہ کم تعیناتی لاگت اور اعلیٰ ہدایات پر عمل درآمد کے ساتھ تجارتی معیار کا بصری تخلیقی ٹول فراہم کرتا ہے۔10
MAGI-2-preview – Sand.ai کا اوپن سورس ملٹی موڈل ویڈیو جنریشن ماڈلAI ویڈیو جنریشنMAGI-2-preview – Sand.ai کا اوپن سورس ملٹی موڈل ویڈیو جنریشن ماڈل، Sand.ai کا اوپن سورس دنیا کا پہلا ایک سو ارب پیرامیٹرز والا MoE ملٹی موڈل ویڈیو جنریشن ماڈل ہے، جس کے کل پیرامیٹرز 114B اور فعال پیرامیٹرز صرف 6B ہیں۔ یہ ماڈل سنگل اسٹریم آرکیٹیکچر کو برقرار رکھتے ہوئے متن، ویڈیو اور آڈیو کو ایک ہی Transformer میں متحد کر کے مشترکہ ماڈلنگ کرتا ہے، جس سے مقامی ملٹی موڈل جنریشن ممکن ہوتی ہے۔ اس کی بنیادی خصوصیات میں متن، تصویر اور ویڈیو سے ویڈیو جنریشن، نیز آڈیو کی تفہیم کا مقامی انضمام شامل ہے، جبکہ MoE کی sparse activation کے ذریعے inference کی لاگت نمایاں طور پر کم کی جاتی ہے۔ اس کا ہدف AI محققین، ڈویلپرز اور کاروباری ٹیکنالوجی ٹیمیں ہیں۔ یہ علمی تحقیق، نجی تعیناتی اور ملٹی موڈل فلم و ٹی وی پری ویژولائزیشن جیسے منظرناموں کے لیے موزوں ہے، اور اوپن سورس، تجارتی استعمال کے قابل مؤثر ویڈیو جنریشن حل فراہم کرتا ہے۔00
Hunyuan3D-Buffalo 1.0 – Tencent Hunyuan کا 3D ملٹی موڈل فریم ورک3D ڈیزائنHunyuan3D-Buffalo 1.0 – Tencent Hunyuan کا 3D ملٹی موڈل فریم ورک، Tencent Hunyuan کا تیار کردہ متحدہ 3D ملٹی موڈل فریم ورک ہے، جو مشترکہ Hunyuan3D-VLM بنیادی ماڈل کے ذریعے 3D سوال و جواب، مکانی تعیین، متن سے 3D تخلیق، ہدایتی تدوین اور پرزوں کی تخلیق کو ایک ہی عمل میں یکجا کرتا ہے۔ یہ فریم ورک قدرتی زبان کے ذریعے 3D ماڈل کی ساخت سمجھنے، پرزوں کی تعیین، ہدایات کے مطابق مقامی جیومیٹری میں ترمیم اور معنوی سطح کے پرزے اخذ کرنے کی سہولت دیتا ہے۔ اس کا مقصد 3D تفہیم، تخلیق اور تدوین کے مکمل چکر کو مربوط کرنا اور گیمز، اینیمیشن اور صنعتی ڈیزائن کے لیے قابلِ ترکیب 3D اثاثہ سازی کا حل فراہم کرنا ہے۔ بنیادی خصوصیات میں 3D تفہیم، متن سے 3D تخلیق، ہدایتی تدوین اور پرزوں کی تخلیق شامل ہیں، جبکہ چاروں اقسام کے کام ایک ہی 3D معنوی نمائندگی اور پراسیسنگ پائپ لائن استعمال کرتے ہیں۔ یہ گیم ڈویلپرز، اینیمیشن سازوں، صنعتی ڈیزائنرز اور 3D مواد تخلیق کاروں کے لیے موزوں ہے؛ قدرتی زبان کے ذریعے پیشہ ورانہ مہارت کی ضرورت کم ہوتی ہے اور اثاثوں کے دوبارہ استعمال اور تکراری بہتری کی کارکردگی بڑھتی ہے۔00اس ٹیگ والے تمام ٹولز دکھائے گئے ہیں۔
