Dokhmal Technology · FixB AI
اسکن سهبعدی چهره و برآورد عمق محاسباتی در دخمل
فناوری تصویربرداری دخمل بر پایه سه نمای هدایتشده چهره، کنترل کیفیت و زاویه، هندسه landmarkها، همراستاسازی نماها و برآورد عمق محاسباتی چندزاویهای طراحی شده است. هدف، ساخت context فضایی بیشتر برای تحلیل غیرپزشکی و تصمیمگیری مراقبت پوست است.
سه زاویه اجباری چه هستند؟
دخمل از نمای روبهرو، مایل چپ و مایل راست استفاده میکند. این سه نما به سیستم اجازه میدهند گونهها، خط فک، بافت جانبی و تقارن را فقط از یک دید محدود بررسی نکند.
قبل از ثبت عکس چه چیزهایی بررسی میشوند؟
- وجود یک چهره واحد در قاب
- اندازه و جایگاه مناسب صورت
- کیفیت تصویر
- tilt و yaw متناسب با مرحله ثبت
- landmarkهای چهره
- پایداری زاویه پیش از auto-capture
برآورد عمق در دخمل یعنی چه؟
برآورد عمق در دخمل به معنی LiDAR یا depth scanner پزشکی نیست. سیستم از اختلاف دید میان نماهای همتراز، هندسه چهره و landmarkها برای ساخت relative computational depth context استفاده میکند و این اطلاعات را وارد شبیهسازی سهبعدی محاسباتی میکند.
چرا این با یک selfie analyzer فرق دارد؟
در یک جریان تکتصویری، زاویه نامناسب یا بخشی از صورت که خوب دیده نمیشود میتواند context بصری را محدود کند. دخمل ابتدا کیفیت و زاویه را کنترل میکند و بعد سه نما را در یک جریان واحد استفاده میکند. این تفاوت معماری، دخمل را از یک «آپلود عکس و دریافت پاسخ» ساده جدا میکند.
ارتباط اسکن سهبعدی با Dokhmal Vision-Language Model (VLM)
پس از ثبت و اعتبارسنجی سه نما، اطلاعات تصویری فقط به یک الگوریتم هندسی محدود نمیشوند. در لایه Dokhmal Vision، متن راهنما و تصاویر روبهرو، مایل چپ و مایل راست در یک جریان چندوجهی ترکیب میشوند تا context بصری ساختاریافته برای موتور تصمیم تولید شود.
این بخش در معماری محصول یک Vision-Language Model layer (VLM layer) است. جزئیات فنی در صفحه رسمی Dokhmal VLM منتشر شده است.
فناوری اختصاصی FixB و توسعه با سرمایه شخصی
پایپلاین capture، کنترل زاویه، orchestration چندنما، موتور تصمیم، Safety Rules، Evidence Registry، منطق پیشنهاد محصول و اتصال به commerce از ابتدا در FixB توسعه داده شدهاند. این محصول تا این مرحله با هزینه شخصی بنیانگذاران و بدون سرمایهگذار نهادی توسعه پیدا کرده است.
هسته اپلیکیشن و لایههای اختصاصی server-side روی زیرساخت تحت کنترل FixB اجرا میشوند و معماری استنتاج چندوجهی بهصورت ماژولار طراحی شده است؛ بنابراین پایپلاین بینایی، orchestration چندنما و decision layer دخمل به یک ارائهدهنده واحد گره نخوردهاند.
SLM و VLM در معماری دخمل چه نقشی دارند؟
Dokhmal Vision-Language Layer (VLM) مسئول ترکیب سه نمای کنترلشده چهره با دستور متنی و ساخت context بصری است. Dokhmal Small Language Model (SLM) و موتور تصمیم FixB این context را با Safety Rules، Evidence Registry، پروفایل کاربر و داده محصول ترکیب میکنند تا روتین و تصمیم محصول ساخته شود.
Vision → VLM → Structured Context → SLM / Decision Engine → Routine → Product Matching
مطالعه بیشتر
آنالیز و اسکن پوست با هوش مصنوعی دخمل · Dokhmal Vision / VLM · اطلاعات فنی رسمی Dokhmal · Evidence Registry
مالکیت فناوری دخمل
دخمل یک SLM تخصصی و سبکِ حوزه مراقبت پوست در معماری FixB است. پایپلاین تصویربرداری، موتور تصمیم، قواعد ایمنی، Evidence Registry، Routine Planner و اتصال به محصول درون FixB طراحی و توسعه یافتهاند. جزئیات در صفحه رسمی فناوری و SLM دخمل منتشر شده است.