• صفحه اصلی
  • همه اخبار
  • تبلیغات تکناک
  • درباره ما
  • تماس با ما
اخبار تکنولوژی روز جهان و ایران
  • فناوری
    • اخبار هوش مصنوعی
    • رباتیک
    • اینترنت و شبکه
    • شبکه های اجتماعی
    • هوافضا
    • معماری
    • ورزش
    • رویداد ها
    • دوربین دیجیتال
  • کامپیوتر و موبایل
    • موبایل و تبلت
    • لپ تاپ و کامپیوتر
    • اپلیکیشن موبایل
    • نرم افزار
    • سخت افزار
    • ساعت هوشمند
    • مانیتور
    • اسپیکر و هدفون
    • سیستم عامل موبایل
    • سیستم عامل کامپیوتر
  • نقد و بررسی
    • بررسی موبایل و تبلت
    • کنسول بازی
    • بررسی لپ تاپ و کامپیوتر
    • قطعات کامپیوتر
    • نرم افزار
    • بررسی اسپیکر و هدفون
    • بررسی ساعت هوشمند
  • آموزش
    • سیستم عامل موبایل
    • سیستم عامل کامپیوتر
    • آموزش هوش مصنوعی
    • سخت افزار
  • اخبار ارز دیجیتال
    • قیمت لحظه ای ارز دیجیتال
    • ماشین حساب ارز دیجیتال
    • آموزش ارز دیجیتال
  • علمی
    • سلامت و پزشکی
    • انرژی
    • فیزیک
    • شیمی
    • نجوم
    • ورزش
    • محیط زیست
    • باستان شناسی
  • کسب و کار
    • شرکت ها
    • بورس
    • مدیریت(پروژه، کسب و کار، منابع انسانی)
    • استارتاپ ها
    • دولت الکترونیک
    • رویداد کسب و کار
  • وسائل نقلیه
    • خودرو
    • دوچرخه
    • موتور سیکلت
    • قطار
    • هواپیما
  • بازی و سرگرمی
    • کنسول بازی های کامپیوتری
    • بازی های کامپیوتر
    • بازی کنسول
    • بازی موبایل
    • فیلم و سریال
  • چند رسانه ای
    • عکس
    • ویدئو
  • اخبار داخلی
    • دانش بنیان
    • دولت الکترونیک
    • رویداد داخلی
    • بازار
    • دانشگاه
No Result
مشاهده تمامی نتایج
اخبار تکنولوژی روز جهان و ایران
  • فناوری
    • اخبار هوش مصنوعی
    • رباتیک
    • اینترنت و شبکه
    • شبکه های اجتماعی
    • هوافضا
    • معماری
    • ورزش
    • رویداد ها
    • دوربین دیجیتال
  • کامپیوتر و موبایل
    • موبایل و تبلت
    • لپ تاپ و کامپیوتر
    • اپلیکیشن موبایل
    • نرم افزار
    • سخت افزار
    • ساعت هوشمند
    • مانیتور
    • اسپیکر و هدفون
    • سیستم عامل موبایل
    • سیستم عامل کامپیوتر
  • نقد و بررسی
    • بررسی موبایل و تبلت
    • کنسول بازی
    • بررسی لپ تاپ و کامپیوتر
    • قطعات کامپیوتر
    • نرم افزار
    • بررسی اسپیکر و هدفون
    • بررسی ساعت هوشمند
  • آموزش
    • سیستم عامل موبایل
    • سیستم عامل کامپیوتر
    • آموزش هوش مصنوعی
    • سخت افزار
  • اخبار ارز دیجیتال
    • قیمت لحظه ای ارز دیجیتال
    • ماشین حساب ارز دیجیتال
    • آموزش ارز دیجیتال
  • علمی
    • سلامت و پزشکی
    • انرژی
    • فیزیک
    • شیمی
    • نجوم
    • ورزش
    • محیط زیست
    • باستان شناسی
  • کسب و کار
    • شرکت ها
    • بورس
    • مدیریت(پروژه، کسب و کار، منابع انسانی)
    • استارتاپ ها
    • دولت الکترونیک
    • رویداد کسب و کار
  • وسائل نقلیه
    • خودرو
    • دوچرخه
    • موتور سیکلت
    • قطار
    • هواپیما
  • بازی و سرگرمی
    • کنسول بازی های کامپیوتری
    • بازی های کامپیوتر
    • بازی کنسول
    • بازی موبایل
    • فیلم و سریال
  • چند رسانه ای
    • عکس
    • ویدئو
  • اخبار داخلی
    • دانش بنیان
    • دولت الکترونیک
    • رویداد داخلی
    • بازار
    • دانشگاه
No Result
مشاهده تمامی نتایج
اخبار تکنولوژی روز جهان و ایران

تک ناک » فناوری » اخبار هوش مصنوعی » استفاده از صدا برای مدل سازی جهان

استفاده از صدا برای مدل سازی جهان

صمد کردی نوشته شده توسط صمد کردی
سه شنبه 10 آبان 1401 - 12:15 - به‌روزشده در چهارشنبه 11 آبان 1401 - 20:34
در اخبار هوش مصنوعی, پیشنهاد سردبیر, فناوری
یک مدل یادگیری ماشینی می تواند انتشار هر صدایی در اتاق را در فضا ثبت کند و مدل میتواند با استفاده از صدا برای مدل سازی مکانی استفاده کند.
کپی لینکاشتراک گذاری در تلگراماشتراک گذاری در توییتر

محققان یک مدل یادگیری ماشینی ایجاد کردند که می تواند نحوه انتشار هر صدایی در اتاق را در فضا ثبت کند و این سیستم میتواند با استفاده از صدا برای مدل سازی هر فصایی را مدل سازی کند.

به گزارش تکناک، صدایی که یک بازدیدکننده کلیسای جامع می شنود تحت تأثیر عوامل زیادی قرار می گیرد، از جمله مکان ارگ، جایی که شنونده در آن ایستاده است، ستون ها، نیمکت ها یا موانع دیگری بین آنها قرار گرفته است، دیوارها از چه چیزی ساخته شده اند، مکان ها پنجره ها یا درها و غیره. شنیدن صدا می تواند به فرد کمک کند تا محیط خود را تصور کند.

محققان MIT و آزمایشگاه هوش مصنوعی واتسون MIT-IBM در حال بررسی استفاده از اطلاعات صوتی فضایی برای کمک به ماشین‌ها برای تجسم بهتر محیط خود هستند.

با مدل‌سازی دقیق آکوستیک یک صحنه، سیستم می‌تواند هندسه سه‌بعدی زیربنای یک اتاق را از ضبط صدا یاد بگیرد. محققان می توانند از اطلاعات صوتی گرفته شده توسط سیستم خود برای ساختن رندرهای بصری دقیق از یک اتاق استفاده کنند، مشابه نحوه استفاده انسان از صدا در هنگام تخمین ویژگی های محیط فیزیکی خود.

https://technoc.ir/wp-content/uploads/2022/11/room-1-speech-2_2.mp4

ییلون دو، دانشجوی مقطع کارشناسی ارشد در دپارتمان مهندسی برق و علوم کامپیوتر EECS و یکی از نویسندگان مقاله ای که مدل را توصیف می کند می گوید این تکنیک علاوه بر کاربردهای بالقوه‌اش در واقعیت مجازی و واقعیت افزوده، می‌تواند به عوامل هوش مصنوعی کمک کند تا درک بهتری از دنیای اطراف خود داشته باشند.

به عنوان مثال، یک ربات کاوشگر زیر آب با مدل‌سازی ویژگی‌های آکوستیک صدا در محیط خود، می‌تواند چیزهایی را که دورتر از آن تنها با بینایی است، حس کند.

دو اضافه می کند: بیشتر محققان تاکنون تنها بر روی مدل‌سازی بینایی تمرکز کرده‌اند. اما ما به عنوان انسان، ادراک چندوجهی داریم. نه تنها بینایی مهم است، صدا نیز مهم است. من فکر می‌کنم این کار یک مسیر تحقیقاتی هیجان‌انگیز را در مورد استفاده بهتر از صدا برای مدل‌سازی جهان باز می‌کند.

صدا و دید

در تحقیقات بینایی کامپیوتری، یک نوع مدل یادگیری ماشینی به نام مدل نمایش عصبی ضمنی برای ایجاد بازسازی های صاف و پیوسته صحنه های سه بعدی از تصاویر استفاده شده است. این مدل‌ها از شبکه‌های عصبی استفاده می‌کنند که حاوی لایه‌هایی از گره‌های به هم پیوسته یا نورون‌ها هستند که داده‌ها را برای تکمیل یک کار پردازش می‌کنند.

محققان MIT از همین نوع مدل برای ثبت چگونگی حرکت مداوم صدا در یک صحنه استفاده کردند.

اما آن‌ها دریافتند که مدل‌های بینایی از خاصیتی به نام سازگاری فتومتریک سود می‌برند که برای صدا اعمال نمی‌شود. اگر کسی از دو مکان مختلف به یک شی نگاه کند، آن شی تقریباً یکسان به نظر می رسد. اما با صدا، مکان را تغییر دهید و صدایی که می شنود می تواند به دلیل موانع، فاصله و غیره کاملاً متفاوت باشد. این امر پیش بینی صدا را بسیار دشوار می کند.

محققان با وارد کردن دو ویژگی آکوستیک در مدل خود بر این مشکل غلبه کردند: ماهیت متقابل صدا و تأثیر ویژگی‌های هندسی محلی.

صدا متقابل است، به این معنی که اگر منبع صدا و شنونده جای خود را عوض کنند، چیزی که شخص می شنود تغییری نمی کند. علاوه بر این، آنچه در یک منطقه خاص می شنود به شدت تحت تأثیر ویژگی های محلی است، مانند مانعی بین شنونده و منبع صدا.

برای گنجاندن این دو عامل در مدل خود، به نام میدان صوتی عصبی (NAF)، شبکه عصبی را با شبکه‌ای تقویت می‌کنند که اشیاء و ویژگی‌های معماری را در صحنه، مانند درها یا دیوارها، ثبت می‌کند. مدل به طور تصادفی از نقاط آن شبکه نمونه برداری می کند تا ویژگی ها را در مکان های خاص یاد بگیرد.

اگر تصور می‌کنید نزدیک دری ایستاده‌اید، آنچه که به شدت بر آنچه می‌شنوید تأثیر می‌گذارد وجود آن در است، نه لزوماً ویژگی‌های هندسی دور از شما در آن سوی اتاق. ما متوجه شدیم که این اطلاعات تعمیم بهتری را نسبت به یک شبکه کاملاً متصل ساده امکان پذیر می کند.

از پیش بینی صداها تا تجسم صحنه ها

محققان می‌توانند اطلاعات بصری NAF را در مورد یک صحنه و چند طیف‌نگار که نشان می‌دهند وقتی فرستنده و شنونده در مکان‌های مورد نظر در اطراف اتاق قرار دارند، صدای یک قطعه صدا را به NAF ارائه دهند. سپس مدل پیش‌بینی می‌کند که اگر شنونده به هر نقطه‌ای از صحنه حرکت کند، صدا چگونه خواهد بود.

NAF یک پاسخ ضربتی تولید می کند که نحوه تغییر صدا را در حین انتشار در صحنه نشان می دهد. سپس محققان این پاسخ ضربتی را به صداهای مختلف اعمال می کنند تا بشنوند که چگونه این صداها وقتی یک فرد در اتاقی قدم می زند تغییر کنند.

به عنوان مثال، اگر آهنگی از یک بلندگو در مرکز اتاق پخش می‌شود، مدل آن‌ها نشان می‌دهد که چگونه وقتی فردی به بلندگو نزدیک می‌شود، این صدا بلندتر می‌شود و سپس هنگام خروج به راهروی مجاور خاموش می‌شود.

وقتی محققان تکنیک خود را با روش‌های دیگری که اطلاعات صوتی را مدل‌سازی می‌کنند مقایسه کردند، تکنیک آنها در همه حالت ها مدل صوتی دقیق‌تری تولید کرد و چون اطلاعات هندسی محلی را یاد گرفت، مدل آنها توانست خیلی بهتر از روش های دیگر در مکان های جدید مورد استفاده قرار گیرد.

علاوه بر این، آنها دریافتند که استفاده از اطلاعات آکوستیکی آنها در یک مدل کامپیوتری تصویری می تواند منجر به بازسازی بصری بهتر صحنه شود.

برای مثال، وقتی شما فقط مجموعه‌ای از تصاویر کمی دارید، استفاده از صدا برای مدل سازی به شما امکان می‌دهد تا مرزها را با وضوح بیشتری ثبت کنید. و شاید به این دلیل باشد که برای ارائه دقیق آکوستیک یک صحنه، باید هندسه سه بعدی زیربنایی آن صحنه را ثبت کنید.

محققان قصد دارند به بهبود این مدل ادامه دهند تا بتواند به صحنه های کاملاً جدید تعمیم یابد. آنها همچنین می‌خواهند این تکنیک را برای پاسخ‌های ضربتی پیچیده‌تر و صحنه‌های بزرگ‌تر، مانند کل ساختمان‌ها یا حتی یک شهر یا شهر، به کار ببرند.

این تکنیک جدید ممکن است فرصت های جدیدی را برای ایجاد یک تجربه همهجانبه چندوجهی در برنامه متاورس ایجاد کند.

دینش منوچا، پروفسوراستاد علوم کامپیوتر و مهندسی برق و کامپیوتر در دانشگاه مریلند، که در این زمینه دخالتی نداشت، می‌گوید: این گروه کارهای زیادی روی استفاده از روش‌های یادگیری ماشینی برای تسریع شبیه‌سازی آکوستیک یا مدل‌سازی آکوستیک صحنه‌های دنیای واقعی انجام داده و نویسندگان این مقاله شامل چوانگ گان و همکارانش به وضوح یک گام به جلو در این مسیر برداشته اند.

این مقاله یک نمایش ضمنی خوب با استفاده از صدا برای مدل سازی را معرفی می‌کند که می‌تواند نحوه انتشار صدا در صحنه‌های دنیای واقعی را با مدل‌سازی آن با استفاده از یک سیستم خطی زمان ناپذیر، به تصویر بکشد. این اثر می تواند کاربردهای زیادی در AR/VR و همچنین درک صحنه های دنیای واقعی داشته باشد.

بخشی از این تحقیق توسط آزمایشگاه هوش مصنوعی MIT-IBM Watson و موسسه Tianqiao و Chrissy Chen پشتیبانی می‌شود.

صمد کردی

صمد کردی

دانش آموخته عمران،عکاس خبری سابق، علاقه‌مند به کامپیوتر

مطالب مرتبط

ماوس‌های حرفه‌ای می‌توانند به میکروفون جاسوسی تبدیل شوند
پیشنهاد سردبیر

ماوس‌های حرفه‌ای می‌توانند به میکروفون جاسوسی تبدیل شوند + ویدیو

نوشته شده توسط اسما کلهر
11 مهر 1404
چین نخستین دیتاسنتر تجاری زیرآب را راه‌اندازی می‌کند؛ کاهش ۹۰ درصدی مصرف انرژی برای خنک‌سازی
پیشنهاد سردبیر

چین نخستین دیتاسنتر تجاری زیرآب را راه‌اندازی می‌کند

نوشته شده توسط اسما کلهر
11 مهر 1404
بحران جهانی حافظه و ذخیره‌سازی زیر فشار هوش مصنوعی
فناوری

بحران جهانی حافظه و ذخیره‌سازی زیر فشار هوش مصنوعی

نوشته شده توسط اسما کلهر
11 مهر 1404
گلکسی S26 اج
پیشنهاد سردبیر

جزئیات جدید از پرچم‌دار آینده سامسونگ؛ هر آنچه از گلکسی S26 اج می‌دانیم + تصویر

نوشته شده توسط اسما کلهر
11 مهر 1404
توپ جام جهانی ۲۰۲۶
پیشنهاد سردبیر

آدیداس از توپ رسمی جام جهانی ۲۰۲۶ پرده‌برداری کرد + تصویر

نوشته شده توسط امیرحسین یونس
11 مهر 1404
خبر بعدی
انسان‌ها یک قدم به صحبت با حیوانات نزدیک‌تر شده‌اند، زیرا فناوری‌های جدید به روبات‌های اجازه می‌دهند با گونه‌های مختلف صحبت کنند.

انسان یک گام دیگر به صحبت با حیوانات نزدیک شد

دیدگاهتان را بنویسید لغو پاسخ

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

آذرآنلاین آذرآنلاین آذرآنلاین

پیشنهادی

تمسخر آیفون ۱۷

آیفون ۱۷ اپل اسباب تمسخر سامسونگ را فراهم کرد

19 شهریور 1404
سامسونگ SmartThings

با SmartThings سامسونگ ماشین را روشن و در را قفل کنید

4 مهر 1404 - به‌روزشده در 5 مهر 1404

داغ‌ترین‌های روز

نحوه فعال سازی eSIM همراه اول + ویدیو

نحوه فعال سازی eSIM همراه اول + ویدیو

7 مهر 1404
نقد و بررسی شیائومی 17 پرو مکس

نقد و بررسی شیائومی ۱۷ پرو مکس ؛ از نمایشگر دوم تا قدرت بالای پردازشی

6 مهر 1404 - به‌روزشده در 7 مهر 1404
عاملان هوشمند Maximor

پایان وابستگی به اکسل؛ مایکروسافت پلتفرم هوش مصنوعی جدید معرفی کرد

7 مهر 1404
هیوندای از سوناتا 2026 رونمایی کرد

هیوندای از سوناتا ۲۰۲۶ رونمایی کرد + تصویر

10 مهر 1404
انتشار One UI 8.5 سامسونگ

فهرست کامل دستگاه‌های واجدشرایط سامسونگ دریافت به‌روزرسانی One UI 8.5

10 مهر 1404 - به‌روزشده در 11 مهر 1404
تک ناک - اخبار تکنولوژی روز جهان و ایران

دنیا با سرعتی خیره کننده به سمت تحقق رویاهایی می رود که تا دیروز دست نیافتنی و محال بود و بشر با گذر از دریایی از موانع یک به یک در حال تحقق آنها است.

ما در” تک ناک” تلاش می کنیم سهمی از انعکاس تحولات بی شمار فناوری و اخبار تکنولوژی داشته باشیم و در این کهکشان بی انتهای یافته های علمی و دانش محور محتوایی قابل اتکاء و اخباری موثق را از گوشه و کنار دنیا در اختیار علاقمندان و مخاطبان خود قرار دهیم.

ما را در شبکه های اجتماعی دنبال کنید

تازه‌ها

ماوس‌های حرفه‌ای می‌توانند به میکروفون جاسوسی تبدیل شوند

ماوس‌های حرفه‌ای می‌توانند به میکروفون جاسوسی تبدیل شوند + ویدیو

11 مهر 1404
چین نخستین دیتاسنتر تجاری زیرآب را راه‌اندازی می‌کند؛ کاهش ۹۰ درصدی مصرف انرژی برای خنک‌سازی

چین نخستین دیتاسنتر تجاری زیرآب را راه‌اندازی می‌کند

11 مهر 1404
افشای جزئیات Motorola Edge 70 در یک ویدیو تبلیغاتی

افشای جزئیات گوشی جدید Motorola Edge 70 در یک ویدیو تبلیغاتی

11 مهر 1404
تأیید رسمی معماری‌های نسل بعدی اینتل؛ Nova Lake و Diamond

تأیید رسمی معماری‌های نسل بعدی اینتل؛ Nova Lake و Diamond

11 مهر 1404

دسترسی سریع

  • فناوری
  • کامپیوتر و موبایل
  • نقد و بررسی
  • آموزش
  • ارز دیجیتال
  • علمی
  • کسب و کار
  • وسائل نقلیه
  • بازی و سرگرمی
  • چند رسانه ای
  • صفحه اصلی
  • همه اخبار
  • تبلیغات تکناک
  • درباره ما
  • تماس با ما

© Copyright 2025 Technoc.ir

No Result
مشاهده تمامی نتایج
  • فناوری
    • اخبار هوش مصنوعی
    • رباتیک
    • اینترنت و شبکه
    • شبکه های اجتماعی
    • هوافضا
    • معماری
    • ورزش
    • رویداد ها
    • دوربین دیجیتال
  • کامپیوتر و موبایل
    • موبایل و تبلت
    • لپ تاپ و کامپیوتر
    • اپلیکیشن موبایل
    • نرم افزار
    • سخت افزار
    • ساعت هوشمند
    • مانیتور
    • اسپیکر و هدفون
    • سیستم عامل موبایل
    • سیستم عامل کامپیوتر
  • نقد و بررسی
    • بررسی موبایل و تبلت
    • کنسول بازی
    • بررسی لپ تاپ و کامپیوتر
    • قطعات کامپیوتر
    • نرم افزار
    • بررسی اسپیکر و هدفون
    • بررسی ساعت هوشمند
  • آموزش
    • سیستم عامل موبایل
    • سیستم عامل کامپیوتر
    • آموزش هوش مصنوعی
    • سخت افزار
  • اخبار ارز دیجیتال
    • قیمت لحظه ای ارز دیجیتال
    • ماشین حساب ارز دیجیتال
    • آموزش ارز دیجیتال
  • علمی
    • سلامت و پزشکی
    • انرژی
    • فیزیک
    • شیمی
    • نجوم
    • ورزش
    • محیط زیست
    • باستان شناسی
  • کسب و کار
    • شرکت ها
    • بورس
    • مدیریت(پروژه، کسب و کار، منابع انسانی)
    • استارتاپ ها
    • دولت الکترونیک
    • رویداد کسب و کار
  • وسائل نقلیه
    • خودرو
    • دوچرخه
    • موتور سیکلت
    • قطار
    • هواپیما
  • بازی و سرگرمی
    • کنسول بازی های کامپیوتری
    • بازی های کامپیوتر
    • بازی کنسول
    • بازی موبایل
    • فیلم و سریال
  • چند رسانه ای
    • عکس
    • ویدئو
  • اخبار داخلی
    • دانش بنیان
    • دولت الکترونیک
    • رویداد داخلی
    • بازار
    • دانشگاه

© Copyright 2025 Technoc.ir