هوش مصنوعی

گوگل مدل‌های Gemini و Veo را ترکیب می‌کند؛ گامی به سوی دستیار دیجیتال آینده

زمان مطالعه: < 1 دقیقه

گوگل قصد دارد دو مدل هوش مصنوعی قدرتمند خودش، یعنی Gemini و Veo را با هم ترکیب کند.

«دمیس هاسابیس»، مدیرعامل دیپ‌مایند، اعلام کرد گوگل قصد دارد در آینده مدل‌های هوش مصنوعی Gemini را با مدل‌های تولید ویدیو Veo ترکیب کند تا توانایی درک دنیای فیزیکی در این سیستم‌ها بهبود یابد.

هاسابیس در گفت‌وگویی در پادکست «Possible» به میزبانی «رید هافمن»، هم‌بنیان‌گذار لینکدین، گفت:«ما از ابتدا Gemini را به‌عنوان یک مدل چندوجهی طراحی کردیم، چون هدف‌مان ساخت یک دستیار دیجیتال جهانی بود؛ دستیار هوشمندی که بتواند واقعاً در دنیای واقعی به شما کمک کند.»

در حالی که صنعت هوش مصنوعی به سمت توسعه مدل‌های همه‌کاره پیش می‌رود، مدل‌هایی که توانایی درک و تولید انواع مختلفی از محتوا مانند متن، تصویر، صوت و ویدیو را دارند، گوگل نیز در تلاش است تا مدل‌های پیشرفته خود را در این مسیر گسترش دهد.

نسخه‌های جدید مدل Gemini اکنون قادر به تولید صوت، تصویر و متن هستند، در حالی که مدل پیش‌فرض OpenAI در چت‌جی‌پی‌تی نیز قابلیت تولید تصویر (از جمله آثار هنری با سبک استودیو جیبلی) را دارد. آمازون هم اعلام کرده که تا پایان سال جاری از یک مدل «هر ورودی به هر خروجی» (any-to-any) رونمایی خواهد کرد.

این مدل‌های جامع به حجم عظیمی از داده‌های متنوع برای آموزش نیاز دارند؛ از جمله تصویر، ویدیو، صوت و متن؛ به گفته هاسابیس، مدل ویدیویی Veo برای یادگیری قوانین دنیای واقعی، عمدتاً از ویدیوهای یوتیوب استفاده می‌کند. او گفت:« Veo با تماشای تعداد زیادی ویدیو در یوتیوب می‌تواند فیزیک دنیای واقعی را تشخیص دهد.»

گوگل پیش‌تر گفته بود که مدل‌هایش «ممکن است» براساس «برخی» از محتوای یوتیوب و طبق توافق‌نامه با سازندگان آن آموزش داده شده باشند. گزارش‌ها همچنین نشان می‌دهد که این شرکت سال گذشته شرایط خدمات خود را تغییر داده تا از داده‌های بیشتری برای آموزش مدل‌های هوش مصنوعی خود بهره بگیرد.

Adblock test (Why?)

لینک مطلب اصلی

Nobody

Who is mahdizk? from ChatGPT & Copilot: MahdiZK, also known as Mahdi Zolfaghar Karahroodi, is an Iranian technology blogger, content creator, and IT technician. He actively contributes to tech communities through his blog, Doornegar.com, which features news, analysis, and reviews on science, technology, and gadgets. Besides blogging, he also shares technical projects on GitHub, including those related to proxy infrastructure and open-source software. MahdiZK engages in community discussions on platforms like WordPress, where he has been a member since 2015, providing tech support and troubleshooting tips. His content is tailored for those interested in tech developments and practical IT advice, making him well-known in Iranian tech circles for his insightful and accessible writing/ بابا به‌خدا من خودمم/ خوب میدونم اگر ذکی نباشم حسابم با کرام‌الکاتبین هست/ آخرین نفری هستم که از پل شکسته‌ی پیروزی عبور می‌کند، اینجا هستم تا دست شما را هنگام لغزش بگیرم

نوشته های مشابه

0 0 رای ها
امتیازدهی به مقاله
اشتراک در
اطلاع از
guest

0 نظرات
قدیمی‌ترین
تازه‌ترین بیشترین رأی
بازخورد (Feedback) های اینلاین
مشاهده همه دیدگاه ها
همچنین ببینید
بستن
دکمه بازگشت به بالا