مدیرعامل دیپ‌مایند، اعلام کرده است:

گوگل مدل‌های Gemini و Veo را ترکیب می‌کند؛ گامی به سوی دستیار دیجیتال آینده

نگار علی
۲۳ فروردین ۱۴۰۴

زمان مطالعه: < 1 دقیقه

گوگل قصد دارد دو مدل هوش مصنوعی قدرتمند خودش، یعنی Gemini و Veo را با هم ترکیب کند.

«دمیس هاسابیس»، مدیرعامل دیپ‌مایند، اعلام کرد گوگل قصد دارد در آینده مدل‌های هوش مصنوعی Gemini را با مدل‌های تولید ویدیو Veo ترکیب کند تا توانایی درک دنیای فیزیکی در این سیستم‌ها بهبود یابد.

هاسابیس در گفت‌وگویی در پادکست «Possible» به میزبانی «رید هافمن»، هم‌بنیان‌گذار لینکدین، گفت:«ما از ابتدا Gemini را به‌عنوان یک مدل چندوجهی طراحی کردیم، چون هدف‌مان ساخت یک دستیار دیجیتال جهانی بود؛ دستیار هوشمندی که بتواند واقعاً در دنیای واقعی به شما کمک کند.»

در حالی که صنعت هوش مصنوعی به سمت توسعه مدل‌های همه‌کاره پیش می‌رود، مدل‌هایی که توانایی درک و تولید انواع مختلفی از محتوا مانند متن، تصویر، صوت و ویدیو را دارند، گوگل نیز در تلاش است تا مدل‌های پیشرفته خود را در این مسیر گسترش دهد.

نسخه‌های جدید مدل Gemini اکنون قادر به تولید صوت، تصویر و متن هستند، در حالی که مدل پیش‌فرض OpenAI در چت‌جی‌پی‌تی نیز قابلیت تولید تصویر (از جمله آثار هنری با سبک استودیو جیبلی) را دارد. آمازون هم اعلام کرده که تا پایان سال جاری از یک مدل «هر ورودی به هر خروجی» (any-to-any) رونمایی خواهد کرد.

این مدل‌های جامع به حجم عظیمی از داده‌های متنوع برای آموزش نیاز دارند؛ از جمله تصویر، ویدیو، صوت و متن؛ به گفته هاسابیس، مدل ویدیویی Veo برای یادگیری قوانین دنیای واقعی، عمدتاً از ویدیوهای یوتیوب استفاده می‌کند. او گفت:« Veo با تماشای تعداد زیادی ویدیو در یوتیوب می‌تواند فیزیک دنیای واقعی را تشخیص دهد.»

گوگل پیش‌تر گفته بود که مدل‌هایش «ممکن است» براساس «برخی» از محتوای یوتیوب و طبق توافق‌نامه با سازندگان آن آموزش داده شده باشند. گزارش‌ها همچنین نشان می‌دهد که این شرکت سال گذشته شرایط خدمات خود را تغییر داده تا از داده‌های بیشتری برای آموزش مدل‌های هوش مصنوعی خود بهره بگیرد.

https://hooshio.com/?p=67161

جدیدترین تحولات هوش مصنوعی را در کانال بله هوشیو بخوانید

گوگل مدل‌های Gemini و Veo را ترکیب می‌کند؛ گامی به سوی دستیار دیجیتال آینده

قابلیت Model Council در Perplexity

پایان GPT-4o پیش از ولنتاین؛ کاربران خشمگین و غمگین شدند

افزونه هوش Claude در پاورپوینت

همکاری OpenAI با G42 برای ساخت هوش مصنوعی برای دولت امارات

مهندسی پرامپت: راهنمای جامع از مبتدی تا پیشرفته

معرفی هوش مصنوعی سازمانی

از کدام چت‌بات‌های هوش مصنوعی استفاده کنیم؟

ضرورت بازنگری نقش کمیسیون هوش مصنوعی سازمان نصر ایران در سالگرد تأسیس

رونمایی از نخستین دستیار هوش مصنوعی قضایی ایران

ضرورت بازنگری نقش کمیسیون هوش مصنوعی سازمان نصر ایران در سالگرد تأسیس

سامانه هوش مصنوعی مرکز وکلا قوه قضاییه رونمایی شد

آموزش رایگان هوش مصنوعی برای کودکان محلات کم‌برخوردار

قابلیت Model Council در Perplexity

پایان GPT-4o پیش از ولنتاین؛ کاربران خشمگین و غمگین شدند

افزونه هوش Claude در پاورپوینت

همکاری OpenAI با G42 برای ساخت هوش مصنوعی برای دولت امارات

به خبرنامه هوشیو بپیوندید

دسترسی سریع

اخرین مطالب

قابلیت Model Council در Perplexity

پایان GPT-4o پیش از ولنتاین؛ کاربران خشمگین و غمگین شدند

افزونه هوش Claude در پاورپوینت

همکاری OpenAI با G42 برای ساخت هوش مصنوعی برای دولت امارات

GPT-5.2 به کشفی تازه در فیزیک نظری رسید

مطالب پیشنهادی مرتبط

به خبرنامه هوشیو بپیوندید

دسترسی سریع

اخرین مطالب

در جریان مهم‌ترین اتفاقات AI بمانید