TWIML AI Podcast
TWIML AI Podcast

Inside Nano Banana 🍌 and the Future of Vision-Language Models with Oliver Wang - #748

Sep 23, 2025 · 1h 3m

Today, we’re joined by Oliver Wang, principal scientist at Google DeepMind and tech lead for Gemini 2.5 Flash Image—better known by its code name, “Nano Banana.” We dive into the development and capabilities of this newly released frontier vision-language model, beginning with the broader shift from specialized image generators to general-purpose multimodal agents that can use both visual and textual data for a variety of tasks. Oliver explains how Nano Banana can generate and iteratively edit images while maintaining consistency, …

اس حصے کو ابھی تک نقل نہیں کیا گیا ہے

AI کے ساتھ اس اي پيز کو نقل کرنے کے ليے STT.ai استعمال کريں اسپيکر کٹ گي ، ٹائم سٹیمپ اور متعدد فارمٹس ميں صادرات کے ليے صحيح متن حاصل کريں

اسپیکر کی تلاش لفظ سطح کے ٹائم سٹیمپ SRT، TXT، JSON کے طور پر برآمد کریں

مزید ایپیز