The Gemini 3.2 real-time model is now available on Google Cloud, offering a cost-effective alternative to GPT-5.5. The model, named "gemini-3.2-flash-lite-live-preview," has been added to the Google Cloud Console, marking its public debut on an official platform. This follows earlier appearances in iOS app bundles and AI Studio.
Gemini 3.2 Flash achieves 92% of GPT-5.5's coding and reasoning capabilities but at only one-twentieth of the inference cost, thanks to advanced distillation and sparsification techniques. Most query latencies are under 200 milliseconds, making it ideal for ultra-low-latency real-time interactions. Industry insiders expect its official launch at Google I/O on May 20.
Gemini 3.2 Model Debuts on Google Cloud with Cost-Effective Inference
免責事項: Phemexニュースで提供されるコンテンツは、あくまで情報提供を目的としたものであり、第三者の記事から取得した情報の正確性・完全性・信頼性について保証するものではありません。本コンテンツは金融または投資の助言を目的としたものではなく、投資に関する最終判断はご自身での調査と、信頼できる専門家への相談を踏まえて行ってください。
