Google Python GenAI SDK Adds Audio Transcription and Enterprise Mode
sdkai
feature patch
The Python GenAI SDK version 2.15.0 introduces support for audio transcription capabilities, allowing for more versatile multimodal interactions. It also enhances enterprise mode by enabling API key authentication alongside project and location configurations. These updates are relevant for developers integrating Google's generative AI models into Python applications, offering expanded functionality for handling audio input and more flexible enterprise deployments.
- →[GenerateContentConfig] Add GenerationConfig.audio_transcription_config and Part.audio_transcription
- →Add flat language_codes field to AudioTranscriptionConfig
- →Allow api key + proj/location for enterprise mode
- →Regenerate docs for 2.14.0
Features (3) ›
- [GenerateContentConfig] Add GenerationConfig.audio_transcription_config and Part.audio_transcription
- Add flat language_codes field to AudioTranscriptionConfig
- Allow api key + proj/location for enterprise mode
Maintenance (1) ›
- Regenerate docs for 2.14.0
Read the original announcement →
https://github.com/googleapis/python-genai/releases/tag/v2.15.0
Related releases
- Vibe-coded schedule app built with Gemini simplifies mornings Gemini Blog ·
- Gemini App Updates: July Drop Gemini Blog ·
- Gemini Spark integrates Chrome for automated web errands Gemini Blog ·
- Gemini Robotics ER 2 Enhances Embodied Reasoning for Robots Gemini Blog ·
- Python GenAI SDK v2.16.0 adds environment resource, Maps tool support Gemini Python SDK Releases ·
- Gemini for macOS adds voice-based natural language features Gemini Blog ·