CONFIRMADO. O Google publicou em 10 de setembro a versão 2.23.0 do seu SDK Gen AI para Python. Não é um lançamento de modelo, não muda preço da API e não promete um salto de benchmark. É uma atualização de infraestrutura que reduz atrito justamente nas partes mais chatinhas de transformar Gemini em produto: preparar ambientes reproduzíveis e saber quando uma conversa ao vivo realmente terminou.
A primeira mudança adiciona o parâmetro from_environment à criação de ambientes. Na prática, um desenvolvedor pode criar um novo ambiente a partir de outro já existente, usando o identificador do ambiente como origem. O recurso vale para as chamadas síncronas e assíncronas e, segundo a implementação publicada, a cópia é feita pela API de ambientes do Agent Platform. Quando essa opção é usada, a requisição não deve misturar uma nova lista de fontes ou configuração de ambiente.
Isso parece detalhe de SDK, mas muda a operação. Uma pequena empresa que mantém um agente com arquivos, dependências e configuração de rede pode separar desenvolvimento, homologação e produção sem remontar tudo do zero a cada teste. Também facilita criar uma versão temporária para um cliente, testar uma nova integração e voltar ao ambiente original sem transformar cada experimento em projeto de infraestrutura. A ressalva é importante: copiar um ambiente não equivale a validar permissões, segredos, custos ou comportamento do agente. O clone precisa entrar no mesmo checklist de segurança e observabilidade do original.
A segunda novidade corrige o entendimento de fim de turno no Live API. Antes, o cliente Python encerrava a leitura quando encontrava turn_complete. Agora, quando o servidor informa um interaction_status diferente do valor não especificado, o SDK considera o estado IDLE como conclusão. Se o estado estiver IN_PROGRESS, a sessão continua recebendo eventos, mesmo que um sinal de conclusão de turno já tenha aparecido.
Para voz e vídeo em tempo real, isso é mais do que uma troca de nome. Um agente pode sinalizar que terminou uma etapa de geração e ainda estar processando a interação. A nova lógica diminui o risco de cortar resposta, liberar a interface cedo demais ou disparar a próxima ação enquanto o servidor ainda está trabalhando. É uma correção de sincronização, não uma promessa de menor latência por si só. A latência final ainda depende do modelo, da rede, do áudio e do desenho da aplicação.
O pacote também remove um campo sem uso de FunctionResultDelta, uma limpeza pequena que reduz ambiguidade em respostas de ferramentas. Minha leitura: vale atualizar quem usa ambientes do Agent Platform ou o Live API, mas com teste de regressão nos fluxos de streaming. Para quem só chama generate_content de forma convencional, o ganho é indireto e não há motivo para correr atrás da versão apenas pelo número.
Fontes em PT: release oficial v2.23.0; changelog da versão; guia oficial do Live API; catálogo independente do pacote.