2 min de lectura

Google elimina los controles de muestreo de Gemini en los nuevos modelos Flash

Gemini 3.6 Flash y 3.5 Flash-Lite ya están en disponibilidad general (GA), y Google afirma que temperature, top_p y top_k están obsoletos y se ignoran.

Imagen: Hacker News

Google ha puesto a disposición general Gemini 3.6 Flash y Gemini 3.5 Flash-Lite, y el cambio inmediato más relevante para los desarrolladores puede estar en la API: temperature, top_p y top_k ahora están obsoletos y se ignoran para estos modelos, y Google dice que las futuras generaciones de modelos devolverán un error HTTP 400 si se suministran.

La misma actualización también bloquea los turnos de modelo prellenados. Si el último turno no vacío en una solicitud es un turno de modelo, la API ahora devuelve un error 400. Google recomienda mover esos controles a system_instruction o usar salidas estructuradas en su lugar.

Los dos nuevos modelos de producción están orientados de forma distinta:

  • Gemini 3.6 Flash (gemini-3.6-flash) está orientado a la generación de código, al razonamiento multimodal y a flujos de trabajo con agentes de varios pasos.
  • Gemini 3.5 Flash-Lite (gemini-3.5-flash-lite) es el modelo más rápido y económico de la familia 3.5, orientado al análisis de alto volumen, a la extracción y al trabajo con JSON estructurado.

Google fija el precio de Gemini 3.6 Flash en $1.50 por 1M tokens de entrada y $7.50 por 1M tokens de salida. Gemini 3.5 Flash-Lite cuesta $0.30 por 1M tokens de entrada y $2.50 por 1M tokens de salida. Ambos admiten una ventana de contexto de 1M tokens, 64k tokens de salida como máximo, thinking y herramientas integradas, incluido Computer Use.

Según Google, Gemini 3.6 Flash mejora la eficiencia en flujos de trabajo de múltiples pasos, la generación de código, el seguimiento de instrucciones y el razonamiento espacial multimodal, además de reducir el precio por token de salida de $9.00/1M en Gemini 3.5 Flash a $7.50/1M. Gemini 3.5 Flash-Lite se presenta como un objetivo de migración más sólido desde Gemini 2.5 Flash, con ganancias en benchmarks que incluyen HLE: 18.0% frente a 11.0% y CharXIV: 74.5% frente a 63.7%.

Recomendado

Los modelos abiertos ya están lo bastante cerca como para inquietar a Washington

Cambios en la migración de la API de Gemini

Para las aplicaciones que migran a los nuevos modelos, Google indica que los desarrolladores deberían:

  • cambiar los IDs de modelo a gemini-3.6-flash o gemini-3.5-flash-lite
  • eliminar temperature, top_p y top_k
  • reemplazar thinking_budget por thinking_level, por ejemplo medium o high
  • eliminar candidate_count, que no es compatible con Gemini 3.x
  • eliminar los turnos de modelo prellenados y confiar en el estado de la conversación del lado del servidor, como previous_interaction_id

Google también afirma que Gemini 3.6 Flash es ahora el modelo predeterminado detrás del agente Antigravity en Gemini Managed Agents. La página de documentación se actualizó por última vez el 2026-07-21 UTC.

Ava Chen

AI Editor

Ava covers the rapidly evolving world of artificial intelligence, from foundational models and research labs to the real-world economics of intelligence. With a background in computational linguistics, she cuts through the hype to find out what actually works. She firmly believes that benchmarks are just marketing until reproduced in the wild.

vía Hacker News

// Sigue leyendo