Gemini 4 puede escribir un millón de tokens de una sentada: el producto ya no es el chat sino el trabajo largo y autónomo

Hasta esta semana, un modelo Gemini podía generar como mucho 64.000 tokens por respuesta. Gemini 4 Argon, presentado por Google anoche, sube ese techo a un millón. Para que funcione, la API estrena una función que pausa las respuestas largas y las retoma en llamadas sucesivas, así que el modelo no se queda a medias cuando la petición agota su tiempo.

Por qué es importante. Un millón de tokens son unas 750.000 palabras. Ahí cabe ‘Guerra y paz’ y todavía sobra sitio para ‘Cien años de soledad’. Pero Argon no tiene ese límite para escribir una novela rusa sobre las guerras napoleónicas. Google ha subido ese límite para que el modelo pueda trabajar más tiempo sin parar. Así que la unidad de producto ya no es tanto la respuesta como el encargo.

Leer noticia completa →