Hasta esta semana, un modelo Gemini podía generar como mucho 64.000 tokens por respuesta. Gemini 4 Argon, presentado por Google anoche, sube ese techo a un millón. Para que funcione, la API estrena una función que pausa las respuestas largas y las retoma en llamadas sucesivas, así que el modelo n...
Continúa leyendo en la fuente original:
Xataka — Leer artículo completo →
Xataka — Leer artículo completo →