Gemini 3.5 Flash-Lite
10 +
About
Google's fastest, cheapest current Flash tier (~350 tok/s) — GA July 2026, for high-volume low-latency text tasks.
Available controls: Temperature, Top P, Top K, Context length, Response length.
Settings
Response length- The maximum number of tokens to generate in the output.
Temperature- The temperature of the model. Higher values make the model more creative and lower values make it more focused.
Diversity control- Top_p. Filters AI responses based on probability.
Lower values = top few likely responses,
Higher values = larger pool of options.
Lower values = top few likely responses,
Higher values = larger pool of options.
Context length- The maximum number of tokens to use as input for a model.