Model Library Gemini 3.1 Flash Lite
Gemini 3.1 Flash Lite
Active
Provider: Google

Gemini 3.1 Flash Lite

model="gemini-3.1-flash-lite"

Gemini 3.1 Flash-Lite is Google’s highly cost-efficient, natively multimodal reasoning model, optimized for low latency and high-throughput tasks like data extraction, translation, and text classification.

Model Capabilities

Accepts (Input)

Text Generation

Generates (Output)

Text Responses

Quick Integration

Python (OpenAI SDK)
import os
from openai import OpenAI

client = OpenAI(
    base_url="https://helyxai.space/v1/chat/completions",
    api_key=os.environ.get("HELYX_API_KEY")
)

response = client.chat.completions.create(
    model="gemini-3.1-flash-lite",
    messages=[
        {"role": "system", "content": "You are a helpful assistant."},
        {"role": "user", "content": "How do I use this model?"}
    ],
    max_tokens=65536
)

print(response.choices[0].message.content)

Architecture

Context Window

1,048,576 tokens

Max Input

1,048,576

Max Output

65,536

Usage Allowances

Free Plan (Default)

10,000 tokens / day

Automatically resets every 24 hours.

Developer Plan

10,000,000 tokens / day

Market Pricing Equivalency

Input (per 1M) $0.2500
Output (per 1M) $1.5000
Your Cost: $0.00 (Via Free Quota)