Active
Provider: Google
Gemini 3.1 Flash Lite
model="gemini-3.1-flash-lite"
Gemini 3.1 Flash-Lite is Google’s highly cost-efficient, natively multimodal reasoning model, optimized for low latency and high-throughput tasks like data extraction, translation, and text classification.
Model Capabilities
Accepts (Input)
Text Generation
Generates (Output)
Text Responses
Quick Integration
Python (OpenAI SDK)import os
from openai import OpenAI
client = OpenAI(
base_url="https://helyxai.space/v1/chat/completions",
api_key=os.environ.get("HELYX_API_KEY")
)
response = client.chat.completions.create(
model="gemini-3.1-flash-lite",
messages=[
{"role": "system", "content": "You are a helpful assistant."},
{"role": "user", "content": "How do I use this model?"}
],
max_tokens=65536
)
print(response.choices[0].message.content)
Architecture
Context Window
1,048,576 tokens
Max Input
1,048,576
Max Output
65,536
Usage Allowances
Free Plan (Default)
10,000 tokens / day
Automatically resets every 24 hours.
Developer Plan
10,000,000 tokens / day
Market Pricing Equivalency
Input (per 1M)
$0.2500
Output (per 1M)
$1.5000
Your Cost: $0.00 (Via Free Quota)