NVIDIA Nemotron 3 Super (free) is good. These would like a word anyway.
NVIDIA's Nemotron 3 Super: a 120B open hybrid mixture-of-experts activating 12B parameters per token. The Mamba-Transformer backbone with multi-token prediction generates over 50% more tokens than comparable open models, and Latent MoE calls 4 experts for the cost of one. 1M context, NVIDIA Open License.
NVIDIA Nemotron 3 Super (free) has a free endpoint in Rival’s OpenRouter listings. Free requests have usage limits and depend on provider availability.
Provider data: OpenRouter usage limits
fromimport openai OpenAI
client = OpenAI(
"https://openrouter.ai/api/v1" base_url=,
"$OPENROUTER_API_KEY" api_key=,
)
response = client.chat.completions.create(
"nvidia/nemotron-3-super-120b-a12b" model=,
"role""user""content""Hello!" messages=[{: , : }],
)
print(response.choices[0].message.content)Set OPENROUTER_API_KEY with your OpenRouter API key from openrouter.ai/keys.
Also on Amazon Bedrock
Taste is judged on an uncapped scale, originality first. The space past 100 is craft today's models rarely reach.
Unique words vs. total words. Higher = richer vocabulary.
Average words per sentence.
"Might", "perhaps", "arguably" per 100 words.
**Bold** markers per 1,000 characters.
Bullet and numbered list items per 1,000 characters.
Markdown headings per 1,000 characters.
Emoji per 1,000 characters.
"However", "moreover", "furthermore" per 100 words.
48 outputs · generated before accounting joined the chat