Traffic rank on Composite
#166 of 203
0% of tokens and 0% of requests over 30 days.
AI model
meta/muse-glimmer-30b
Meta: Muse Glimmer 30B is a 131,072-token model served on Composite at $0.0960 per million tokens in and $1.10 per million tokens out. Ranked #166 of 203 models by traffic on Composite over the last 30 days, taking 0% of tokens and 0% of requests.
Try in Playground| Model ID | meta/muse-glimmer-30b |
|---|---|
| Provider | cv11 |
| Context window | 131,072 tokens |
| Accepts | text, image |
| Returns | text |
| Input price | $0.0960 per million tokens |
| Output price | $1.10 per million tokens |
| Prompt caching | Supported — cached input is 60% off the list rate on pay-as-you-go credits |
| Thinking | Always on for this model |
| Moderated | No |
| Cost on a monthly plan | 3 requests of the daily allowance per call |
| Plans that may spend on it | Every plan, plus pay-as-you-go credits |
| Routing endpoints | 10 (base plus 9 routing variants) |
#166 of 203
0% of tokens and 0% of requests over 30 days.
The same model behind 9 alternative endpoints. Call the id directly to pin a route; the base id above picks for you.
| Route | Model ID | Provider | Price |
|---|---|---|---|
| Normal | meta/muse-glimmer-30b-normal |
cv11 | $0.0960 per million tokens input · $1.20 per million tokens output |
| Normal + cheapThink | meta/muse-glimmer-30b-normal:cheapThink |
cv11 | $0.0960 per million tokens input · $1.20 per million tokens output |
| Cheapest provider | meta/muse-glimmer-30b:cheapest-provider |
Phala | $0.0960 per million tokens input · $1.10 per million tokens output |
| Cheapest provider + cheapThink | meta/muse-glimmer-30b:cheapest-provider:cheapThink |
Phala | $0.0960 per million tokens input · $1.10 per million tokens output |
| cheapThink | meta/muse-glimmer-30b:cheapThink |
cv11 | $0.0960 per million tokens input · $1.10 per million tokens output |
| Fast | meta/muse-glimmer-30b:fast |
Phala | $0.0960 per million tokens input · $1.10 per million tokens output |
| Fast + cheapThink | meta/muse-glimmer-30b:fast:cheapThink |
Phala | $0.0960 per million tokens input · $1.10 per million tokens output |
| Quality | meta/muse-glimmer-30b:quality |
DeepInfra | $0.0960 per million tokens input · $1.20 per million tokens output |
| Quality + cheapThink | meta/muse-glimmer-30b:quality:cheapThink |
DeepInfra | $0.0960 per million tokens input · $1.20 per million tokens output |
$0.0960 per million tokens input · $1.10 per million tokens output
Input and output are charged at the provider’s list price.
On a monthly plan, one call costs 3 requests of that day's allowance.
cv11
Llama models are a widely-supported open baseline, useful when you want predictable, well-documented behavior.
With a 131,072-token context window, it can hold a long-running roleplay or a full lorebook in memory without losing earlier plot details, so it suits multi-session campaigns and character cards with heavy backstory.
It is priced low enough for high-volume daily roleplay without the per-message cost adding up quickly.
Muse Glimmer 30B is a dense, open-weight multimodal model from Meta Superintelligence Labs, distilled from Muse Spark and optimized for autonomous agents on consumer hardware. It is suited for long-horizon...
Supplied by cv11, not written by Composite.
Meta: Muse Spark 1.3 Contributor · Meta: Muse Spark 1.3 · Meta: Muse Spark 1.2 Contributor