Macaron V1 Tall is Mindai's language model with a 262K context window and up to 33K output tokens, starting at $0.45 / 1M input and $2.60 / 1M output. An efficient mixture-of-LoRA-experts model built on Qwen3 with specialist adapters for chat, agent, coding, and generative UI tasks.
Specifications
Canonical IDmindai-macaron-1-tall
TypeLanguage
StatusActive
CreatorMindai
Providers
Context Window262K tokens
Max Output33K tokens
Input ModalitiesText
Output ModalitiesText
Reasoning Effortsdefault

Capabilities

Input1/5
Text✓
Image·
Audio·
Video·
PDF·
Output1/5
Text✓
Image·
Audio·
Video·
Embedding·
Capabilities3/13
Reasoning✓
Adaptive Reasoning·
Function Calling✓
Parallel Function Calling·
Structured Outputs·
Native JSON Schema·
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching✓
Assistant Prefill·

Pricing by Provider

US Dollar ($)
Per 1M tokens
ProviderStandard
Input
$ / 1M
Output
$ / 1M
Cache Read
$ / 1M
Novita logo
Novita
novita/mindai/macaron-v1-tall
$0.45$2.60$0.08

Cost Calculator

US Dollar ($)
Preset:

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
Macaron V1 Tall—262K$0.450$2.60Current
Macaron V1 Venti—1.0M$1.50$4.50Available

Model IDs

mindai-macaron-1-tall
mindai/macaron-v1-tall
novita/mindai/macaron-v1-tall