Macaron V1 Tall is Mindai's language model with a 262K context window and up to 33K output tokens, starting at $0.45 / 1M input and $2.60 / 1M output. An efficient mixture-of-LoRA-experts model built on Qwen3 with specialist adapters for chat, agent, coding, and generative UI tasks.
Specifications
Canonical IDmindai-macaron-1-tall
TypeLanguage
StatusActive
CreatorMindai
Providers
Context Window262K tokens
Max Output33K tokens
Input ModalitiesText
Output ModalitiesText
Reasoning Effortsdefault

Capabilities

Input1/5
Text
Image·
Audio·
Video·
PDF·
Output1/5
Text
Image·
Audio·
Video·
Embedding·
Capabilities3/13
Reasoning
Adaptive Reasoning·
Function Calling
Parallel Function Calling·
Structured Outputs·
Native JSON Schema·
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching
Assistant Prefill·

Pricing by Provider

US Dollar ($)
Per 1M tokens
ProviderStandard
Input
$ / 1M
Output
$ / 1M
Cache Read
$ / 1M
Novita logo
Novita
novita/mindai/macaron-v1-tall
$0.45$2.60$0.08

Cost Calculator

US Dollar ($)
Preset:

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
Macaron V1 Tall262K$0.450$2.60Current
Macaron V1 Venti1.0M$1.50$4.50Available

Model IDs

mindai-macaron-1-tall
mindai/macaron-v1-tall
novita/mindai/macaron-v1-tall