IA no Mac
Preparado para revisão; não fechado Publicação externa ainda precisa de prova real; multi-chip é comparativo opcional. Ver estado real

Guia de instalação

Playbooks por modelo

Arquivos gerados a partir de data/models.json.

Em uma frase

Arquivos gerados a partir de data/models.json.

Por que isso importa

Use quando quiser rodar um modelo específico no Mac.

Como ler sem conhecimento técnico

Leia primeiro os dados do modelo, depois a instalação e por fim o comando de execução.

Próximo passo

Copie apenas os comandos que fazem sentido para o seu runtime e confira se o modelo cabe na RAM.

Termos traduzidos

guardrail
filtro ou regra para reduzir respostas inseguras.
LLM
modelo de linguagem; a IA que lê e escreve texto.
MLX
biblioteca da Apple/MLX Community para rodar modelos em Apple Silicon.
playbook
guia passo a passo para instalar e rodar algo.
script
arquivo com comandos para automatizar uma tarefa.
JSON
formato estruturado de dados usado por programas e relatórios.

Artigo exclusivo · leitura guiada

Aprofundamento para entender de verdade

Use este artigo como roteiro prático: primeiro entenda para que o modelo serve, depois confira se ele combina com seu Mac e só então abra os comandos avançados.

Depois da leitura, volte ao teste do seu Mac e compare este modelo com uma alternativa mais leve.

O que este artigo resolve

Você entende Playbooks por modelo sem precisar começar pelo jargão. A ideia central é: Arquivos gerados a partir de data/models.json.

Como usar na prática

A aplicação mais segura é escolher uma tarefa simples, testar com um texto pequeno e anotar se a resposta ficou útil antes de avançar para arquivos maiores.

Roteiro de leitura

Leia primeiro Playbooks por modelo. Quando aparecerem termos como guardrail, LLM, MLX e playbook, use o glossário desta página antes de seguir.

Atenção antes de avançar

Não copie comandos sem entender o objetivo de cada etapa. Se o artigo citar memória, modelo ou ferramenta local, trate isso como requisito antes de instalar.

Conteúdo completo

Playbooks por modelo

Arquivos gerados a partir de data/models.json.

ModeloCategoriaTipoScriptPlaybook
Llama-3.2-1B-Instruct-4bitdraftgenerationllama-3-2-1b-instruct-4bit.pyllama-3-2-1b-instruct-4bit.md
Qwen2.5-Coder-1.5B-Instruct-4bitcodergenerationqwen2-5-coder-1-5b-instruct-4bit.pyqwen2-5-coder-1-5b-instruct-4bit.md
Qwen3-0.6B-4bit-DWQdraftgenerationqwen3-0-6b-4bit-dwq.pyqwen3-0-6b-4bit-dwq.md
Qwen3-1.7B-4bit-DWQchatgenerationqwen3-1-7b-4bit-dwq.pyqwen3-1-7b-4bit-dwq.md
Llama-3.2-3B-Instruct-4bitchatgenerationllama-3-2-3b-instruct-4bit.pyllama-3-2-3b-instruct-4bit.md
Qwen3-4B-Instruct-2507-4bit-DWQ-2510chatgenerationqwen3-4b-instruct-2507-4bit-dwq-2510.pyqwen3-4b-instruct-2507-4bit-dwq-2510.md
SmolLM3-3B-4bitchatgenerationsmollm3-3b-4bit.pysmollm3-3b-4bit.md
Tucano2-qwen-3.7B-Instruct-MLX-4bitmultilingualgenerationtucano2-qwen-3-7b-instruct-mlx-4bit.pytucano2-qwen-3-7b-instruct-mlx-4bit.md
Tucano2-qwen-3.7B-Think-MLX-4bitmultilingualgenerationtucano2-qwen-3-7b-think-mlx-4bit.pytucano2-qwen-3-7b-think-mlx-4bit.md
Fin-R1-4bitfinancegenerationfin-r1-4bit.pyfin-r1-4bit.md
OmniSQL-7B-4bit-mlxsqlgenerationomnisql-7b-4bit-mlx.pyomnisql-7b-4bit-mlx.md
watt-tool-8Btool-usegenerationwatt-tool-8b.pywatt-tool-8b.md
DeepSeek-Coder-V2-Lite-Instruct-4bit-mlxcodergenerationdeepseek-coder-v2-lite-instruct-4bit-mlx.pydeepseek-coder-v2-lite-instruct-4bit-mlx.md
Qwen3-VL-30B-A3B-Instruct-4bitvisionvisionqwen3-vl-30b-a3b-instruct-4bit.pyqwen3-vl-30b-a3b-instruct-4bit.md
Qwen2.5-VL-7B-Instruct-4bitvisionvisionqwen2-5-vl-7b-instruct-4bit.pyqwen2-5-vl-7b-instruct-4bit.md
Qwen3-Coder-Next-MLX-4bitcodergenerationqwen3-coder-next-mlx-4bit.pyqwen3-coder-next-mlx-4bit.md
OpenThinker3-7B-4bitreasoninggenerationopenthinker3-7b-4bit.pyopenthinker3-7b-4bit.md
Qwen3.6-35B-A3B-4bit-DWQchatgenerationqwen3-6-35b-a3b-4bit-dwq.pyqwen3-6-35b-a3b-4bit-dwq.md
Seed-Coder-8B-Reasoning-DWQcodergenerationseed-coder-8b-reasoning-dwq.pyseed-coder-8b-reasoning-dwq.md
DeepSeek-R1-0528-Qwen3-8B-4bit-DWQreasoninggenerationdeepseek-r1-0528-qwen3-8b-4bit-dwq.pydeepseek-r1-0528-qwen3-8b-4bit-dwq.md
EuroLLM-9B-Instruct-MLX-4bitmultilingualgenerationeurollm-9b-instruct-mlx-4bit.pyeurollm-9b-instruct-mlx-4bit.md
Qwen3-Next-80B-A3B-Thinking-4bitreasoninggenerationqwen3-next-80b-a3b-thinking-4bit.pyqwen3-next-80b-a3b-thinking-4bit.md
Qwen2.5-Coder-14B-Instruct-4bitcodergenerationqwen2-5-coder-14b-instruct-4bit.pyqwen2-5-coder-14b-instruct-4bit.md
OpenThinker3-7B-8bitreasoninggenerationopenthinker3-7b-8bit.pyopenthinker3-7b-8bit.md
phi-4-4bitchatgenerationphi-4-4bit.pyphi-4-4bit.md
OpenMath-Nemotron-14B-4bitmathgenerationopenmath-nemotron-14b-4bit.pyopenmath-nemotron-14b-4bit.md
AceReason-Nemotron-14B-4bitreasoninggenerationacereason-nemotron-14b-4bit.pyacereason-nemotron-14b-4bit.md
Qwen2.5-Coder-32B-Instruct-4bitcodergenerationqwen2-5-coder-32b-instruct-4bit.pyqwen2-5-coder-32b-instruct-4bit.md
SaulLM-54B-Instruct-mlx-4Bitlegalgenerationsaullm-54b-instruct-mlx-4bit.pysaullm-54b-instruct-mlx-4bit.md
Mistral-Small-3.2-24B-Instruct-2506-4bitchatgenerationmistral-small-3-2-24b-instruct-2506-4bit.pymistral-small-3-2-24b-instruct-2506-4bit.md
medgemma-27b-text-it-4bitmedicalgenerationmedgemma-27b-text-it-4bit.pymedgemma-27b-text-it-4bit.md
Qwen3.5-27B-4bit-DWQchatgenerationqwen3-5-27b-4bit-dwq.pyqwen3-5-27b-4bit-dwq.md
KAT-Dev-MLX-4bitcodergenerationkat-dev-mlx-4bit.pykat-dev-mlx-4bit.md
MiniMax-M2-THRIFT-55-MLX-4bittool-usegenerationminimax-m2-thrift-55-mlx-4bit.pyminimax-m2-thrift-55-mlx-4bit.md
Qwen3-VL-32B-Instruct-4bitvisionvisionqwen3-vl-32b-instruct-4bit.pyqwen3-vl-32b-instruct-4bit.md
Seed-OSS-36B-Instruct-4bitchatgenerationseed-oss-36b-instruct-4bit.pyseed-oss-36b-instruct-4bit.md
AceReason-Nemotron-14B-8bitreasoninggenerationacereason-nemotron-14b-8bit.pyacereason-nemotron-14b-8bit.md
Codestral-22B-v0.1-4bitcodergenerationcodestral-22b-v0-1-4bit.pycodestral-22b-v0-1-4bit.md
EuroLLM-22B-Instruct-2512-mlx-4bitmultilingualgenerationeurollm-22b-instruct-2512-mlx-4bit.pyeurollm-22b-instruct-2512-mlx-4bit.md
Qwen3-235B-A22B-Thinking-2507-3bit-DWQreasoninggenerationqwen3-235b-a22b-thinking-2507-3bit-dwq.pyqwen3-235b-a22b-thinking-2507-3bit-dwq.md
Qwen2.5-72B-Instruct-4bitchatgenerationqwen2-5-72b-instruct-4bit.pyqwen2-5-72b-instruct-4bit.md
c4ai-command-r-08-2024-4bittool-usegenerationc4ai-command-r-08-2024-4bit.pyc4ai-command-r-08-2024-4bit.md
OlympicCoder-32B-4bitcodergenerationolympiccoder-32b-4bit.pyolympiccoder-32b-4bit.md
OpenMath-Nemotron-32B-4bitmathgenerationopenmath-nemotron-32b-4bit.pyopenmath-nemotron-32b-4bit.md
Qwen-3-32B-Medical-Reasoning-4bitmedicalgenerationqwen-3-32b-medical-reasoning-4bit.pyqwen-3-32b-medical-reasoning-4bit.md
DeepSeek-R1-Distill-Qwen-32B-4bitreasoninggenerationdeepseek-r1-distill-qwen-32b-4bit.pydeepseek-r1-distill-qwen-32b-4bit.md
Olmo-3.1-32B-Think-4bitreasoninggenerationolmo-3-1-32b-think-4bit.pyolmo-3-1-32b-think-4bit.md
xLAM-2-32b-fc-r-mlx-8Bittool-usegenerationxlam-2-32b-fc-r-mlx-8bit.pyxlam-2-32b-fc-r-mlx-8bit.md
Goedel-Prover-V2-32B-8bitmathgenerationgoedel-prover-v2-32b-8bit.pygoedel-prover-v2-32b-8bit.md
Llama-3-Groq-70B-Tool-Use-4bittool-usegenerationllama-3-groq-70b-tool-use-4bit.pyllama-3-groq-70b-tool-use-4bit.md
Qwen2.5-Math-72B-Instruct-4bitmathgenerationqwen2-5-math-72b-instruct-4bit.pyqwen2-5-math-72b-instruct-4bit.md
gte-Qwen2-7B-instruct-Q4-mlxembeddingembeddinggte-qwen2-7b-instruct-q4-mlx.pygte-qwen2-7b-instruct-q4-mlx.md
serafim-900m-portuguese-pt-sentence-encoderembeddingembeddingserafim-900m-portuguese-pt-sentence-encoder.pyserafim-900m-portuguese-pt-sentence-encoder.md
Fin-R1financegenerationfin-r1.pyfin-r1.md
Qwen3Guard-Gen-0.6B-mxfp4-mlxguardrailgenerationqwen3guard-gen-0-6b-mxfp4-mlx.pyqwen3guard-gen-0-6b-mxfp4-mlx.md
Qwen3Guard-Gen-4B-mxfp4-mlxguardrailgenerationqwen3guard-gen-4b-mxfp4-mlx.pyqwen3guard-gen-4b-mxfp4-mlx.md
gte-reranker-modernbert-base-mlxrerankerrerankergte-reranker-modernbert-base-mlx.pygte-reranker-modernbert-base-mlx.md
ibm-granite-guardian-3.1-2b-4bitguardrailgenerationibm-granite-guardian-3-1-2b-4bit.pyibm-granite-guardian-3-1-2b-4bit.md
jina-reranker-v3-mlxrerankerrerankerjina-reranker-v3-mlx.pyjina-reranker-v3-mlx.md
Devstral-Small-2507-4bit-DWQcodergenerationdevstral-small-2507-4bit-dwq.pydevstral-small-2507-4bit-dwq.md
GLM-4-32B-0414-4bit-DWQchatgenerationglm-4-32b-0414-4bit-dwq.pyglm-4-32b-0414-4bit-dwq.md
GLM-4.5-Air-6bitchatgenerationglm-4-5-air-6bit.pyglm-4-5-air-6bit.md
InternVL3-78B-4bitvisionvisioninternvl3-78b-4bit.pyinternvl3-78b-4bit.md
Kimi-Dev-72B-4bit-DWQcodergenerationkimi-dev-72b-4bit-dwq.pykimi-dev-72b-4bit-dwq.md
Kokoro-82M-bf16ttsttskokoro-82m-bf16.pykokoro-82m-bf16.md
Llama-3.3-70B-Instruct-4bit-DWQchatgenerationllama-3-3-70b-instruct-4bit-dwq.pyllama-3-3-70b-instruct-4bit-dwq.md
Magistral-Small-2506-4bit-DWQreasoninggenerationmagistral-small-2506-4bit-dwq.pymagistral-small-2506-4bit-dwq.md
Mistral-Large-Instruct-2407-4bitchatgenerationmistral-large-instruct-2407-4bit.pymistral-large-instruct-2407-4bit.md
QwQ-32b-4bit-DWQreasoninggenerationqwq-32b-4bit-dwq.pyqwq-32b-4bit-dwq.md
Qwen2-Audio-7B-Instruct-4bitaudioaudio-understandingqwen2-audio-7b-instruct-4bit.pyqwen2-audio-7b-instruct-4bit.md
Qwen2.5-Coder-0.5B-Instruct-4bitdraftgenerationqwen2-5-coder-0-5b-instruct-4bit.pyqwen2-5-coder-0-5b-instruct-4bit.md
Qwen2.5-Coder-1.5B-Instruct-8bitcodergenerationqwen2-5-coder-1-5b-instruct-8bit.pyqwen2-5-coder-1-5b-instruct-8bit.md
Qwen2.5-Coder-7B-4bitcodergenerationqwen2-5-coder-7b-4bit.pyqwen2-5-coder-7b-4bit.md
Qwen3-30B-A3B-Instruct-2507-4bit-DWQchatgenerationqwen3-30b-a3b-instruct-2507-4bit-dwq.pyqwen3-30b-a3b-instruct-2507-4bit-dwq.md
Qwen3-32B-4bit-DWQchatgenerationqwen3-32b-4bit-dwq.pyqwen3-32b-4bit-dwq.md
Qwen3-Coder-30B-A3B-Instruct-4bit-dwq-v2codergenerationqwen3-coder-30b-a3b-instruct-4bit-dwq-v2.pyqwen3-coder-30b-a3b-instruct-4bit-dwq-v2.md
Qwen3-Embedding-4B-mxfp8embeddingembeddingqwen3-embedding-4b-mxfp8.pyqwen3-embedding-4b-mxfp8.md
Qwen3-Embedding-8B-4bit-DWQembeddingembeddingqwen3-embedding-8b-4bit-dwq.pyqwen3-embedding-8b-4bit-dwq.md
Qwen3-Reranker-4B-mxfp8rerankerrerankerqwen3-reranker-4b-mxfp8.pyqwen3-reranker-4b-mxfp8.md
SongGeneration-v2-largemusicmusicsonggeneration-v2-large.pysonggeneration-v2-large.md
XBai-o4-4bit-DWQreasoninggenerationxbai-o4-4bit-dwq.pyxbai-o4-4bit-dwq.md
bge-m3-mlx-8bitembeddingembeddingbge-m3-mlx-8bit.pybge-m3-mlx-8bit.md
csm-1b-fp16ttsttscsm-1b-fp16.pycsm-1b-fp16.md
demucs-mlxaudio-fxaudio-fxdemucs-mlx.pydemucs-mlx.md
gemma-3-27b-it-4bit-DWQchatgenerationgemma-3-27b-it-4bit-dwq.pygemma-3-27b-it-4bit-dwq.md
gpt-oss-120b-MXFP4-Q8reasoninggenerationgpt-oss-120b-mxfp4-q8.pygpt-oss-120b-mxfp4-q8.md
gpt-oss-20b-MXFP4-Q8reasoninggenerationgpt-oss-20b-mxfp4-q8.pygpt-oss-20b-mxfp4-q8.md
medgemma-1.5-4b-it-4bitmedicalvisionmedgemma-1-5-4b-it-4bit.pymedgemma-1-5-4b-it-4bit.md
multilingual-e5-large-mlxembeddingembeddingmultilingual-e5-large-mlx.pymultilingual-e5-large-mlx.md
orpheus-3b-0.1-ft-4bitttsttsorpheus-3b-0-1-ft-4bit.pyorpheus-3b-0-1-ft-4bit.md
parakeet-tdt-0.6b-v3sttsttparakeet-tdt-0-6b-v3.pyparakeet-tdt-0-6b-v3.md
snowflake-arctic-embed-l-v2.0-8bitembeddingembeddingsnowflake-arctic-embed-l-v2-0-8bit.pysnowflake-arctic-embed-l-v2-0-8bit.md
whisper-large-v3-turbosttsttwhisper-large-v3-turbo.pywhisper-large-v3-turbo.md
LFM2.5-ColBERT-350M-mxfp4retrievalretrievallfm2-5-colbert-350m-mxfp4.pylfm2-5-colbert-350m-mxfp4.md
llama-guard-3-1bguardrailgenerationllama-guard-3-1b.pyllama-guard-3-1b.md
GLM-4.6-REAP-218B-A32B-mlx-3Bitreasoningllmglm-4-6-reap-218b-a32b-mlx-3bit.pyglm-4-6-reap-218b-a32b-mlx-3bit.md
MiniMax-M2.7-REAP-139B-A10B-MLX-4bitagenticollmminimax-m2-7-reap-139b-a10b-mlx-4bit.pyminimax-m2-7-reap-139b-a10b-mlx-4bit.md
c4ai-command-a-03-2025-4bitchatllmc4ai-command-a-03-2025-4bit.pyc4ai-command-a-03-2025-4bit.md
Athene-V2-Chat-8bitchatllmathene-v2-chat-8bit.pyathene-v2-chat-8bit.md
Leitura técnica com ressalvas

Evidência, limite e decisão · leitura de especialista

Como um especialista em IA avaliaria este conteúdo

Leia esta página com duas lentes ao mesmo tempo: valor prático para o usuário e força da evidência técnica. O objetivo não é decorar jargão, é saber o que pode virar recomendação pública e o que ainda precisa de teste.

Checklist técnico: Evidência, Ambiente, Baseline, Métrica, Repetição, Erro, Risco, Limites e Decisão precisam estar claros antes de transformar qualquer afirmação em recomendação.

Evidência mínima

O guia deve provar que o modelo foi escolhido por tarefa, cabe no Mac sugerido com ressalvas e tem teste curto de validação.

Risco principal

Comando sem contexto, dependência excessiva ou modelo pesado demais para a memória real do usuário.

Pergunta de auditoria

O usuário consegue saber o que instalou, por que instalou e como confirmar que funcionou?