
BaseRT, da BaseCompute, é o runtime de LLM mais rápido para Apple Silicon. Com um único comando, instale e execute modelos de IA localmente no seu dispositivo, garantindo desempenho e privacidade.
O BaseRT é um runtime de alto desempenho desenvolvido pela BaseCompute, projetado especificamente para hardware Apple Silicon. Ele permite que os usuários instalem e executem modelos de linguagem de grande porte (LLMs) localmente em seus dispositivos com um único comando. A ferramenta é comercializada como o runtime de LLM mais rápido no Apple Silicon, oferecendo melhorias significativas de velocidade em comparação com alternativas como MLX e llama.cpp. Os usuários podem servir modelos diretamente de suas máquinas, mantendo todos os dados no dispositivo, sem necessidade de chaves de API ou chamadas de rede externas.
Desenvolvimento local de IA
Execute e teste modelos de código aberto inteiramente no seu Mac com Apple Silicon, sem dependências de nuvem.
Agentes de codificação
Sirva um modelo localmente e aponte um agente de codificação para ele, permitindo assistência de código privada e offline.
Tarefas que exigem privacidade
Execute cargas de trabalho de IA sem enviar dados do seu dispositivo, ideal para projetos confidenciais ou sigilosos.
Benchmarking de modelos
Compare o desempenho entre modelos usando os benchmarks integrados do BaseRT em relação ao MLX e llama.cpp.
Experimentação da comunidade
Participe de uma comunidade no Discord para engenheiros que trabalham com IA no dispositivo e modelos de código aberto.
Instalação com um comando
Instale o BaseRT com um único comando `curl`: `curl -LsSf https://basecompute.co/install.sh | sh`.
Runtime mais rápido para Apple Silicon
Alcança velocidades de decodificação até 33% mais rápidas e velocidades de preenchimento (prefill) até 6,4x mais rápidas em comparação com o llama.cpp, e preenchimento até 3,9x mais rápido que o MLX.
Servir modelos
Sirva um modelo localmente usando `basert serve basecompute/gemma-4-E4B-it` para acesso imediato.
Integração com agentes de codificação
Instale um plugin dedicado (`pip install git:github.com/basecompute/pi-basert`) para executar agentes de codificação locais com o BaseRT.
Modelos suportados
Funciona com modelos populares de código aberto, incluindo Qwen3, Qwen3.5, Qwen3.6, Llama 3.1, Llama 3.2, Gemma 3, Gemma 4, Mistral, Phi-3 e Nomic BERT.
Suporte da comunidade
Acesse relatórios técnicos, documentação e um repositório no GitHub, além de um servidor no Discord para engenheiros que constroem IA no dispositivo.
O BaseRT é desenvolvido para engenheiros e desenvolvedores que trabalham com IA no dispositivo, especialmente aqueles que precisam executar modelos de código aberto localmente em hardware Apple Silicon. É ideal para pesquisadores de IA, desenvolvedores de ferramentas de codificação e usuários preocupados com a privacidade que desejam evitar dependências de nuvem. A ferramenta também atrai entusiastas e membros da comunidade interessados em benchmarking e experimentação com LLMs em Macs.
curl -LsSf https://basecompute.co/install.sh | sh.basert serve basecompute/gemma-4-E4B-it (ou qualquer modelo suportado).pip install git:github.com/basecompute/pi-basert e execute-o.O BaseRT cumpre sua promessa de ser o runtime de LLM mais rápido para Apple Silicon, com números de benchmark concretos mostrando ganhos substanciais sobre MLX e llama.cpp tanto nas fases de decodificação quanto de preenchimento. A instalação com um comando e o serviço de modelo direto tornam a ferramenta acessível para desenvolvedores que desejam iniciar rapidamente uma IA local sem configuração complexa. A integração com agentes de codificação é um recurso prático para quem constrói ferramentas de desenvolvimento privadas e offline. Embora a ferramenta seja claramente otimizada para Apple Silicon, seu foco em execução local e privacidade está alinhado com as tendências atuais de IA de borda. A comunidade ativa no Discord e os relatórios técnicos disponíveis sugerem um projeto bem suportado, embora o feedback real de usuários além dos benchmarks não seja fornecido no site.
BaseRT, da BaseCompute, é o runtime de LLM mais rápido para Apple Silicon. Com um único comando, instale e execute modelos de IA localmente no seu dispositivo, garantindo desempenho e privacidade.
Category:Ferramenta de treinamento e implantação
Visit Link:https://www.basecompute.co/getbasert
Tags:Apple Silicon、LLM runtime、inferência local、BaseCompute、macOS AI