MLX no Apple Silicon: quando você precisa do seu próprio modelo, e não do da Apple
O Foundation Models entrega o LLM on-device lacrado da Apple. O MLX roda o seu: modelos open-weight quantizados e fine-tunes LoRA no Apple Silicon.
AI & TechnologyReflexões sobre design, desenvolvimento, infraestrutura de IA e criação de produtos.
O Foundation Models entrega o LLM on-device lacrado da Apple. O MLX roda o seu: modelos open-weight quantizados e fine-tunes LoRA no Apple Silicon.
AI & TechnologySatoru Iwata foi o programador que virou presidente da Nintendo sem nunca deixar de ser gamer: maestria técnica a serviço da alegria de quem joga.
Engineering & CraftO framework Translation da Apple: tradução on-device gratuita via translationPresentation e TranslationSession, mais as arestas do download offline.
AI & TechnologyO Swift 6.2 inverte a concorrência: padronize seu módulo para MainActor (SE-0466), execute async nonisolated no chamador (SE-0461), escape com @concurrent.
AI & TechnologyMark Shuttleworth construiu o Ubuntu sobre uma ideia: Linux para seres humanos, software livre para todos, com prazo certo.
Engineering & CraftRich Hickey construiu Clojure e Datomic sobre uma distinção: simples não é fácil. Simples é não entrelaçado; fácil é apenas familiar.
Engineering & CraftGrace Hopper criou o primeiro compilador para programar em linguagem humana, tornou a latência física com seu fio de um nanossegundo e enfrentou o dogma.
Engineering & CraftDonald Knuth trata a programação como arte escrita para humanos. Meça antes de cortar, otimize só os 3% críticos e prove a correção com ofício.
Engineering & CraftBarbara Liskov tornou a abstração de dados uma primitiva: um tipo é o contrato que cumpre, e um subtipo precisa honrar as promessas do supertipo.
Engineering & CraftThompson e Ritchie construíram Unix e C com ferramentas pequenas e afiadas, unidas por uma interface universal: fluxos de texto e pipes.
Engineering & CraftBjarne Stroustrup construiu C++ sobre a sobrecarga zero: código expressivo sem abrir mão da velocidade no metal.
Engineering & CraftGuido van Rossum construiu Python sobre uma única aposta: código é lido muito mais do que escrito, então a linguagem deve ser otimizada para quem lê.
Engineering & CraftRedação técnica em Introl
Recomendações abrangentes de hardware e análise de custos para executar modelos de linguagem grandes localmente.
Guia de seleção de GPU comparando os mais recentes aceleradores de datacenter da NVIDIA para diferentes cargas de trabalho de IA.
Análise técnica aprofundada da evolução da Unidade de Processamento Tensor do Google, do TPUv1 ao TPUv5.
Estratégias de compartilhamento de recursos para clusters de GPU em ambientes containerizados.
Guia para construir e gerenciar computação de IA distribuída com o framework Ray.
Análise da economia de LLMs de código aberto e do posicionamento competitivo da DeepSeek.
Requisitos futuros de energia para datacenters e o roteiro de GPUs de próxima geração da NVIDIA.
Soluções de reatores modulares pequenos para alimentar a infraestrutura de IA de próxima geração.
Análise técnica das inovações da arquitetura Multi-Head Compression da DeepSeek.