Foundation Models no iOS 27: controle de chamada de ferramentas
O iOS 27 adiciona GenerationOptions.ToolCallingMode para orientar o uso de ferramentas pelo modelo no dispositivo, mais OCRTool e BarcodeReaderTool.
AI & TechnologyReflexões sobre design, desenvolvimento, infraestrutura de IA e criação de produtos.
O iOS 27 adiciona GenerationOptions.ToolCallingMode para orientar o uso de ferramentas pelo modelo no dispositivo, mais OCRTool e BarcodeReaderTool.
AI & TechnologyCore AI é o framework de execução de modelos do iOS 27: asset versus model, tensores NDArray e inferência no Apple silicon.
AI & TechnologyA WWDC26 tornou o Metal uma superfície de ML de primeira classe: Metal tensors, o neural accelerator do M5, neural rendering em tempo real e MLX Swift.
AI & TechnologySwift 6.3 e 6.4 da WWDC26: disponibilidade anyAppleOS, seletores de módulo, acessadores borrow/mutate, protocolo Iterable e interoperabilidade com MLX.
AI & TechnologyAI agents have two untrusted inputs: code the model writes and tool output it reads. One now has a real WASM sandbox; the other, MCP tool poisoning, does not.
AI & TechnologyO framework Foundation Models da Apple: LanguageModelSession, geração guiada com @Generable, chamada de ferramentas e quando abandonar o modelo local.
AI & TechnologyGeoffrey Hinton apostou em redes neurais inspiradas no cérebro durante dois invernos da IA, quando a área as ridicularizava: convicção acima da moda.
Engineering & CraftSophie Wilson projetou o conjunto de instruções ARM — hoje em quase todo celular do mundo — com uma equipe minúscula e uma eficiência RISC implacável.
Engineering & CraftO Swift 6.2 inverte a concorrência: padronize seu módulo para MainActor (SE-0466), execute async nonisolated no chamador (SE-0461), escape com @concurrent.
AI & TechnologyO framework Translation da Apple: tradução on-device gratuita via translationPresentation e TranslationSession, mais as arestas do download offline.
AI & TechnologyJim Keller projetou os chips por trás da AMD, do iPhone e do Autopilot da Tesla — gastando silício para eliminar gargalos.
Engineering & CraftLeCun ergueu a visão computacional sobre a convolução e depois apostou que a inteligência real vem do aprendizado não supervisionado, não de LLMs maiores.
Engineering & CraftRedação técnica em Introl
Recomendações abrangentes de hardware e análise de custos para executar modelos de linguagem grandes localmente.
Guia de seleção de GPU comparando os mais recentes aceleradores de datacenter da NVIDIA para diferentes cargas de trabalho de IA.
Análise técnica aprofundada da evolução da Unidade de Processamento Tensor do Google, do TPUv1 ao TPUv5.
Estratégias de compartilhamento de recursos para clusters de GPU em ambientes containerizados.
Guia para construir e gerenciar computação de IA distribuída com o framework Ray.
Análise da economia de LLMs de código aberto e do posicionamento competitivo da DeepSeek.
Requisitos futuros de energia para datacenters e o roteiro de GPUs de próxima geração da NVIDIA.
Soluções de reatores modulares pequenos para alimentar a infraestrutura de IA de próxima geração.
Análise técnica das inovações da arquitetura Multi-Head Compression da DeepSeek.