Core ML 端侧推理:真正能落地上线的模式
Core ML 在 Neural Engine、GPU 或 CPU 上运行模型。真正能落地上线的模式包括:模型转换、调度提示、延迟预算与量化。
AI & Technology关于设计、开发、AI基础设施和产品构建的思考。
Core ML 在 Neural Engine、GPU 或 CPU 上运行模型。真正能落地上线的模式包括:模型转换、调度提示、延迟预算与量化。
AI & TechnologyiOS 18 引入了 Writing Tools。iOS 26 让标准文本视图只需一个属性即可接入,并为自定义文本引擎提供了精心设计的协调器 API。
AI & TechnologyiOS、iPad、Mac、Watch、Vision、TV。六个平台,六份责任。选择Apple目标平台首先是产品决策,其次才是工程决策。
AI & TechnologyiOS 26 推出了带有 SpeechTranscriber 与 SpeechDetector 模块的 SpeechAnalyzer,作为 SFSpeechRecognizer 的端侧替代方案。何时该迁移?
AI & Technology一个博客集群的声音来自于它拒绝发表的内容,而非它发布的内容。类别性、模式性和有趣的拒绝各自塑造着集群的本质。
AI & Technology每个iOS应用的能力都面向三个界面:人类、Apple Intelligence、智能体。每个界面都有不同的义务、渲染、延迟和信任态势。
AI & Technology两个LLM接触一个 Swift 应用。一个是随应用一起发布的设备端模型,另一个是编写代码的智能体。不同的技术栈,不同的责任。
AI & TechnologyiOS代理可以访问开发者的签名密钥、构建系统和项目文件。Hooks用于限制影响范围。四种已投入生产的模式。
AI & Technology三个调用方可以写入同一份购物清单:人类、Apple Intelligence 和外部代理。真相必须存放在某处。请选择基础载体。
AI & TechnologyReturn的Live Activity看起来像锁屏倒计时。它实际上是一个具有三条退出路径的五状态生命周期机器。生产代码与那些bug。
AI & TechnologyiOS 26 的 Foundation Models 框架在每台 Apple Intelligence 设备上部署了 30 亿参数的LLM。Tool 协议是让该模型变得有用的核心接口。
AI & TechnologywatchOS没有iOS式的后台。WKExtendedRuntimeSession就是契约;若不使用,应用会在落腕时挂起。Return已落地此模式。
AI & Technology技术写作: Introl
本地运行大型语言模型的全面硬件建议和成本分析。
针对不同AI工作负载比较NVIDIA最新数据中心加速器的GPU选择指南。
深入技术分析Google张量处理单元从TPUv1到TPUv5的演进。
容器化环境中GPU集群的资源共享策略。
使用Ray框架构建和管理分布式AI计算的指南。
开源LLM经济学分析和DeepSeek的竞争定位。
未来数据中心电力需求和NVIDIA下一代GPU路线图。
为下一代AI基础设施供电的小型模块化反应堆解决方案。
DeepSeek多头压缩架构创新的技术分析。