Inférence Core ML sur l'appareil : les patterns qui partent vraiment en production
Core ML exécute des modèles sur le Neural Engine, le GPU ou le CPU. Les patterns qui tiennent : conversion de modèle, orientation de la répartition, budgets de latence et quantification.
AI & Technology