Modelos de IA en el dispositivo para iOS y macOS
Paquetes de Swift listos para usar que ejecutan modelos pequeños y especializados en el dispositivo, en iOS y macOS, sobre Core ML.
Todos los modelos disponibles de Desert Ant Labs se distribuyen como un paquete de Swift construido sobre Core ML, con async/await de principio a fin y una API que parece salida de AVFoundation.
Añade el paquete en Xcode y llama al modelo. Todo se ejecuta en el dispositivo, así que el audio, las imágenes y el texto nunca salen de él.
Modelos disponibles
Ocultación reversible de PII en 27 idiomas, desde un modelo Core ML de 11,6 MB integrado en la app.
Sugerencias de emojis a partir de texto en menos de 2 ms, lo bastante pequeño para ejecutarse en cada pulsación.
Temas de contenido de cualquier texto en 101 idiomas, desde un modelo Core ML de 74 MB, o una versión solo en inglés de 15 MB.
Ajuste a formas en PencilKit con una sola llamada, desde un modelo Core ML de 0,2 MB, sin descarga.
Mejora de voz DeepFilterNet 3 en Core ML: 302x en tiempo real en un iPhone 16 Pro, un clip de 5 minutos en 1 s.
Detección de muletillas con precisión de trama directamente desde la forma de onda, sin transcripción.
Identificación de idioma para texto corto, entre 84 idiomas, desde un modelo de 2 MB incluido en la app.
Moderación de imágenes NSFW en el dispositivo desde un modelo Core ML de 9,7 MB, así que la comprobación se ejecuta antes de que una subida salga del teléfono.
Marcas de tiempo por palabra más precisas para cualquier transcripción, la mitad de error, desde un modelo Core ML de 0,7 MB. Apple Speech primero.
Shorts y destacados a partir de una transcripción, ordenados, un vídeo de 25 minutos en 9 s en Core ML.
Identificación del idioma hablado en 99 idiomas a partir de 30 segundos de audio, en Core ML.
Un título y una descripción de una o dos frases para cualquier texto, en Apple silicon a través de MLX.
Voz a texto con marcas de tiempo por palabra, 25 idiomas, íntegramente en el Neural Engine: 10 minutos de audio en 2 s en un iPhone.
Disponibles próximamente
Precios
Cada modelo es gratis hasta 100 000 dispositivos activos mensuales. La inferencia es ilimitada.