§ feed · storyline
Optimizing On-Device Inference for Apple Silicon
Perplexity releases Lily, a local inference engine optimized for running large models on Apple silicon.
Perplexity detailed its Lily local inference engine, optimized specifically for Apple silicon to enable high-performance, on-device AI tasks for models like Qwen3.6-35B-A3B.
§ sources1 publication · timeline below