Apple is in discussions with PrismML, a Caltech startup that compressed a 54 GB AI model to under 4 GB for on-device iPhone use, potentially reshaping

PrismML says its compressed version of Alibaba’s Qwen model uses up to 15 times less memory, potentially advancing Apple’s AI push.

Apple is reportedly negotiating with PrismML to compress massive AI models for on-device iPhone use, with implications for privacy, computing, and crypto