Bonsai 27B: мощный reasoning-LLM, который помещается в iPhone
PrismML сжала 27-миллиардную reasoning-модель до менее 4 ГБ — она запускается прямо на iPhone без облака. Apple, по имеющимся данным, уже тестирует технологию сжатия.
Публикаций: 4
PrismML сжала 27-миллиардную reasoning-модель до менее 4 ГБ — она запускается прямо на iPhone без облака. Apple, по имеющимся данным, уже тестирует технологию сжатия.
Редактор The Verge Nilay Patel сказал вслух то, что индустрия предпочитает замалчивать: AR-очки в нормальном формфакторе физически невозможны без постоянной облачной обработки всего, что вы видите. Это не вопрос будущего — это архитектурное ограничение прямо сейчас.
Apple наконец показала Siri AI с реальной начинкой: лицензированная модель на базе Gemini, vision-LLM для чтения экрана и новый Core AI-фреймворк поверх PyTorch. Но рынок держит скептицизм — слишком больно обожглись на обещаниях WWDC 2024.
Google DeepMind опубликовала QAT-чекпоинты для Gemma 4 — формат Q4_0 и новый мобильный вариант, которые радикально снижают потребление памяти при on-device инференсе. Граница между облачным и локальным ИИ становится тоньше.