Перейти до вмісту
ATAI Today Brief
ГоловнаНовиниКонцептиГайдиІнструменти
Про насПідписатисяEN
Підписатися

AI Today Brief

Щоденний бриф з AI-інженерії. Built in public. EN · UA.

XTelegramLinkedInYouTubeRSS

Слідкуйте за AI Today Brief у LinkedIn — щоденні оновлення з AI-інженерії та тижневий PDF «5 shifts that changed how developers work».

Огляд

НовиниДайджестиКонцептиГайди

Компанія

ПідписатисяРекламаПро нас

Правове

Редакційна політикаAI-розкриттяПриватністьУмови

© 2026 AI Today Brief. Усі права захищені.

  1. Головна/
  2. Новини/
  3. Локальні LLM/
  4. TurboFieldfare: запуск Gemma 4 26B на Apple Silicon із 2 ГБ оперативної пам'яті
Локальні LLM

TurboFieldfare: запуск Gemma 4 26B на Apple Silicon із 2 ГБ оперативної пам'яті

29 липня 2026 р.· 3 хв читання
OKКуратор Oleksandr Kuzmenko, AI Product Engineer·Оновлено 29 липня 2026 р.·Джерела вказані в кожному матеріалі
За участі AI · перевірено редактором·Як ми використовуємо AI
TurboFieldfare: запуск Gemma 4 26B на Apple Silicon із 2 ГБ оперативної пам'яті

TurboFieldfare — це спеціалізоване середовище виконання на Swift та Metal, яке дозволяє запускати модель Gemma 4 на 26 мільярдів параметрів на комп'ютерах Mac із обмеженою оперативною пам'яттю. Завдяки потоковому завантаженню експертів із SSD замість завантаження всієї моделі в ОЗП, воно забезпечує ефективну роботу навіть на пристроях із 8 ГБ пам'яті.

Вплив: Високий

Чому це важливо

Це дозволяє запускати масивні моделі на обладнанні з низьким обсягом пам'яті.

TL;DR

  • 01Запускає модель на 26B в межах ~2 ГБ оперативної пам'яті.
  • 02Використовує Swift та Metal.

Ключові факти

Вимоги до оперативної пам'яті
~2 ГБ

Архітектура та потокове передавання з SSD

На кожному шарі трансформера Metal обчислює механізм уваги та роутер на основі резидентних ваг. Процесор використовує top-8 ідентифікаторів експертів роутера для планування завантаження у 16-слотовий LFU-кеш шару, після чого заповнює пропуски за допомогою обмежених паралельних викликів pread у буфери, видимі для Metal. Metal обчислює резидентну гілку спільних експертів паралельно з цими зчитуваннями, а потім об'єднує виходи.

#TurboFieldfare#Swift#Metal
ПоділитисяПоділитися в XПоділитися в LinkedIn
← Попередня новинаЗвіт OpenAI: як кодингові агенти прискорюють модернізацію та рефакторинг софтуНаступна новина →Tokenless: паралельна маршрутизація запитів для оптимізації витрат на API

Email-дайджест

Отримуйте ранковий AI-бриф

Один лист на день — історії, що важливі для інженерів, фаундерів і техлідів. Редагує людина, з посиланнями на першоджерела.

  • ✓120+ джерел щодня
  • ✓Редагує людина
  • ✓1 лист на день
  • ✓EN + UA

Підписуючись, ви погоджуєтесь з політикою конфіденційності.