Перейти до вмісту
ATAI Today Brief
ГоловнаНовиниКонцептиГайдиІнструменти
Про насПідписатисяEN
Підписатися

AI Today Brief

Щоденний бриф з AI-інженерії. Built in public. EN · UA.

XTelegramLinkedInYouTubeRSS

Слідкуйте за AI Today Brief у LinkedIn — щоденні оновлення з AI-інженерії та тижневий PDF «5 shifts that changed how developers work».

Огляд

НовиниДайджестиКонцептиГайди

Компанія

ПідписатисяРекламаПро нас

Правове

Редакційна політикаAI-розкриттяПриватністьУмови

© 2026 AI Today Brief. Усі права захищені.

  1. Головна/
  2. Новини/
  3. Інструменти й релізи/
  4. Hetzner запускає безкоштовний експериментальний API інференсу LLM
Інструменти й релізи

Hetzner запускає безкоштовний експериментальний API інференсу LLM

24 липня 2026 р.· 3 хв читання
OKКуратор Oleksandr Kuzmenko, AI Product Engineer·Оновлено 24 липня 2026 р.·Джерела вказані в кожному матеріалі
За участі AI · перевірено редактором·Як ми використовуємо AI
Hetzner запускає безкоштовний експериментальний API інференсу LLM

Hetzner випустила експериментальний API інференсу, сумісний з OpenAI, який працює на власній європейській інфраструктурі. Розробники можуть протестувати Qwen3.6-35B-A3B-FP8 із низькою затримкою за допомогою стандартних OpenAI SDK або OpenCode.

Вплив: Середній

Чому це важливо

Ви можете спрямувати свої агентні фреймворки та локальні кодинг-асистенти на швидкий безкоштовний європейський ендпоінт уже зараз.

TL;DR

  • 01Hetzner надає безкоштовний OpenAI-сумісний ендпоінт для Qwen3.6-35B-A3B-FP8 із контекстом 262K.
  • 02Швидкість генерації перевищує 220 токенів на секунду при TTFT у 153 мс.
  • 03Недокументований параметр `enable_thinking` дозволяє вмикати ланцюжок міркувань.

Ключові факти

262 000 токенівКонтекстне вікно
153 мсМедіанний TTFT
224 токени/секШвидкість генерації
Доступна модель
Qwen/Qwen3.6-35B-A3B-FP8
Контекстне вікно
262 000 токенів
Медіанний TTFT
153 мс
Швидкість генерації
224 токени/сек
Ціна
Безкоштовно під час тесту

Налаштування експериментального ендпоінту

Hetzner надає базовий URL https://inference.hetzner.com/api/v1, сумісний із кодом OpenAI. Для початку роботи необхідно створити токен у панелі Hetzner Experiments та вказати нову адресу в клієнтській бібліотеці.

Характеристики моделі та продуктивність

Модель Qwen/Qwen3.6-35B-A3B-FP8 займає близько 38 ГБ відеопам'яті. Перші виміри показують:

  • Затримка до першого токена (TTFT): 153 мс на відкритому з'єднанні.
  • Швидкість генерації: 224 токени/сек при ліміті генерації в 512 токенів.
  • Прапор роздумів: Передача enable_thinking: true активує генерацію проміжних ланцюжків міркувань.

Спробуй за 2 хвилини

from openai import OpenAI

client = OpenAI(
    base_url="https://inference.hetzner.com/api/v1",
    api_key="YOUR_HETZNER_EXPERIMENTS_TOKEN"
)

response = client.chat.completions.create(
    model="Qwen/Qwen3.6-35B-A3B-FP8",
    messages=[{"role": "user", "content": "Explain LLM prompt caching in one clear sentence."}]
)

print(response.choices[0].message.content)

python

✓ Коли використовувати

  • Порівняльне тестування швидкості відкритих моделей проти пропрієтарних API.
  • Запуск локальних агентних циклів без витрат на токени.

✕ Коли НЕ варто

  • Продакшн-системи, які вимагають суворого SLA та гарантій доступності.
  • Проєкти з регуляторними вимогами щодо фіксованого розкриття інфраструктури.

Що зробити сьогодні

  • →Згенеруйте токен API у панелі Hetzner Experiments.
  • →Змініть base_url в OpenAI SDK на https://inference.hetzner.com/api/v1 для тестування агентів.
  • →Підключіть OpenCode до безкоштовного європейського ендпоінту.

Що каже спільнота

  • “Interesting, didn’t know about them! Weird model selection though, no glm or deepseek?”

    — jonas_scholz на Hacker News

#Hetzner#OpenAI SDK#OpenCode#Qwen

Джерела

  • Hetzner is working on LLM Inference
ПоділитисяПоділитися в XПоділитися в LinkedIn
← Попередня новинаCodeberg забороняє репозиторії на базі LLM: зміна політики викликає дебати про управління відкритим кодомНаступна новина →OpenAI додає ChatGPT Voice у десктопний застосунок для голосування в Codex

Схожі матеріали

  • Інструменти й релізиПрактичне порівняння моделей: швидкість Grok 4.5 проти міркувань Claude Fable 5
  • Інструменти й релізиGrafana випустила Go LLM SDK із підтримкою React-хуків від Vercel AI SDK
  • Інструменти й релізиOpenAI випустила консольну утиліту та TypeScript SDK Codex Security для аудиту коду
  • Інструменти й релізиПлагін i-have-adhd вилучає зайві вступи з відповідей AI-асистентів

Email-дайджест

Отримуйте ранковий AI-бриф

Один лист на день — історії, що важливі для інженерів, фаундерів і техлідів. Редагує людина, з посиланнями на першоджерела.

  • ✓120+ джерел щодня
  • ✓Редагує людина
  • ✓1 лист на день
  • ✓EN + UA

Підписуючись, ви погоджуєтесь з політикою конфіденційності.