Перейти до вмісту
ГоловнаНовиниДайджестиКонцептиГайдиІнструменти
Про насПідписатисяEN
Підписатися

AI Today Brief

Щоденний бриф з AI-інженерії. Built in public. EN · UA.

XTelegramLinkedInYouTubeRSS

Слідкуйте за AI Today Brief у LinkedIn — щоденні оновлення з AI-інженерії та тижневий PDF «5 shifts that changed how developers work».

Огляд

НовиниДайджестиКонцептиГайди

Компанія

ПідписатисяРекламаПро нас

Правове

Редакційна політикаAI-розкриттяПриватністьУмови

© 2026 AI Today Brief. Усі права захищені.

  1. Головна/
  2. Новини/
  3. Моделі й дослідження/
  4. Практики даних OpenAI викликають занепокоєння щодо інтелектуальної власності у ChatGPT та Codex
Моделі й дослідження

Практики даних OpenAI викликають занепокоєння щодо інтелектуальної власності у ChatGPT та Codex

Математики зажадали від OpenAI роз'яснень щодо використання неопублікованих досліджень із ChatGPT та Codex у моделях компанії. OpenAI визнала, що деідентифіковані дані користувачів могли потрапити у навчання, що вимагає негайного аудиту налаштувань приватності даних.

10 вересня 2026 р.· 5 хв читання
OKКуратор Oleksandr Kuzmenko, AI Product Engineer·Оновлено 10 вересня 2026 р.·Джерела вказані в кожному матеріалі
За участі AI · перевірено редактором·Як ми використовуємо AI
Практики даних OpenAI викликають занепокоєння щодо інтелектуальної власності у ChatGPT та Codex

Вплив: Високий

Чому це важливо

Негайно перевірте налаштування телеметрії в ChatGPT та Codex, щоб уникнути витоку пропрієтарних алгоритмів і непублічного коду в навчальні датасети.

TL;DR

  • 01OpenAI підтвердила, що не може виключити використання деідентифікованих даних із ChatGPT та Codex для навчання нових моделей.
  • 02Деідентифікація прибирає метадані користувача, але залишає в датасеті алгоритмічну логіку, структури коду та математичні ідеї.
  • 03Безкоштовні та стандартні акаунти типово передають дані для навчання, якщо функцію не вимкнено або немає корпоративної угоди про незбереження даних.

Ключові факти

Оголошені математичні результати
10 результатів
Доступ до сесій Нав'є — Стокса
Спростовано OpenAI
Використання деідентифікованих даних
Не виключено OpenAI

Звинувачення у використанні даних для навчання

Математик Андреас Том звинуватив OpenAI у непрозорості після публікації 10 значних математичних результатів, зокрема щодо несофічних груп — нескінченних структур, які неможливо апроксимувати скінченними. За словами Тома, модель відтворила неочевидні техніки, розроблені ним спільно з Габором Куном. Раніше професор Нью-Йоркського університету Трістан Бакмастер також заявив про можливе запозичення його напрацювань через OpenAI Codex під час роботи над рівняннями Нав'є — Стокса разом із дослідником Anthropic Левентом Альпоге.

Проблема деідентифікації даних

У листуванні з дослідниками Себастьяном Бюбеком та Марком Селлке представники OpenAI заперечили прямий перегляд сесій користувачів. Проте компанія офіційно визнала: хоча це малоймовірно, вона не може виключити, що деідентифіковані дані взаємодії з сервісами допомогли покращити моделі. Видалення ідентифікаторів усуває персональні дані акаунта, але зберігає логіку алгоритмів, архітектурні структури та математичні формули в пулах для тренування.

Захист кодової бази та промптів

Інженерам, які використовують агентні IDE та чат-боти для закритих проєктів, варто ретельно контролювати налаштування збору телеметрії. Для чутливих алгоритмів необхідно використовувати робочі простори з гарантією Zero Data Retention або вручну вимикати передачу даних на навчання, оскільки стандартні налаштування часто вмикають тренування за замовчуванням.

Що зробити сьогодні

  • →Відкрийте налаштування Data Controls у ChatGPT та переконайтеся, що пункт покращення моделей вимкнено для всіх акаунтів команди.
  • →Перевірте конфігурацію API-ключів та плагінів агентних IDE на активність режиму Zero Data Retention.
  • →Встановіть внутрішні правила, які забороняють надсилати незакомічені пропрієтарні алгоритми в публічні інтерфейси LLM.

Що каже спільнота

  • “If I were a business, I wouldn't want my proprietary business information into a hands of a competitor. But CEOs are racing to do it, and (at best) relying in flimsy contractual guarantees...”

    — palmotea на Hacker News

  • “See other post today about where OpenAI keeps flipping the toggle back to “share.” Even if it was technically turned on, the dark patterns that are clearly trying to override the obvious intent...”

    — cmiles8 на Hacker News

#ChatGPT#OpenAI Codex

Джерела

  • Where does OpenAI get mathematics training data? (The Verge)
  • Hacker News Discussion on OpenAI Data Practices
ПоділитисяПоділитися в XПоділитися в LinkedIn
← Попередня новинаHugging Face перебудувала AUTOMATIC1111 у Gradio Workflow із підтримкою Model Context Protocol

Схожі матеріали

  • Моделі й дослідженняДистиляція меж запитів знижує хибні відмови великих мовних моделей до чотирьох відсотків
  • Моделі й дослідженняAnthropic випустила згенерований ШІ-агентами доказ великої теореми Ферма в Lean 4
  • Моделі й дослідженняInclusionai випустила відкриту MoE-модель Ling-3.0-flash на 124 мільярди параметрів
  • Моделі й дослідженняМультимодальні енкодери NeoMME забезпечують візуальний пошук документів зі швидкістю 51 сторінка на секунду

Email-дайджест

Отримуйте ранковий AI-бриф

Один лист на день — історії, що важливі для інженерів, фаундерів і техлідів. Редагує людина, з посиланнями на першоджерела.

  • ✓120+ джерел щодня
  • ✓Редагує людина
  • ✓1 лист на день
  • ✓EN + UA

Підписуючись, ви погоджуєтесь з політикою конфіденційності.