Будь-який інженер, який розуміє економіку датацентрів та інференсу сучасних моделей, скаже те саме що і я:
коли компанія раптово відмовляється брати найдорожчих, найприбутковіших клієнтів по $200 на місяць, причина майже ніколи не полягає у раптовому «напливі звичайних покупців».Це класичний симптом
внутрішньої реквізиції обчислювальних потужностей.
Це виглядає як OpenAI перевела свою інфраструктуру на «військовий стан»:
1.Чому саме план за $200 (Pro)?
План за $200 купують не для того, щоб питати рецепти млинців чи генерувати вірші.
Його купують розробники, дослідники, математики, які експлуатують модель на 100%: вони запускають моделі класу Astra на максимальні зусилля мислення, навантажують контекстне вікно довгими ланцюгами агентських викликів і викачують гігавати обчислень.
У плані Pro один активний користувач за рахунок багатокрокового міркування може за день спожити стільки FLOPs, скільки кілька сотень користувачів звичайного ChatGPT Plus за $20.
Заморозити підписку на $200 - це найефективніший вентиль, щоб негайно зупинити витік найцінніших H100/H200/B200 кластерів назовні.
2. Внутрішній канібалізм: Сервіс проти Наукового прориву
Усередині OpenAI завжди існує жорсткий конфлікт за ресурси між двома підрозділами:
Продуктова команда: їм потрібні GPU, щоб продавати підписки, збільшувати виручку та задовольняти користувачів.
Команда фундаментальних досліджень: їм потрібні ті самі GPU для тренування наступних поколінь GPT і для масивних агентських запусків у Lean.
Коли комерційний відділ каже: «Вибачте, ми не беремо нових клієнтів, які готові платити нам у 10 разів більше за звичайну підписку», це означає лише одне: дослідницький відділ прийшов до керівництва з ультиматумом.
Якщо на кону стоїть закриття Гіпотези Ходжа, перемога над Anthropic та статус творців першого повноцінного AGI, жоден фінансовий директор не стане сперечатися через пару мільйонів доларів від підписок.
3. Збіг у часі надто ідеальний, щоб бути випадковим
Подивіться на хронологію:
8 вересня: Оголошення про розв'язання Нав'є–Стокса за допомогою кластера на 10 000 агентів.
9–10 вересня: Витік інформації в The New York Times про «значний прогрес над іншою проблемою» та чутки про фінальну стадію перевірки Гіпотези Ходжа.
10 вересня: Заява про екстрену паузу найважчого тарифу за $200 через «перевантаження систем».
Для того, щоб перевірити таку колосальну конструкцію, як Гіпотеза Ходжа в Lean, потрібні не просто звичайні тренувальні сервери, а ті самі інференс-кластери з надшвидкою пам'яттю, які обслуговують Astra. Їм потрібно ганяти мільйони паралельних спроб доведення лем за секунду. Вони буквально зняли ці чипи з публічного сервісу і перекинули їх на внутрішній математичний кластер.
4. Історичний прецедент
OpenAI робить так не вперше, але раніше масштаби були іншими:
У листопаді 2023 року після DevDay Сем Альтман уже писав: «we are pausing new ChatGPT Plus sign-ups», але тоді це був звичайний наплив людей на GPT-4.
Сьогодні ситуація принципово інша: вони залишають відкритим базовий доступ для мільйонів простих людей, але перекривають кран саме для важких обчислень.
Підсумок
Коли казино припиняє пускати за VIP-столи нових багатих гравців - це означає, що
за головним столом у закритій кімнаті зараз іде гра на весь банк.Схоже, моя підозра абсолютно виправдана: «високий попит» - це внутрішній апетит рою агентів, які прямо зараз на максимальних обертах спалюють теравати енергії, щоб видати світу наступне епохальне математичне оголошення раніше за конкурентів.