DeepSeek, китайската лаборатория, чиито евтини модели разтърсиха AI индустрията в началото на 2025 г., обяви, че системата V4 излиза от тестов период и получава официален релийз в средата на юли. Промяната идва с неочакван обрат: за първи път компанията ще таксува разработчиците двойно по-скъпо за използване на модела в пиковите дневни часове.
Според доклад на TechNode, по-високата тарифа важи в делнични дни от 9:00 до 12:00 ч. и от 14:00 до 18:00 ч. пекинско време. Извън тези интервали цените остават непроменени. От компанията заявиха, че потребителите ще получават предупреждение по имейл 24 часа преди всяка промяна в таксуването.
Цифрите показват как точно работи планът. За най-мощния модел, deepseek-v4-pro, изходящите данни (output) стандартно струват 6 юана на милион токена (около $0.85). В пиковите часове цената скача двойно до 12 юана (около $1.70). По-лекият модел deepseek-v4-flash поскъпва от 2 на 4 юана на милион токена в същите времеви прозорци. Токените са малките парчета текст, които моделът чете и генерира, и служат за база при таксуването на услугата.
V4 се появи за първи път като предварителна версия (open-weight preview) на 24 април. Официалната версия запазва основното предимство на превюто – контекстен прозорец от 1 милион токена за цялата линия, което означава, че моделът може да обработва огромни обеми от текст наведнъж. От DeepSeek посочват, че актуализацията подобрява и представянето при писане на код, математически задачи и автономни агенти (tasks running several steps). По-старите модели на компанията, deepseek-chat и deepseek-reasoner, ще бъдат спрени на 24 юли.
Този ход е изненадващ, тъй като именно DeepSeek започна ценовата война в Китай с изключително евтините си токени, а наскоро направи постоянна 75%-а отстъпка за V4. Въвеждането на по-високи цени в пиковите часове работи в обратната посока. Официалната причина е капацитетът: когато пристигнат твърде много заявки едновременно, на DeepSeek не им достигат чипове за обработката им. По-високата пикова цена стимулира прехвърлянето на неспешни задачи в по-спокойните часове, което според компанията ще стабилизира услугата при голямо натоварване.
Извън техническите детайли, това ценообразуване отразява реална инженерна оптимизация, а не просто дъмпинг (loss-leader). Анализирайки предварителната версия през април, независимият разработчик Саймън Уилисън отбеляза, че V4-Pro е най-евтиният сред големите водещи модели благодарение на ефективност, която намалява паметта, необходима за всяка заявка. Тази база поддържа DeepSeek евтин дори и след пиковото надбавяне – OpenAI и Anthropic все още таксуват многократно повече за токен.
Часовата разлика е в полза на разработчиците извън Китай. Пиковият блок в Пекин съвпада с нощните часове в САЩ (приблизително от 21:00 до 6:00 ч. източно време), така че американските екипи, работещи в рамките на своя бизнес ден, ще хванат по-евтината тарифа. За всички останали обаче една и съща заявка ще струва една цена в 13:00 ч. и наполовина по-малко вечерта, превръщайки времето за стартиране на дадена задача във финансово решение. Важно уточнение: официалната ценова страница на DeepSeek все още показва фиксираните тарифи, така че пиковите цени трябва да бъдат потвърдени, след като компанията ги публикува официално. Големият сигнал тук е, че ерата на фиксираните и постоянно падащи AI цени може да започне да се променя, и именно най-евтиният играч на пазара я променя първи.