На 3 август Alibaba представи Qwen3.8-Max — определян от компанията като най-големия и най-способния ѝ AI модел до момента. Оттам заявиха, че резултатите му в няколко индустриални теста вече съперничат на тези на Claude на Anthropic, но на много по-ниска цена. Новината изпрати акциите на Alibaba в Хонконг с над 6% нагоре.

Qwen3.8-Max разполага с общо 2,4 трилиона параметъра, но използва архитектура от типа „смес от експерти“ (mixture-of-experts), която насочва всяка заявка през едва около 95 милиарда от тях, поддържайки оперативните разходи ниски. Моделът поддържа различни формати — обработва текст, изображения и видео — и може да прочита до един милион входящи токена наведнъж, което се равнява приблизително на една дебела книга.

Най-впечатляващото число обаче е цената. Alibaba таксува 2 долара за милион входящи токена и 6 долара за милион изходящи токена. Това е около 40% от цената, която Anthropic иска за входящ текст при Claude Opus 5, и приблизително една четвърт от изходящата му цена от 25 долара. В LMArena — публична класация, в която потребителите гласуват за предпочитаните отговори — моделът се класира на второ място в категорията за компютърно зрение и на пето място за текст. Това го прави най-високо поставеният китайски текстов модел, макар и все още зад семейството Claude на Anthropic.

В собствените си публикувани тестове Alibaba посочва, че Qwen3.8-Max води при определени задачи за програмиране и за AI агенти, постигайки 86,6 точки на Terminal-Bench 2.1 (тест за AI агенти, работещи с команден ред) спрямо 84,6 за Claude Opus 4.8. Моделът обаче изостава в други области, като софтуерно инженерния бенчмарк SWE-bench Pro и труден изпит за разсъждения. Тези данни произлизат от вътрешни тестове на Alibaba, като при пускането липсваха независими проверки, а компанията все още не беше публикувала карта на модела (model card) или методология. Alibaba планира да предостави теглата на модела за безплатно изтегляне през следващата седмица, заедно с много по-малък вариант с 27 милиарда параметъра, който може да работи на обикновен хардуер.

Премиерата идва седмица след като Moonshot AI пусна Kimi K3 — модел с отворени тегла и 2,8 трилиона параметъра. Разгледани заедно, двете събития показват обща стратегия сред китайските лаборатории: да се доближат максимално до способностите на западните модели, след което да спечелят разработчиците с цена и отворен достъп, вместо с оглавяване на дадена класация.

По подобен начин анализаторите тълкуват пазарната реакция. От Citi заявиха пред клиентите си, че ръстът на акциите „вероятно отразява положителни очаквания за облачните приходи“ и подобрените резултати на модела. Те обаче предупредиха, че честите премиери тласкат компаниите към подход, независим от конкретния модел („model-agnostic“), при който се избира най-евтиният вариант за всяка конкретна задача. Според Citi това премахва трайното предимство на когото и да било.

Външните изследователи ще могат да направят свои тестове, щом отворените тегла бъдат публикувани. За купувачите съществената промяна, която си струва да се следи, не е кой печели бенчмарковете този месец, а колко още ще падат цените на най-съвременните AI модели.