Anonymous AI Shocks the Internet
45sThe mystery and rapid rise of an unknown AI model captures curiosity and FOMO.
▶ Play Clip"The title promises a look at an anonymous model and its impact, which the video delivers with detailed analysis and a practical test, though the horse-themed humor is a quirky aside."
The video discusses the emergence of OxAlpha, an anonymous AI model that quickly became the most popular on OpenRouter, serving 42 trillion tokens in six days. It explores the speculation about its origin, the eventual reveal as GLM 5.3 Flash by Xipu, and its impressive performance and low cost, including a practical test on a legacy app.
OxAlpha served 42 trillion tokens in six days, becoming the most popular model on OpenRouter and doubling the next closest, DeepSeek.
The model was speculated to be from China, with clues like stack traces matching Zepu API and a tokenizer fingerprint matching GLM series.
A misleading screenshot showing an 80% score on Deep SWE went viral, but the real number was 58%, and some speculated it was a stolen checkpoint.
On August 26, Xipu revealed OxAlpha was GLM 5.3 Flash, a natively multimodal mixture-of-experts model with 320B parameters, MIT-licensed.
The entire stealth run was served on just 100,000 Chinese-made chips, which impacted Silicon Valley sentiment.
After the reveal, pricing was set at 15 cents per million input tokens and 50 cents per million output, with a 50% discount until September 9th.
In a practical test, the model modernized a legacy AngularJS app, fixed a CSS bug using vision, and added humor, showing its capabilities.
How many tokens did OxAlpha serve in its first six days?
42 trillion tokens in its first six days, making it the most popular model on OpenRouter.
What model was OxAlpha revealed to be?
It was revealed to be GLM 5.3 Flash by Xipu on August 26.
02:08
How many total parameters does GLM 5.3 Flash have?
320 billion total parameters.
02:08
What is the pricing for OxAlpha after the reveal?
15 cents per million input tokens and 50 cents per million output tokens.
02:38
How many chips were used to serve the entire stealth run of OxAlpha?
It was served on just 100,000 Chinese-made chips.
02:26
OxAlpha's Rapid Rise
OxAlpha served 42 trillion tokens in six days, doubling the next closest model, showing its immediate popularity.
Hype vs. Reality
A misleading screenshot of an 80% Deep SWE score went viral, but the real number was 58%, illustrating how hype can distort perceptions.
01:54The Reveal
Xipu confirmed OxAlpha was GLM 5.3 Flash, a natively multimodal mixture-of-experts model with 320B parameters, ending the speculation.
02:08Efficiency on Chinese Chips
The entire stealth run was served on just 100,000 Chinese-made chips, highlighting hardware efficiency and impacting Silicon Valley sentiment.
02:26Practical Test on Horsetube
The model successfully modernized a legacy AngularJS app, fixed a CSS bug using vision, and added humor, demonstrating real-world utility.
03:26[00:01] своей татуировкой "Долли Партон слишком быстра для Смерти" , кто-то анонимно выложил в интернет новую модель автомобиля класса "форвард". Они назвали его Ox Alpha. За первые 6 дней было продано 42 триллиона токенов,
[00:14] моделью на Open Router, вдвое превзойдя ближайшего конкурента — DeepS. Оно поставляется с контекстным окном на миллион токенов, принимает видеовход, пишет код так, будто ему трудно устанавливать зрительный контакт, и еще несколько дней назад было совершенно
[00:28] бесплатным. Одни предположили, что это был Джепу, другие — Сяй, а по крайней мере один человек был что-то полезное. В сегодняшнем видео мы рассмотрим, как эта анонимная модель завоевала популярность в интернете, кто за ней стоит, и посмотрим, сможет ли она наконец помочь мне
[00:40] осуществить мою мечту о службе в конном спорте. Сегодня 1 сентября 2026 года, и вы смотрите « Отчет о коде». Не прошло и двух недель с тех пор, как мы обсуждали, как Кремниевая в Китае после выпуска Deep Seek Harness. И, к сожалению,
[00:53] ужасный, кошмарный, никудышный, очень плохой месяц для Даарио и Сэма, возможно, стал еще хуже, потому что эта новая анонимная модель явно была произведена в Китае. Как известно, вещества, выходящие за пределы китайских лабораторий, как правило, оказывают значительное влияние
[01:05] стало то, что Ox Alpha стал пятой анонимной моделью животного, появившейся на предыдущие модели оказались из разработчики заметили совпадение трассировок стека и кодов ошибок с API Zoo, а
[01:20] тест на отпечаток токенизатора показал совпадение с их серией GLM, но никто не стал ждать подтверждения, чтобы начать его использовать. Да, мелким шрифтом было указано, что все ваши запросы будут сохранены некой таинственной, вероятно, иностранной организацией. Но на
[01:32] самом деле никому нет дела до конфиденциальности, когда волшебная коробочка бесплатна и так в него собственный код своей компании, пропускали через него код Claude, чтобы обойти ограничения скорости, и на пике своего развития OX Alpha занимал почти треть всего
[01:45] еженедельного трафика Open Router. Ажиотаж вышел из-под контроля настолько, что вводящий в заблуждение скриншот, показывающий результат в 80% в бенчмарке deepsw S.WE, быстро распространился в интернете, хотя реальное значение оказалось ближе к 58%, и
[01:57] кто-то даже предположил, что результат настолько хорош, что это может быть украденная контрольная точка Клода. И действительно, 26 августа Jepu признался, что Ox Alpha — это GLM 5.3 Flash, изначально многомодальная модель, объединяющая экспертов, с
[02:11] общим числом параметров в 320 миллиардов, и её веса, лицензированные MIT, появились на Hugging Face в тот же день. Но больше всего в Силиконовой долине разочаровала та деталь, что для разработки Stealth использовалось всего 100 000 чипов китайского производства,
[02:23] что, как мне сказали, очень задело Дженсена . Конечно, это также означало, что бесплатные образцы закончились, а анонимный конечный пункт был заменен полноценной страницей с ценами, но цена по-прежнему невероятно низкая — всего 15 центов за
[02:35] миллион входных токенов и 50 центов за миллион выходных. А с 50% скидкой, действующей до 9 сентября, сейчас он в 40 раз дешевле, чем Claude. Как известно, при обычных запусках подобных устройств обычно используется множество тестов,
[02:48] ним кто-либо прикасается. Однако их показатели довольно хорошо выдерживают внешнюю проверку. Подвох в том, что она медленная, любит поболтать и иногда застревает в мрачных петлях. Но, на мой взгляд, есть только один способ проверить,
[03:00] действительно ли это полезно, — использовать это в одном из моих любимых проектов. После неудачной попытки привлечь финансирование для Horse Tinder, я переключился на его некогда любимого родственника, Horse, приложение на Angular.JS, вышедшее в 2016 году, последний коммит которого был сделан 10 лет назад. Поэтому
[03:13] я попросил модернизировать устаревший стек, не теряя при этом юмора и атмосферы, которые я так тщательно создавал. Оно правильно определило устаревшие технологии, а затем в мельчайших деталях, по
[03:25] меньшей мере, в течение 20 минут, излагало свой план атаки. Затем компания начала создавать систему дизайна, используя чистый CSS. Он сочетался с красивым фиолетовым фоном для слотов и кнопками с радужным градиентом, демонстрируя истинное вдохновение, вернее, квинтэссенцию визуальных вкусов других популярных магистерских программ
[03:38] . Благодаря своим возможностям компьютерного зрения , программа смогла обнаружить ошибку переполнения CSS на мобильных экранах, правильно диагностировать её и исправить с помощью проклятого трюка с минимальной шириной, равной нулю, который, казалось, всегда срабатывал. Это добавило несколько приятных
[03:51] анимаций появления видеокарт, что было действительно здорово. Весь юмор остался прежним, и даже добавилось несколько новых, например, эти всплывающие уведомления. В стек на систему без стека. Приложение было написано на HTML, CSS и чистом JavaScript, а
[04:05] кодовая база. Но мне очень хотелось проверить его зрительные способности. Поэтому я загрузил в приложение случайное видео с лошадью и попросил добавить его, а также создать заголовок, описание и комментарии, решено использовать FFmpeg для разбиения
[04:20] видео на серию кадров, анализа этих кадров, и это сработало действительно хорошо происходящего в видео, точно передать описание и даже согласовать юмор с остальной частью платформы. Ещё один инструмент, на который стоит обратить внимание, — это Exa,
[04:33] спонсор сегодняшнего видео. Это поисковая система, созданная для агентов искусственного интеллекта, которая предоставляет гораздо больше, чем просто результаты поиска в интернете. Он включает 350 миллионов научных работ, финансовые данные и информацию о более чем 1 миллиарде человек и 70
[04:46] миллионах компаний, при этом новые источники добавляются каждую неделю. Я подключил его к Polyhip, чтобы позволить моим пользователям делать ставки на фондовом рынке еще более извращенными способами, например, акции своих компаний непосредственно перед следующим отчетом о доходах. Компания EXA смогла получить
[04:59] последние документы, поданные в Комиссию по ценным бумагам и биржам США (SEC), и преобразовать их в структурированный JSON за один раз. В нем также указаны все источники, поэтому пользователи больше не смогут обвинить меня в мошенничестве. Вы можете напрямую подключаться к Claude, Chat GPT или другому вашему любимому агенту, используя их
[05:12] встроенные плагины. Или попробуйте Exa Agent, чтобы получить ответы на более сложные запросы, , что намного мощнее, чем возможности LLM . Попробуйте Exa бесплатно уже сегодня и получите 20 долларов в виде бонусов по ссылке ниже. Это
[05:27] watching, and I will see you in the next one.
⚡ Saved you 0h 05m reading this? Transcribe any YouTube video for free — no signup needed.