---
title: 'What AI actually does with your prompt'
source: 'https://youtube.com/watch?v=1ICzp9TXFBw'
video_id: '1ICzp9TXFBw'
date: 2026-09-02
duration_sec: 177
channel: 'Steve Mould'
---

# What AI actually does with your prompt

> Source: [What AI actually does with your prompt](https://youtube.com/watch?v=1ICzp9TXFBw)

## Summary

This video explores the fascinating similarities and differences between generative AI and human intelligence, using the example of how text-to-image models understand prompts. It explains the iterative process of semantic understanding, the concept of vectors in high-dimensional space, and questions whether AI should mimic human intelligence at all.

### Key Points

- **AI vs Human Intelligence** [00:00] — Generative AI reveals both similarities and differences with human intelligence, such as distilling layers of meaning from text but failing at simple tasks like counting the 'R's in 'strawberry'.
- **Need for Text Understanding** [00:29] — To generate an image from text, a model must understand the text's meaning, which may require a separate model dedicated to text comprehension.
- **Iterative Semantic Understanding** [00:41] — Language models work through several iterations, progressively refining their semantic understanding—from recognizing word order to grasping narrative style like gothic horror with an unreliable narrator.
- **Vectors as Semantic Points** [01:20] — The output is a long string of values, or a vector, representing a point in a high-dimensional space of semantic meaning.
- **Interrogating Vectors** [01:35] — While some vector values can be linked to concepts like gender, it is generally very hard to see what most values or directions in this high-dimensional space actually represent semantically.
- **Questioning Mimicry** [02:12] — The video questions whether AI should mimic human intelligence, as this forces us to suppress human fallibilities like bias and hallucination.
- **AI in Go: Beyond Human Moves** [02:24] — An AI trained on human Go games won using a move no human had ever seen. When retrained without human games, it learned to beat humans faster and more comprehensively with novel moves.

### Conclusion

The video concludes that AI's ability to surpass human strategies, as seen in Go, is both fascinating and terrifying, suggesting that moving beyond human mimicry may unlock greater potential.

## Transcript

генеративного ИИ, который меня больше всего интересует, — это то, как он демонстрирует сходства искусственного интеллекта с человеческим и существенные различия между ними.  То, как искусственный интеллект извлекает различные смысловые слои
из фрагмента текста, кажется очень человечным, но тот факт, что он не знает, сколько букв «р» в слове «клубника», кажется совершенно нечеловеческим.  Для того чтобы создать изображение на основе текстовой подсказки, модель должна уметь понимать
смысл текста.  Возможно, нам нужна отдельная модель, способная понимать текст. Принцип работы текстовой или языковой модели действительно очень продуман.  По сути, он проходит несколько итераций, в ходе которых его семантическое понимание текста
становится все более и более тонким.  Например, как и в первой итерации, система может понять, что слово «синий» стоит перед словом «лодка», а это значит, что лодка синяя.  Затем, после нескольких итераций, система может понять, что человек, упомянутый
в начале текстового запроса, на самом деле находится на лодке, а упомянутые позже волны неспокойные, и именно это вызывает качку лодки.  А затем, к двадцатой итерации, система понимает, что текст был написан как готический ужастик с
нашем случае на выходе получается, по сути, длинная последовательность значений, представляющая все эти различные смыслы.  Эта последовательность значений обычно называется вектором, потому что её можно рассматривать как точку в этом
сверхмногомерном пространстве семантического значения.  Ранее я говорил, что понять, как работают эти модели, может быть невозможно, и думаю, это В некоторой степени, вы можете проанализировать эти векторы, представляющие
смысл запроса, и обнаружить, что определенное значение может отражать лингвистическое понятие пола.  Таким образом, если это значение увеличивается, то подсказка становится семантически более женственной.  Возможно, это несколько векторов,
представляющих разные части задания.  Но в целом очень сложно понять, что именно семантически представляют собой эти различные значения, или направления, если хотите, в этом сверхмногомерном пространстве .  Но это всё равно как-то работает
обучать ИИ имитировать человеческий интеллект, потому что тогда нам придётся подавлять все эти человеческие слабости, такие как предвзятость и галлюцинации.  Искусственный интеллект был обучен играть в го, просматривая
предыдущие матчи с участием людей.  А когда в итоге оно одержало победу над человеком, оно в итоге оно одержало победу над человеком, оно в основном повторяло ходы человека.  Но решающий ход, что весьма интересно, был таким, какого раньше никто из людей не видел
.  А когда ИИ переобучали, не видя ни одной игры с участием людей, а играя только сам с собой, он научился обыгрывать людей быстрее и убедительнее, используя ходы, которых раньше никто не видел, что одновременно и завораживает, и
before, which is both fascinating and terrifying.
