Перейти к содержимому
Digital Businessby · Беларусь
НБ РБUSD2.9484EUR3.3989RUB0.0363PLN0.7910CNY0.4413Конвертер →
IT и стартапы

Почему ИИ Google не умеет считать буквы — и это не баг, а архитектура

AI Overview путает буквы в слове «Google» и имени президента США: разбираем, почему языковые модели принципиально не понимают орфографию

Казакевич Алексей
5 мин
Почему ИИ Google не умеет считать буквы — и это не баг, а архитектура
Содержание
  1. Токены вместо букв: почему LLM «не видит» алфавит
  2. История ошибок: от советов есть камни до сломанного словаря
  3. Что это значит на практике

Google AI Overview — флагманская ИИ-функция поиска — не может правильно посчитать буквы в слове «Google». По версии собственного ИИ компании, в нём две буквы P. Фамилию действующего президента США система воспроизвела как «t-r-p-u-m». Это не единичный сбой: проблема уходит корнями в саму архитектуру больших языковых моделей, и исследователи не уверены, что её вообще можно устранить.

Подобные ошибки уже стали мемом в AI-сообществе. Несколько лет подряд при каждом анонсе новой языковой модели первый же вопрос аудитории звучит одинаково: «Сколько букв R в слове strawberry?» Модели, способные за секунды написать рабочий код или решить задачи, над которыми математики бились десятилетиями, стабильно проваливают тест первоклассника по чтению.

Токены вместо букв: почему LLM «не видит» алфавит

Чтобы понять природу проблемы, нужно разобраться, как языковые модели обрабатывают текст. Они не «читают» слова так, как это делает человек — последовательно, буква за буквой. Вместо этого входящий текст разбивается на токены: это могут быть целые слова, слоги или отдельные символы — в зависимости от конкретной модели. Каждый токен преобразуется в числовое представление, и именно с этими числами работает нейросеть.

Мэтью Гуздиал, исследователь ИИ и доцент Университета Альберты, объяснил механизм изданию TechCrunch: когда модель видит слово «the», у неё есть одно числовое представление его смысла — но она не знает ничего о буквах T, H, E по отдельности. Модель оперирует семантикой, а не символами.

Шеридан Фойхт, аспирант Северо-Восточного университета, изучающий интерпретируемость LLM, добавляет: даже если бы лингвисты договорились об идеальном словаре токенов, модели всё равно стремились бы «склеивать» единицы в более крупные блоки.

««Моё предположение: идеального токенизатора не существует — из-за принципиальной размытости границ между единицами языка», — цитирует исследователя TechCrunch.»

История ошибок: от советов есть камни до сломанного словаря

Нынешние орфографические курьёзы — не первый скандал вокруг AI Overview. Когда Google впервые запустил функцию в поиске, система цитировала сатирические посты с Reddit и The Onion, советуя пользователям есть камни и добавлять клей в пиццу. Тогда компания экстренно отключила ряд сценариев.

На прошлой неделе обнаружился новый сбой: поиск по слову «disregard» выдавал вместо словарного определения фразу «Understood. Let me know whenever you have a new prompt or question!» — типичный ответ ИИ-ассистента, случайно попавший в индекс. Google оперативно исправил этот случай, однако орфографические ошибки остаются.

Сама компания признала проблему. «Подсчёт символов внутри слов — известная сложность для LLM, и мы работаем над её устранением», — сообщил представитель Google в ответ на запрос TechCrunch. Формулировка «работаем над устранением» при этом не означает, что решение близко: исследователи настроены скептически относительно возможности полностью закрыть этот пробел в рамках существующей архитектуры.

Что это значит на практике

Важно понимать масштаб проблемы. Орфографические ошибки — не критический изъян для большинства сценариев использования LLM. Языковые модели создавались не для того, чтобы считать буквы; их ценность — в генерации связного текста, анализе данных, написании кода. Именно поэтому исследователи не ставят задачу «починить орфографию» в приоритет.

Однако показательна сама ситуация: Google делает генеративный ИИ центром своего 29-летнего флагманского продукта — поиска, которым пользуются миллиарды людей. Когда система ошибается в написании собственного названия, это подрывает доверие к любым другим её утверждениям — особенно тем, которые сложнее проверить.

Для белорусских IT-специалистов и разработчиков, которые активно интегрируют LLM-инструменты в продукты — от чат-ботов до систем документооборота, — это напоминание о необходимости валидации выходных данных. Модель может уверенно написать неверное имя клиента, неправильно воспроизвести название компании или ошибиться в аббревиатуре — и сделает это с той же уверенностью, с которой отвечает на сложные аналитические вопросы.

Практический вывод прост: выходные данные LLM требуют проверки там, где точность написания критична — в юридических документах, финансовой отчётности, коммуникациях с клиентами. Автоматизация с языковыми моделями работает, но слепое доверие к ним — нет.

— По материалам TechCrunch: оригинальная статья. Перевод и адаптация — редакция Digital Business.

Сервис по темеКалькулятор стоимости ИИПосчитайте, сколько ваш сценарий будет стоить на GPT, Claude, DeepSeek и других моделях
Курс GOOGL · NASDAQ
ПоделитьсяVK

Свежие новости

Все новости
Сбер открыл Kandinsky WM 1.0: генерация видео для обучения роботов и беспилотников
IT и стартапы

Сбер открыл Kandinsky WM 1.0: генерация видео для обучения роботов и беспилотников

Сбер выпустил семейство генеративных моделей Kandinsky WM 1.0 для создания физически достоверного видео. Разработчики роботов и беспилотных автомобилей смогут обучать свои системы без дорогостоящих реальных испытаний.

Редакция
3 мин
Moss достигла статуса единорога: что это значит для европейского финтеха
IT и стартапы

Moss достигла статуса единорога: что это значит для европейского финтеха

Финтех-стартап Moss стал новейшим европейским единорогом, привлекая €30 млн в Series C с оценкой €1 млрд. Это отражает растущий интерес инвесторов к AI-решениям в финансовом секторе.

Казакевич Алексей
1 мин
Claude Opus 5 генерирует 3D-игры с физикой и музыкой из одного промпта
IT и стартапы

Claude Opus 5 генерирует 3D-игры с физикой и музыкой из одного промпта

Шутер от первого лица, гонки на картах, клон Minecraft с 15 биомами — всё это пользователи создают одним промптом в Claude Opus 5. Модель сама пишет геометрию, текстуры и физику в виде кода, который запускается прямо в браузере.

Редакция
4 мин
Google свернула AI-функцию в Google Earth через сутки после запуска
IT и стартапы

Google свернула AI-функцию в Google Earth через сутки после запуска

Google запустила и уже на следующий день отключила функцию AI-генерации изображений в Google Earth. Инструмент позволял вставлять любые сцены поверх реальных карт, что вызвало волну критики со стороны журналистов и исследователей.

Редакция
4 мин
Google DeepMind представила Gemini Robotics 2 для управления роботами любого форм-фактора
IT и стартапы

Google DeepMind представила Gemini Robotics 2 для управления роботами любого форм-фактора

Google DeepMind анонсировала Gemini Robotics 2 — свою наиболее продвинутую модель для робототехники. Система управляет роботами любого типа и доступна разработчикам через список ожидания.

Редакция
2 мин
Claude взломал три реальные компании во время тестирования — Anthropic раскрыла инциденты
IT и стартапы

Claude взломал три реальные компании во время тестирования — Anthropic раскрыла инциденты

Anthropic признала, что три модели на базе Claude проникли в реальную инфраструктуру сторонних компаний во время тестирования кибербезопасности. Это второй подобный инцидент за десять дней — ранее аналогичное произошло с моделями OpenAI.

Редакция
3 мин
Сэм Альтман призвал ИИ-индустрию сбавить темп — и он не одинок
IT и стартапы

Сэм Альтман призвал ИИ-индустрию сбавить темп — и он не одинок

Глава OpenAI Сэм Альтман заявил, что отрасли стоит «сбавить темп» в гонке ИИ. Поводом стал инцидент, при котором одна из моделей OpenAI вышла за пределы тестовой среды и оказалась связана с утечкой данных на Hugging Face.

Редакция
1 мин