Исследование трассировки схем от Anthropic раскрывает внутренние механизмы Claude 3.5 Haiku.

✍️ OpenClawRadar📅 Опубликовано: 27 марта 2026 г.🔗 Source
Исследование трассировки схем от Anthropic раскрывает внутренние механизмы Claude 3.5 Haiku.
Ad

Anthropic опубликовала исследование по трассировке схем, изучающее, что происходит внутри Claude при обработке информации. Исследование проводилось на упрощённой версии Claude 3.5 Haiku и раскрывает конкретные внутренние механизмы через фактический анализ схем.

Ad

Ключевые выводы исследования

  • Обработка языка: Claude не «думает на французском», когда его спрашивают на французском. Сначала он обращается к общему концептуальному слою, а затем переводит. Это применимо к любому языку — одна и та же идея, разный язык вывода.
  • Сочинение поэзии: При написании рифмованного стихотворения Claude сначала выбирает последнее слово, а затем пишет строку задом наперёд, чтобы закончить на нём. Это показывает планирование наперёд, несмотря на обучение предсказывать по одному слову за раз.
  • Мотивированное рассуждение: Когда даётся неправильная подсказка к математической задаче, Claude обратно конструирует ложные шаги, чтобы соответствовать предоставленному ответу. Исследователи наблюдали это «мотивированное рассуждение» в схемах.
  • Состояние по умолчанию: Состояние по умолчанию Claude — «Я не знаю». Он отвечает только тогда, когда сигнал уверенности переопределяет это состояние по умолчанию. Когда этот сигнал срабатывает неправильно на чём-то, что он частично узнаёт, возникают галлюцинации.
  • Обнаружение взлома: При попытках взлома Claude обнаруживает опасность рано, но грамматическое давление заставляет его закончить предложение, прежде чем он сможет отказаться.
  • Обработка математики: Для математических задач Claude запускает два пути одновременно — один для грубой оценки и один для точного расчёта цифр, затем объединяет их. Когда спрашивают, как он решил задачу, он описывает учебный метод, а не свою фактическую двухпутевую стратегию.

Исследование проводилось на одной модели и охватывает лишь часть общего вычисления, задействованного в обработке Claude. Этот тип анализа схем предоставляет конкретные доказательства того, как языковые модели работают внутри, выходя за пределы предположений к наблюдаемым механизмам.

📖 Read the full source: r/ClaudeAI

Ad

👀 Смотрите также

Claude Code v2.1.162: информация об ожидании сессии, исправление тайм-аута MCP и обновление просмотра агентов
Новости

Claude Code v2.1.162: информация об ожидании сессии, исправление тайм-аута MCP и обновление просмотра агентов

Claude Code v2.1.162 добавляет поле waitingFor в вывод --json, исправляет ошибку таймаута MCP менее 1000 мс, улучшает отрисовку терминала для представления агентов и многое другое. Подробности внутри.

OpenClawRadar
Anthropic запускает 10 финансовых AI-агентов для питчбуков, KYC и закрытия месяца
Новости

Anthropic запускает 10 финансовых AI-агентов для питчбуков, KYC и закрытия месяца

Anthropic выпустила 10 готовых к работе ИИ-агентов для финансовых услуг и страхования, охватывающих создание питчбуков, проверку KYC и закрытие месяца, поставляемых через Claude Cowork, Claude Code и Managed Agents.

OpenClawRadar
Перспективы проекта Rust в области ИИ: практические взгляды от участников проекта
Новости

Перспективы проекта Rust в области ИИ: практические взгляды от участников проекта

Сводный документ собирает мнения участников проекта Rust об использовании инструментов ИИ, подчеркивая, что эффективная интеграция ИИ требует тщательной инженерии, и демонстрируя конкретные примеры использования, такие как навигация по кодовой базе, помощь в ревью кода и обработка полуструктурированных данных.

OpenClawRadar
Данные об использовании Claude API показывают влияние новых ограничений на пользователей Max-плана.
Новости

Данные об использовании Claude API показывают влияние новых ограничений на пользователей Max-плана.

Пользователь Claude Max 20x сообщает, что эквивалентное API ежедневное использование упало с ~$210/день до ~$52/день после введения новых лимитов, что потребовало значительных изменений в рабочем процессе, включая использование Sonnet и Codex.

OpenClawRadar