Talkie: 13B LLM, обученная исключительно на текстах до 1931 года, с использованием Claude в качестве судьи при RL-обучении

✍️ OpenClawRadar📅 Опубликовано: 28 апреля 2026 г.🔗 Source
Talkie: 13B LLM, обученная исключительно на текстах до 1931 года, с использованием Claude в качестве судьи при RL-обучении
Ad

Группа исследователей, включая Алека Рэдфорда (GPT, CLIP, Whisper), Ника Левина и Дэвида Дювено, только что выпустила Talkie — языковую модель с 13 миллиардами параметров, обученную исключительно на текстах, опубликованных до 1931 года. Область знаний модели заканчивается 31 декабря 1930 года — никакого интернета, Википедии или контента о Второй мировой войне.

Почему это важно

Современные LLM (GPT, Claude, Gemini, Llama) разделяют обучающие данные из современного веба, что затрудняет отделение запоминания от подлинного рассуждения. Talkie разрывает эту связь: его обучающий распределение принципиально иное, что позволяет исследователям проверить, возникают ли способности из запоминания или обобщения. Как отмечает команда: «Важный вопрос — в какой степени возможности LM обусловлены запоминанием, а не обобщением. Винтажные LM позволяют проводить уникальные тесты на обобщение.»

Роль Claude в обучении

Claude Sonnet 4.6 служил судьей в конвейере обучения с подкреплением Talkie (онлайн DPO). Кроме того, Claude Opus 4.4 генерировал синтетические многопоточные диалоги, которые использовались на финальном этапе точной настройки. Команда признает иронию и риск заражения, отмечая, что это то, что они планируют устранить в будущих версиях.

Ad

Ключевые возможности

  • Talkie может научиться писать код на Python на основе всего нескольких примеров в контексте — несмотря на полное отсутствие современного кода в обучающих данных. Он рассуждает на основе математических текстов XIX века, а не извлекает информацию.
  • Предназначен для долгосрочного прогнозирования: насколько хорошо модель может «предсказывать» будущее с точки зрения своего замороженного состояния 1930 года?
  • Может использоваться для изучения «изобретательства» — способности разрабатывать идеи, которые выходят за временные рамки её знаний.
  • Помогает изолировать, какие способности обусловлены архитектурой, а какие заимствованы из веб-данных.

Доступ и лицензирование

Talkie и его вариант распространяются по лицензии Apache 2.0 и имеют открытый вес на Hugging Face. Вы можете общаться с ним вживую по предоставленной ссылке. Команда планирует выпустить винтажную модель масштаба GPT-3 позднее в этом году.

Для чего она используется

  • Долгосрочное прогнозирование: предсказывать будущие события с исторической точки зрения.
  • Изобретательство: генерировать идеи, которые выходят за временные рамки её обучения.
  • Идентичность LLM: что делает модель собой — выделение влияния архитектуры и распределения данных.

📖 Полный источник: r/ClaudeAI

Ad

👀 Смотрите также

Пользователи Claude Code быстрее, чем ожидалось, достигают лимитов использования, подозреваются ошибки.
Новости

Пользователи Claude Code быстрее, чем ожидалось, достигают лимитов использования, подозреваются ошибки.

Anthropic признаёт, что пользователи Claude Code исчерпывают квоты «гораздо быстрее, чем ожидалось», причём пользователи сообщают о достижении максимальных лимитов в течение нескольких часов. Предполагаемые ошибки в кэшировании промптов могут увеличивать затраты в 10–20 раз, а возврат к версии 2.1.34, по сообщениям, помогает.

OpenClawRadar
Гибридная архитектура ИИ: компоненты с открытым исходным кодом и проприетарные модели логического вывода
Новости

Гибридная архитектура ИИ: компоненты с открытым исходным кодом и проприетарные модели логического вывода

Практическая гибридная архитектура ИИ становится реальностью: 89% организаций используют компоненты с открытым исходным кодом для снижения затрат более чем на 50%, в то время как проприетарные модели справляются со сложными задачами логического вывода. Фреймворки с открытым исходным кодом предлагают прозрачность и возможности тонкой настройки без переговоров о лицензировании.

OpenClawRadar
Разработчик переходит на Minimax 2.7 после блокировки Claude и проблем с кредитами MiMo.
Новости

Разработчик переходит на Minimax 2.7 после блокировки Claude и проблем с кредитами MiMo.

Разработчик протестировал несколько ИИ-моделей для OpenClaw после блокировки Claude, обнаружив, что GLM 5.1 и 5 Turbo неэффективны для агентских задач, кредитная система MiMo V2 Pro неэффективна, и остановился на Minimax 2.7 из-за щедрой квоты и способности справляться с задачами автоматизации.

OpenClawRadar
Anthropic запускает 10 финансовых AI-агентов для питчбуков, KYC и закрытия месяца
Новости

Anthropic запускает 10 финансовых AI-агентов для питчбуков, KYC и закрытия месяца

Anthropic выпустила 10 готовых к работе ИИ-агентов для финансовых услуг и страхования, охватывающих создание питчбуков, проверку KYC и закрытие месяца, поставляемых через Claude Cowork, Claude Code и Managed Agents.

OpenClawRadar