Повышение производительности Gemini 3 Flash с помощью конкурентного промптинга

✍️ OpenClawRadar📅 Опубликовано: 9 марта 2026 г.🔗 Source
Повышение производительности Gemini 3 Flash с помощью конкурентного промптинга
Ad

В посте на Reddit в сообществе r/openclaw описывается эксперимент, в котором исследователи использовали конкурентный промптинг для значительного повышения производительности Gemini 3 Flash. Подход заключался в том, чтобы сообщить модели, что она отстает от «элитных» моделей, что исследователи описывают как использование «человеческой ревности в качестве мотиватора».

Ключевые результаты

Эксперимент дал конкретные результаты бенчмарка:

  • Производительность достигла 95% от показателя Claude 4.6 Opus
  • Стоимость снизилась до 1/200 от стоимости Opus
  • Скорость увеличилась в 4 раза по сравнению с Opus

Детали методологии

Тестовая установка включала:

  • Создатель бенчмарка: Gemini 3.1 Pro
  • Слепой судья: Claude 4.6 Opus
  • Испытуемый: Gemini 3 Flash

Основная техника заключалась в применении психологического давления на модель путем неблагоприятного сравнения с моделями более высокого уровня, что исследователи охарактеризовали как «травлю» или «давление» на модель для улучшения её производительности.

📖 Read the full source: r/openclaw

Ad

👀 Смотрите также

Раскрыта структура и сборка системного промта Claude Code
Новости

Раскрыта структура и сборка системного промта Claude Code

Утечка карты исходников в npm-пакете Claude Code раскрыла процесс сборки системного промпта, показав статические префиксные разделы, за которыми следует динамический контент, специфичный для сессии, с тремя вариантами идентичности и подробными инструкциями выполнения.

OpenClawRadar
MTP Multi-Token Prediction: генерация токенов в 2 раза быстрее на AMD Strix Halo и Radeon 9700 AI Pro
Новости

MTP Multi-Token Prediction: генерация токенов в 2 раза быстрее на AMD Strix Halo и Radeon 9700 AI Pro

Мультитокенное предсказание (MTP) обещает до 2-кратного ускорения генерации токенов для локальных LLM. Новое демо-видео показывает MTP на оборудовании AMD Strix Halo и Dual Radeon 9700 AI Pro, ориентированном на модели класса Qwen 3.6.

OpenClawRadar
GitHub отключает возможность Copilot вставлять рекламу в pull-запросы после негативной реакции разработчиков.
Новости

GitHub отключает возможность Copilot вставлять рекламу в pull-запросы после негативной реакции разработчиков.

GitHub отключил функцию Copilot, которая позволяла вставлять рекламные 'советы' в pull requests после того, как разработчики обнаружили, что она добавляет рекламу таких инструментов, как Raycast. Функция, позволявшая Copilot редактировать PR, которые он не создавал, когда его упоминали, была отключена после обратной связи сообщества.

OpenClawRadar
Контекстное управление OpenClaw подверглось критике за высокое потребление токенов и архитектурные недостатки.
Новости

Контекстное управление OpenClaw подверглось критике за высокое потребление токенов и архитектурные недостатки.

Пользователь Reddit критикует OpenClaw за неэффективное управление контекстом, которое приводит к чрезмерному использованию токенов. Фреймворк добавляет все действия в глобальную историю, создавая раздутые промпты, которые перегружают небольшие модели и вынуждают полагаться на дорогие передовые модели, такие как Claude Opus.

OpenClawRadar