SAP замораживает большинство поездок и найма из-за стремительно растущей стоимости ИИ — кроме самого ИИ

SAP, одна из крупнейших в мире компаний-разработчиков программного обеспечения, приостановила большую часть поездок и найма в прошлом месяце из-за роста затрат на ИИ, за исключением поездок и найма, связанных с ИИ, согласно внутреннему письму, полученному 404 Media. Письмо, о котором сообщил Bloomberg в июле, все еще действует, сообщил текущий сотрудник SAP.
Ключевые детали из источника
- Ограничения: Большинство поездок и найма приостановлено по всей компании. Исключения для должностей и поездок, связанных с ИИ.
- Продолжительность: Заморозка началась в июле и все еще активна на дату статьи (6 августа 2026 г.). Сотрудник сообщил, что этот вопрос снова поднимался на недавнем глобальном собрании сотрудников.
- Причина: Рост затрат на ИИ, а не экономия. Сотрудник отметил, что SAP внедряет новый инструмент ИИ по всей компании, что, по их ожиданиям, «значительно увеличит затраты».
- Контекст: Это подчеркивает, как компании осознают, что ИИ не является обещанным средством экономии; некоторые ограничивают использование ИИ сотрудниками из-за роста затрат.
В статье цитируется внутреннее письмо, в котором говорится, что SAP необходимо «быть дисциплинированными в наших расходах». Анонимный сотрудник говорил с 404 Media, чтобы избежать ответных мер.
Эта история напоминает о том, что затраты на инфраструктуру ИИ могут быть значительными, что заставляет даже таких гигантов, как SAP, урезать бюджеты в других областях.
📖 Читать полный источник: HN LLM Tools
👀 Смотрите также

Cursor's Composer 2.0, судя по данным конечной точки API, использует модель Kimi 2.5.
Анализ сетевого трафика показывает, что Cursor's Composer 2.0 отправляет запросы на конечную точку, содержащую 'kimi-k2p5-rl-0317-s515-fast', что указывает на использование Kimi 2.5 в качестве основы. Модифицированная лицензия MIT, согласно сообщениям, требует указания авторства, но налагает минимальные другие обязательства.

Разработчик ищет советы по архитектуре для запуска моделей Embed, Rerank и Zero-Shot на 8 ГБ видеопамяти
Разработчик, создающий единый сервис Knowledge Graph/RAG для локального кодирующего агента, сталкивается с ограничениями памяти на 8 ГБ видеопамяти и 16 ГБ оперативной памяти, испытывая ошибки нехватки памяти (OOM), скачки задержек и завершение процессов ядром Linux при одновременном обслуживании трёх трансформерных моделей.

Эффективность токенов Opus 4.7: немецкие промпты расходуют до 2 раз больше токенов по сравнению с английскими
Подписчик Claude Pro сообщает, что использование немецкого языка с Opus 4.7 израсходовало 100% токенов сессии за секунды, в то время как английский использовал 37%. Неэффективность токенизатора обусловлена сложными существительными и умлаутами, что приводит к 1,5–2-кратному расходу токенов.

Сравнение текущих затрат на LLM: Deepseek, Qwen, MiniMax против OpenAI
Анализ Reddit показывает, что Deepseek-V3.2 стоимостью $0,26/$0,38 за миллион токенов примерно в 10 раз дешевле GPT-4, при этом демонстрируя производительность уровня GPT-5 по тестам, а Qwen3.5 и MiniMax-M2.5 предлагают конкурентоспособные альтернативы Claude и OpenAI.