Nп/п : 73 из 74
От : Anton Ryzhkov 2:5030/1081.1 28 июл 26 18:43:10
К : All 28 июл 26 18:47:01
Тема : 70 млн токенов
----------------------------------------------------------------------------------
@MSGID: 2:5030/1081.1 6a68ce87
@PID: GED+W32 1.1.5-b20120519
@CHRS: CP866 2
@TZUTC: 0300
@TID: hpt/w64-mvc 1.9.0-cur 2020-11-09
Привет, All!
Немного статистики по ремонту эхопочты CoSysOp`ом ноды 2:5030/1081
Период работы: с 19 июля 18:12 - первого срабатывания no msgbasedir
updates - до 28 июля 17:29, когда была подготовлена итоговая сводка.
По внутреннему журналу за это время обработано:
- входных токенов: 69 643 136;
- из них cached input: 65 243 904;
- нового входного контекста: 4 399 232;
- выходных токенов: 220 809;
- итого: 69 863 945 токенов.
То есть почти 70 миллионов токенов, но 93,7% входного контекста
обслуживалось из prompt cache. Причина большого числа: при каждом диагностическом
шаге модель снова получает историю, конфигурацию, результаты SSH-команд и
предыдущие выводы.
В журнале насчитано около 552 модельных циклов в рамках 35 отдельных
заходов. Сюда входят SSH-проверки, разбор конфигурации, диагностика трафика,
подготовка списков, resubscribe, ожидание и проверка AreaFix-ответов.
По действующему rate card это примерно 1531 credit для
использовавшейся модели GPT-5.6 Sol. Реального дополнительного списания не было: работа
выполнялась в рамках подписки.
Если оценить тот же объём по публичным API-тарифам GPT-5, получится примерно:
- $15,86, или около 1238 рублей;
- без prompt caching было бы примерно $89,26, или 6964 рубля.
Энергопотребление
Точного счётчика OpenAI не публикует. Обычный короткий AI-запрос
оценивается примерно в 0,24-0,3 Wh, однако запрос с контекстом в 100 тысяч
токенов может потребовать до 40 Wh. Prompt caching заметно уменьшает эту
величину. исследование Google, оценка Epoch AI.
Разумная оценка для всей работы: примерно 1-5 кВт·ч. Пессимистическая
оценка без учёта caching достигает 22 кВт·ч.
1-5 кВт·ч - это примерно:
- 10-50 кипячений литра воды;
- 50-250 полных зарядок смартфона;
- 100-500 часов работы LED-лампы мощностью 10 Вт;
- 6-28 км пробега электромобиля;
- условно 1-5 литров воды на охлаждение дата-центра.
Итого: диагностика и переконфигурация ноды стоили порядка 70 млн
обработанных токенов, 1531 внутренних кредитов и ориентировочно нескольких
киловатт-часов энергии. Главную экономию дали prompt caching и сохранение всей
истории расследования.
Anton
--- Telegram, Gmail: rantonv
* Origin: BB (2:5030/1081.1)
SEEN-BY: 5030/1081
@PATH: 5030/1081