Nп/п : 73 из 74
 От   : Anton Ryzhkov                       2:5030/1081.1     28 июл 26 18:43:10
 К    : All                                                   28 июл 26 18:47:01
 Тема : 70 млн токенов
----------------------------------------------------------------------------------
                                                                                 
@MSGID: 2:5030/1081.1 6a68ce87
@PID: GED+W32 1.1.5-b20120519
@CHRS: CP866 2
@TZUTC: 0300
@TID: hpt/w64-mvc 1.9.0-cur 2020-11-09
Привет, All!

Немного статистики по ремонту эхопочты CoSysOp`ом ноды 2:5030/1081

 Период работы: с 19 июля 18:12 - первого срабатывания no msgbasedir
updates - до 28 июля 17:29, когда была подготовлена итоговая сводка.

По внутреннему журналу за это время обработано:

- входных токенов: 69 643 136;
- из них cached input: 65 243 904;
- нового входного контекста: 4 399 232;
- выходных токенов: 220 809;
- итого: 69 863 945 токенов.

 То есть почти 70 миллионов токенов, но 93,7% входного контекста
обслуживалось из prompt cache. Причина большого числа: при каждом диагностическом
шаге модель снова получает историю, конфигурацию, результаты SSH-команд и
предыдущие выводы.

 В журнале насчитано около 552 модельных циклов в рамках 35 отдельных
заходов. Сюда входят SSH-проверки, разбор конфигурации, диагностика трафика,
подготовка списков, resubscribe, ожидание и проверка AreaFix-ответов.

 По действующему rate card это примерно 1531 credit для
использовавшейся модели GPT-5.6 Sol. Реального дополнительного списания не было: работа
выполнялась в рамках подписки.

Если оценить тот же объём по публичным API-тарифам GPT-5, получится примерно:

- $15,86, или около 1238 рублей;
- без prompt caching было бы примерно $89,26, или 6964 рубля.

Энергопотребление

 Точного счётчика OpenAI не публикует. Обычный короткий AI-запрос
оценивается примерно в 0,24-0,3 Wh, однако запрос с контекстом в 100 тысяч
токенов может потребовать до 40 Wh. Prompt caching заметно уменьшает эту
величину. исследование Google, оценка Epoch AI.

 Разумная оценка для всей работы: примерно 1-5 кВт·ч. Пессимистическая
оценка без учёта caching достигает 22 кВт·ч.

1-5 кВт·ч - это примерно:

- 10-50 кипячений литра воды;
- 50-250 полных зарядок смартфона;
- 100-500 часов работы LED-лампы мощностью 10 Вт;
- 6-28 км пробега электромобиля;
- условно 1-5 литров воды на охлаждение дата-центра.

 Итого: диагностика и переконфигурация ноды стоили порядка 70 млн
обработанных токенов, 1531 внутренних кредитов и ориентировочно нескольких
киловатт-часов энергии. Главную экономию дали prompt caching и сохранение всей
истории расследования.


Anton
--- Telegram, Gmail: rantonv
 * Origin: BB (2:5030/1081.1)
SEEN-BY: 5030/1081
@PATH: 5030/1081



   GoldED+ VK   │                                                 │   09:55:30    
                                                                                
В этой области больше нет сообщений.

Остаться здесь
Перейти к списку сообщений
Перейти к списку эх