diff --git a/app/version.py b/app/version.py index 3e2f46a..61fb31c 100644 --- a/app/version.py +++ b/app/version.py @@ -1 +1 @@ -__version__ = "0.9.0" +__version__ = "0.10.0" diff --git a/docs/ИНТЕГРАЦИЯ-TALKSCORE.md b/docs/ИНТЕГРАЦИЯ-TALKSCORE.md index 9eeacd9..4f3c558 100644 --- a/docs/ИНТЕГРАЦИЯ-TALKSCORE.md +++ b/docs/ИНТЕГРАЦИЯ-TALKSCORE.md @@ -217,17 +217,34 @@ x24 к реальному времени: час записи за две с п ### Стоимость разметки ролей -Расчёт на реальных объёмах: 205 минут разговоров дают около 46 600 входных -и 2 500 выходных токенов. +Замеряно на записи в 15 минут (160 предложений). Обе проверенные модели - +рассуждающие, и по умолчанию они тратят на размышления тысячи токенов. +Это решающий фактор цены. -| Модель | За 8 записей | За час разговора | -|---|---|---| -| Claude Sonnet 5 | $0,119 | **$0,035** | -| Claude Opus 5 | $0,296 | $0,087 | +| Модель | Размышления | Выходных токенов | Время | Цена за 15 мин | За час | +|---|---|---|---|---|---| +| Claude Sonnet 5 | по умолчанию | 17 791 | 137 с | $0,188 | $0,75 | +| Claude Sonnet 5 | минимальные | 897 | 9 с | $0,019 | $0,076 | +| Claude Sonnet 5 | выключены | 375 | 7 с | $0,014 | $0,055 | +| Gemini 3.1 Pro | по умолчанию | 13 715 | 85 с | $0,172 | $0,69 | +| Gemini 3.1 Pro | минимальные | 5 354 | 32 с | $0,071 | $0,29 | -Выход маленький, потому что модель отвечает одной буквой на предложение. -Если просить её возвращать текст реплик, выход вырастает в двадцать раз, -а вместе с ним и цена. +Отключение размышлений даёт разницу в тринадцать раз по цене и в двадцать +по времени. Но за это платится качеством: без размышлений модель верно +размечает начало разговора, а дальше начинает менять роли местами - +объяснения менеджера приписывает клиенту и наоборот. + +Разумный компромисс - минимальные размышления: цена $0,076 за час против +$0,75 при полных, а разметка заметно устойчивее, чем при полностью +выключенных. Проверьте на своих записях, прежде чем ставить в поток. + +У OpenRouter это задаётся полем запроса: + +```json +{"model": "anthropic/claude-sonnet-5", + "reasoning": {"effort": "low"}, + "messages": [...]} +``` ### Качество @@ -263,9 +280,11 @@ x24 к реальному времени: час записи за две с п Итог по разметке: 80 % реплик у менеджера, смена говорящего в 28 % переходов - правдоподобно для консультации. -**Gemini 3.1 Pro с задачей не справился**: вернул 100 % реплик менеджеру и ни -одной смены. Проверяйте любую новую модель на этой задаче, прежде чем ставить -её в поток. +**Про Gemini 3.1 Pro.** На одной записи он вернул 100 % реплик менеджеру и ни +одной смены, то есть провалился полностью. На другой отработал нормально: +82 % менеджера, 32 % смен - на уровне Claude. Причина такого разброса не +установлена, поэтому в поток его ставить рискованно без дополнительной +проверки на своих данных. **Передавать громкость реплик в промпт бесполезно**: с ней 81 % против 80 % без неё, разницы нет. Экономьте токены и не передавайте.