lct-07 (без LLM): слот-автомат, персона, звонящий на заготовках, make repl
Звонящий не выдаёт данные сам: автомат держит раскрытые факты явно и отдаёт звонящему только их. Тест прогоняет длинную серию реплик и проверяет, что ни один нераскрытый факт не прозвучал. Главная находка — матчинг по порогу близости не работает. На multilingual-e5-small настоящие вопросы дают 0.79–0.95, а «Оставайтесь на линии» — до 0.89: диапазоны перекрываются, и любой порог либо выдаёт адрес на «успокойтесь», либо не слышит «где вы находитесь?». Решение — сравнение с ближайшим соседом: у пункта чек-листа несколько формулировок (examples), рядом общий список не-вопросов (checklists/common.yaml), и реплика засчитывается пункту, только если она ближе к нему, чем к любому не-вопросу. На отложенных фразах: 19 из 20 вопросов, 0 из 8 ложных срабатываний. Реплика режется только по границам предложений, со знаком: «?» для e5 — сильный признак вопроса, без него «Куда ехать» уходит к не-вопросам. Подсказка берёт неотработанный пункт из автомата. В живой сессии автомат начнёт слышать оператора, когда голосовой контур передаст ему stt.final. Ждёт ключа LLM: условие approach у скрытых фактов, звонящий своими словами, dialog/llm.py с кэшем.
This commit is contained in:
parent
4f5a8d1400
commit
7c97310938
22 changed files with 1073 additions and 26 deletions
|
|
@ -14,15 +14,18 @@ dependencies = [
|
|||
"httpx>=0.27",
|
||||
"pyyaml>=6.0",
|
||||
"structlog>=24.1",
|
||||
# Эмбеддинги для слот-автомата: матчинг вопроса к чек-листу. Нужны ядру,
|
||||
# а не только голосу, поэтому не в группе voice.
|
||||
"onnxruntime>=1.18",
|
||||
"tokenizers>=0.19",
|
||||
"numpy>=1.26",
|
||||
]
|
||||
|
||||
[project.optional-dependencies]
|
||||
# Тяжёлый слой моделей — ставится отдельно: uv sync --extra voice
|
||||
voice = [
|
||||
"onnx-asr>=0.6",
|
||||
"onnxruntime>=1.18",
|
||||
"torch>=2.2",
|
||||
"numpy>=1.26",
|
||||
]
|
||||
dev = [
|
||||
"pytest>=8.2",
|
||||
|
|
|
|||
Loading…
Reference in a new issue