ОЦЕНКА
Оценка и границы утверждений
Соответствие прохождения проверяется напрямую; улучшение качества рассуждения требует сравнительных экспериментов.
Три уровня утверждений
| Determinism | Одно связанное состояние даёт тот же результат шлюза. |
|---|---|
| Audit | Вход, трасса шлюза и результат показывают допустимость перехода. |
| Performance | Польза для задачи измеряется относительно альтернатив. |
Как проверить, а не просто поверить
Мы не просим верить нам на слово. verify.py запускает 35 автоматических проверок прямо на движке — не на обещаниях, на коде. Вы запускаете их сами, локально, за секунды:
python -m fpf_thinking_map.verify
А когда вы строите собственную семантическую карту поверх библиотеки — свои контексты, защитные правила, правила логики — вы получаете тот же уровень проверки бесплатно: те же свойства детерминизма и аудита применяются к вашей карте, а не только к поставляемому примеру. Вы не покупаете обещание. Вы устанавливаете движок, который можно проверить с первой строчки кода.
И именно потому, что мы просим проверку, мы так же прямо говорим, где она заканчивается:
Чего продукт не утверждает
Он не доказывает семантическую правильность, не гарантирует безопасность и не делает LLM детерминированной. Он делает выбранную часть управления явной и механически проверяемой.
И столь же важно: он не вмешивается в саму генерацию модели (LLM). Он берёт на себя учётную часть — состояние, правила, историю, — чтобы модели не приходилось держать это в уме самой; именно эту когнитивную нагрузку мы и снимаем. Но он не переписывает, не редактирует, не фильтрует то, что производит модель, и не рассуждает семантически вместо неё. Его роль заканчивается на проверке дискретного хода, до и после: то, что предложила модель, как язык и как смысл, остаётся её собственным.