Upgrade#1
Conversation
Добавлены режимы работы, классификация текста, чёткий процесс, Добавлена обработка особых случаев, edge cases, пустой/короткий текст, Единая система групп A/B/C/D, устранена дублировка паттерн #13 ↔ жёсткие запреты. Добавлен верификационный чеклист, статистика паттернов, формат аудита
|
Upgrade |
Синхронизация с upstream blader/humanizer (версии 2.2.0-2.5.1). Новые паттерны: - B7: Безличные/бессубъектные конструкции (aналог passive voice) - C7: Авторитетные тропы (по сути, на самом деле, главный вопрос в том) - D6: Сигнальные анонсы (давайте разберём, перейдём к сути) - D7: Раздробленные заголовки (заголовок + фраза-повтор) Расширено: - A1: добавлены хвостовые отрицания (tailing negations) - word-scanner.md: новые маркеры во всех группах + англоязычные Добавлено: - Раздел Voice Calibration (калибровка под образец пользователя) - Версия 2.5.1-ru в frontmatter SKILL.md - Обновлён README (26 паттернов вместо 21)
- SKILL.md: полный пример переписан, теперь покрывает все 26 паттернов (было 7) и демонстрирует новые B7, C7, D6, D7 - SKILL.md: добавлен Шаг 6 'Анти-AI проход' как у upstream - SKILL.md: расширен чеклист верификации под новые паттерны - SKILL.md: исправлено собственное нарушение - убран негативный параллелизм 'не просто X, а Y' в разделе Voice Calibration - CHANGELOG.md: добавлен файл с историей изменений
Sync with upstream blader/humanizer v2.5.1 (+5 паттернов, Voice Calibration)
Применены рекомендации skill-architect-ultra Уровней 1-2. Скилл прошёл с 3.45 (B-/C+) до 4.55 (A) по 5-мерной шкале. ## Уровень 1 (Polish) - Frontmatter: version 2.6.0-ru, allowed-tools, усилены negative triggers - Edge cases: не-русский, <5 слов, >10000 слов, Markdown, битая кодировка, художественный текст (отказ) - AI-Slop Score (0-100) с формулой и шкалой интерпретации - Чеклист верификации расширен под B7/C7/D6/D7 ## Уровень 2 (Strengthening) - references/test-cases.md - 12 эталонных тест-кейсов с ожидаемыми score - references/scoring-rubric.md - Edit Quality Score (5 измерений × 5 баллов) - scripts/scan_markers.py - Python regex-сканер, без зависимостей, exit codes для CI/CD интеграции - examples/ - 5 готовых примеров разных типов с метриками ## Качество | Измерение | v2.5.1 | v2.6.0 | |---------------|--------|--------| | Clarity | 4/5 | 4/5 | | Coverage | 3/5 | 5/5 | | Consistency | 4/5 | 4/5 | | Testability | 2/5 | 5/5 | | Architecture | 4/5 | 5/5 | | Overall | 3.45 | 4.55 | ## Самопроверка - Тире '—' в собственных файлах заменены на '-' (нарушение собственного правила) - scan_markers.py протестирован на тест-кейсах: Кейс 1 ожидание 95+ -> 100, Кейс 9 ожидание <15 -> 0, Кейс 11 ожидание 60+ -> 62
feat: humanizer-ru v2.6.0 - sync with upstream + strengthening (3.45→4.55)
audit-only, tail-negations, ru-en-mix (category pr-adopted). Гейт-итерация 5: baseline v3.2 проходит все три 6/6 - RED не состоялся, train на потолке 74/74, кандидат с правками отклонён по правилу терминации (train failing[] пуст). Идеи PR закреплены эвалами, тело скилла не изменено.
|
@kootik, спасибо за PR - и извини, что ревью заняло столько времени. Смёржить его уже не получится: с февраля скилл ушёл на четыре мажорные версии вперёд (v1.x → v3.2, история в README и changelog), база разошлась полностью. Но идеи мы разобрали по косточкам, и лучшие из них теперь живут в проекте: Взяли и закрепили (коммит e648c22) - три твои идеи превратились в регрессионные eval-кейсы:
Забавный факт: прогнали текущую версию по всем трём кейсам через нашу гейт-методологию (train/held-out сплит, из microsoft/SkillOpt) - она прошла их 6/6 без единой правки. Поэтому идеи закреплены эвалами-гвардами, а не новыми правилами: если будущая версия сломает это поведение, эвалы поймают. Реализовано независимо (пока PR ждал): трёхфайловая архитектура, regex-линтер (scripts/lint.py), negative triggers, «текст уже хороший - не трогай», защита цитат. Вместо scoring rubric и test-cases используем бинарные assertions с evidence (BinEval) - 18 эвалов, 121 проверка. Калибровка голоса по образцу - в бэклоге осознанно. Ещё раз спасибо - три находки в постоянной защите проекта это отличный вклад. Закрываю. |
Ключевые улучшения
Архитектура - вместо 451 строки монолита теперь 3 файла с чёткими ролями: SKILL.md (движок), patterns.md (справочник), word-scanner.md (быстрый скан).
3 режима работы - полная редактура, аудит без изменений, точечная правка. Оригинал имел только один режим.
Классификация текста - теперь скилл учитывает тип текста (маркетинг vs техдока vs деловая переписка) и регулирует степень вмешательства.
Система приоритетов - 21 паттерн разбит на 4 группы по severity (A-критические, B-высокие, C-средние, D-стилистические) вместо плоского списка.
Edge cases - добавлена таблица для особых ситуаций: текст уже хороший, слишком короткий, смешанные языки, цитаты, юридический текст.
Negative triggers в description - «Do NOT use for: перевод, написание с нуля, грамматика, код».
Верификация - формальный чеклист перед выдачей + статистика найденных паттернов в выводе.