ml-rl-environments
v1.0.0Доменный плагин AI/ML-исследователя: RL-среды оценки знания концептов (реестр Ариадны E1_define…E8_plan_experiment). Одна среда = задача-формат (определение, формула, классификация, извлечение карточки, связь, контраст, починка карточки, план эксперимента) + verifier-паттерн (детерминированный код) + опциональный LLM-судья по рубрике и веса judge_weight/verifiable_weight, плюс k_samples — число сэмплов на задачу для RL-дисперсии. Разбирает контракт verifier'а (float 0..1 либо dict {gate, components, evidence}), шкалу судьи 0–4 и её перевод в task_score, калибровку судьи (Spearman ρ ≥ 0.75), известные дефекты verifier'ов (E4 константный 0.5, E8 заглушка 0.0, E5-адаптер from/to→source/target) и как собрать из сред честный сигнал для оценки знания концептов, arena-лигу и reward для RL. Триггеры: «RL-среда», «RL-окружение», «E1_define», «E4_extract», «verifier», «верификатор ответа», «judge_weight», «verifiable_weight», «k_samples», «оценка знания концептов», «рубрика судьи», «LLM-судья», «arena лига», «task_score», «калибровка судьи», «reward-сигнал для RL».
1 GitHub starsUpdated last week
Directory evidence
- Runtimes
- Agent Plugins
- Parsed components
- 0 skill or MCP entries
- Source updated
- Sep 17, 2026
- Manifest status
- Canonical path parsed
The directory validates manifest shape and source location. It does not execute the plugin or provide a security endorsement. Review the indexing methodology →
Get the plugin
git clone https://github.com/romannekrasovaillm/spine-aimlClone the source repository, then follow its setup instructions to add the plugin to a compatible client. The plugin root is aiml/plugins/ml-rl-environments/.
This listing currently publishes only the generic Agent Plugins format. Automatic install commands for other clients are not generated yet.
Plugin files
└── plugin.json
Plugin manifests1
{
"$schema": "https://agent-plugins.org/schemas/1.0.0/plugin.schema.json",
"name": "ml-rl-environments",
"version": "1.0.0",
"description": "Доменный плагин AI/ML-исследователя: RL-среды оценки знания концептов (реестр Ариадны E1_define…E8_plan_experiment). Одна среда = задача-формат (определение, формула, классификация, извлечение карточки, связь, контраст, починка карточки, план эксперимента) + verifier-паттерн (детерминированный код) + опциональный LLM-судья по рубрике и веса judge_weight/verifiable_weight, плюс k_samples — число сэмплов на задачу для RL-дисперсии. Разбирает контракт verifier'а (float 0..1 либо dict {gate, components, evidence}), шкалу судьи 0–4 и её перевод в task_score, калибровку судьи (Spearman ρ ≥ 0.75), известные дефекты verifier'ов (E4 константный 0.5, E8 заглушка 0.0, E5-адаптер from/to→source/target) и как собрать из сред честный сигнал для оценки знания концептов, arena-лигу и reward для RL. Триггеры: «RL-среда», «RL-окружение», «E1_define», «E4_extract», «verifier», «верификатор ответа», «judge_weight», «verifiable_weight», «k_samples», «оценка знания концептов», «рубрика судьи», «LLM-судья», «arena лига», «task_score», «калибровка судьи», «reward-сигнал для RL».",
"keywords": [
"ml",
"rl",
"eval",
"verifier",
"rubric"
]
}For maintainers
If you maintain this plugin, link to this source-backed listing from your README so users can review its manifest and indexed components.
[ml-rl-environments on Agent Plugins Marketplace](https://pluginsmp.com/plugins/ml-rl-environments)