Agent Plugins Marketplace
All plugins

ml-selfplay

v1.0.0

Доменный плагин AI/ML-исследователя: контракт selfplay-эпизода — как устроена генерация обучающих диалогов между агентом-средой (ENV-AGENT: генерирует задачи, ведёт состояние, даёт промежуточный отклик, грундует факты в базе концептов Ариадны) и обучаемой моделью (SOLVER). Ключевой инвариант: НИ ОДИН агент не назначает финальную награду — reward считает только внешний verifier-конвейер. Формат эпизода JSONL (episode_id/turn/actor/type/content/grounding), машина состояний INIT→TASK→SUBMIT→VERIFY→REWARD→LOG с ABORT, commit-reveal золотого эталона по sha256, режимы M1–M5, сэмплер по леджеру frontier и детекторы вырождения (коллапс, дрейф сложности, сговор env↔solver, length-bias, шаблонный коллапс, нарушение персоны). Связь с fitness/rubric-дисциплиной харнесса: reward = внешний verifier (rubric.rs weighted_total + изоляция судьи + k-сэмплов медиана), веса judge_weight/verifiable_weight = аналог весов критериев. Триггеры: «selfplay-эпизод», «ENV-AGENT», «SOLVER», «контракт эпизода», «JSONL эпизода», «внешний verifier», «reward назначает агент», «commit-reveal», «генерация selfplay-данных», «анти-дегенерация selfplay», «сговор env и solver».

Agent Plugins

1 GitHub starsUpdated last week

Directory evidence

Runtimes
Agent Plugins
Parsed components
0 skill or MCP entries
Source updated
Sep 17, 2026
Manifest status
Canonical path parsed

The directory validates manifest shape and source location. It does not execute the plugin or provide a security endorsement. Review the indexing methodology

Get the plugin

git clone https://github.com/romannekrasovaillm/spine-aiml

Clone the source repository, then follow its setup instructions to add the plugin to a compatible client. The plugin root is aiml/plugins/ml-selfplay/.

This listing currently publishes only the generic Agent Plugins format. Automatic install commands for other clients are not generated yet.

Plugin files

aiml/plugins/ml-selfplay/
└── plugin.json

Plugin manifests1

aiml/plugins/ml-selfplay/plugin.json
{
  "$schema": "https://agent-plugins.org/schemas/1.0.0/plugin.schema.json",
  "name": "ml-selfplay",
  "version": "1.0.0",
  "description": "Доменный плагин AI/ML-исследователя: контракт selfplay-эпизода — как устроена генерация обучающих диалогов между агентом-средой (ENV-AGENT: генерирует задачи, ведёт состояние, даёт промежуточный отклик, грундует факты в базе концептов Ариадны) и обучаемой моделью (SOLVER). Ключевой инвариант: НИ ОДИН агент не назначает финальную награду — reward считает только внешний verifier-конвейер. Формат эпизода JSONL (episode_id/turn/actor/type/content/grounding), машина состояний INIT→TASK→SUBMIT→VERIFY→REWARD→LOG с ABORT, commit-reveal золотого эталона по sha256, режимы M1–M5, сэмплер по леджеру frontier и детекторы вырождения (коллапс, дрейф сложности, сговор env↔solver, length-bias, шаблонный коллапс, нарушение персоны). Связь с fitness/rubric-дисциплиной харнесса: reward = внешний verifier (rubric.rs weighted_total + изоляция судьи + k-сэмплов медиана), веса judge_weight/verifiable_weight = аналог весов критериев. Триггеры: «selfplay-эпизод», «ENV-AGENT», «SOLVER», «контракт эпизода», «JSONL эпизода», «внешний verifier», «reward назначает агент», «commit-reveal», «генерация selfplay-данных», «анти-дегенерация selfplay», «сговор env и solver».",
  "keywords": [
    "ml",
    "selfplay",
    "rl",
    "env-agent",
    "verifier"
  ]
}

If you maintain this plugin, link to this source-backed listing from your README so users can review its manifest and indexed components.

[ml-selfplay on Agent Plugins Marketplace](https://pluginsmp.com/plugins/ml-selfplay)