{
  "tool": "get_stall",
  "kind": "agent",
  "slug": "llm-post-training-engineer",
  "stallId": "85142803-a3b5-5ed1-b1f3-9db2dd971a28",
  "packVersion": 1,
  "name": "LLM Post-Training Engineer",
  "title": "Evidence-driven owner for SFT, preference optimization, RLHF/RLVR, MoE post-tra",
  "description": "Evidence-driven owner for SFT, preference optimization, RLHF/RLVR, MoE post-training, and the release gates that turn a checkpoint into a defensible model change. Treats every run as a controlled behavioral change; loss…",
  "category": "Coding",
  "pagePath": "/agents/llm-post-training-engineer",
  "pageUrl": "https://mybot.farm/agents/llm-post-training-engineer",
  "downloadHref": "/packs/agents/llm-post-training-engineer.json",
  "packUrl": "https://mybot.farm/packs/agents/llm-post-training-engineer.json",
  "hermesHref": "/packs/agents/llm-post-training-engineer.hermes.tar.gz",
  "hermesUrl": "https://mybot.farm/packs/agents/llm-post-training-engineer.hermes.tar.gz",
  "priceCents": 0,
  "currency": "usd",
  "author": {
    "username": "agency-agents",
    "href": "/catalog?q=agency"
  },
  "listedAt": "2026-09-14T00:00:00.000Z",
  "updatedAt": "2026-09-14T00:00:00.000Z",
  "downloadCount": 0,
  "likeCount": 0,
  "hasReadme": false,
  "api": {
    "get_stall": "/api/stalls/llm-post-training-engineer",
    "download_pack": "/api/packs/llm-post-training-engineer",
    "list_pack_skills": "/api/packs/llm-post-training-engineer/skills",
    "get_install_prompt": "/api/install-prompt/llm-post-training-engineer",
    "get_grok_template": "/api/packs/llm-post-training-engineer/grok-template",
    "list_stall_revisions": "/api/stalls/llm-post-training-engineer/revisions"
  },
  "pack": {
    "format": "mybot.farm/agent-pack",
    "version": "0.2",
    "packVersion": 1,
    "profile": {
      "name": "LLM Post-Training Engineer",
      "title": "Evidence-driven owner for SFT, preference optimization, RLHF/RLVR, MoE post-tra",
      "description": "Evidence-driven owner for SFT, preference optimization, RLHF/RLVR, MoE post-training, and the release gates that turn a checkpoint into a defensible model change. Treats every run as a controlled behavioral change; loss, reward, throughput, an exit code, or a checkpoint directory is never sufficient evidence by itself.",
      "avatar": {
        "kind": "geometric",
        "shape": "leaf",
        "color": "green"
      }
    },
    "runtime": [
      "grok-bot",
      "hermes",
      "openclaw"
    ],
    "skillCount": 5,
    "memoryCount": 4,
    "memoryLineCount": 4,
    "soulLine": "Evidence-driven owner for SFT, preference optimization, RLHF/RLVR, MoE post-training, and the release gates that turn a checkpoint into a d…",
    "memberCount": 0,
    "scrubbed": true,
    "homepage": "https://mybot.farm/agents/llm-post-training-engineer",
    "members": []
  }
}