Commit Graph

  • 0adf7cdf2f Merge pull request 'feat: add adaptive review effort budgets' (#19) from feat/review-budget-governor into main main masi 2026-09-01 12:15:16 +00:00
  • 592747d98d fix: resolve review budget feedback feat/review-budget-governor Claude 2026-09-01 12:14:18 +00:00
  • 4d51e14a1a feat: adapt review budget to diff size Claude 2026-09-01 11:50:46 +00:00
  • f9eef969e6 docs: document review budget defaults Claude 2026-09-01 11:42:59 +00:00
  • 3a10deef06 feat: add review effort accounting and budget governor Claude 2026-09-01 11:41:08 +00:00
  • a202bd3598 Merge pull request 'refactor: split opencode runtime and tests' (#17) from refactor/split-opencode-modules into main masi 2026-09-01 03:34:58 +00:00
  • e6cb7d01a6 fix: remove duplicate lens config helpers Claude 2026-09-01 03:26:50 +00:00
  • f485d9faf9 refactor: split opencode runtime and tests Claude 2026-09-01 02:54:23 +00:00
  • 0c3997db35 Merge pull request 'refactor: organize pilot modules and tests' (#16) from refactor/split-pilot-modules into main masi 2026-09-01 01:21:56 +00:00
  • 8dfca67ad3 docs: describe review module seams refactor/split-pilot-modules Claude 2026-09-01 01:17:00 +00:00
  • 87dd695d97 refactor: split review pipeline responsibilities Claude 2026-09-01 01:14:49 +00:00
  • c948f2818b refactor: make review facade thin Claude 2026-09-01 01:05:54 +00:00
  • 7a510a926d refactor: organize pilot packages Claude 2026-09-01 00:59:51 +00:00
  • 3a110ab52c Merge pull request 'Refactor pilot architecture and remove dashboard' (#15) from refactor/pilot-architecture-langfuse into main masi 2026-09-01 00:28:06 +00:00
  • 9a9923d034 Merge pull request 'test: eval judges e2e' (#14) from test/eval-judges-trigger into main masi 2026-09-01 00:26:59 +00:00
  • 3f30bdd450 merge: resolve eval judge rule conflict test/eval-judges-trigger Claude 2026-09-01 00:26:25 +00:00
  • b4041f6892 refactor: split pilot architecture refactor/pilot-architecture-langfuse Claude 2026-09-01 00:17:16 +00:00
  • 5b8be61e2f test: trigger review after DB rule insert Claude 2026-08-31 19:19:59 +00:00
  • 3109bd7c2d pilot(eval): switch rule target from observation to trace Claude 2026-08-31 19:18:59 +00:00
  • d746b1fdc2 test: trigger review for eval judges gitea_admin 2026-08-31 18:37:41 +00:00
  • 370adcde6f test: trigger after reopen fix/dataset-item-url-safe-ids Claude 2026-08-31 18:36:07 +00:00
  • 84325e61c1 test: trigger review after .pr-review.json merged to main Claude 2026-08-31 18:34:18 +00:00
  • 193a90e63e Merge pull request 'feat(eval): LLM-as-judge evaluators, dataset item fixes, and Experiments runs' (#13) from fix/dataset-item-url-safe-ids into main gitea_admin 2026-08-31 18:34:02 +00:00
  • 1644c7f6b1 chore: enable pragent pilot on this repo (.pr-review.json on PR branch) gitea_admin 2026-08-31 18:33:06 +00:00
  • 3543d15677 test: re-trigger after dedupe window Claude 2026-08-31 18:31:32 +00:00
  • 72ac0f76bc test: retrigger review after eval rule wiring Claude 2026-08-31 18:25:57 +00:00
  • 5d44121b28 feat(eval): LLM-as-judge evaluators for finding actionability and review self-consistency Claude 2026-08-31 17:17:16 +00:00
  • 2e1ad817e7 feat(eval): filterable item metadata and dataset runs for the Experiments tab Marcos 2026-08-31 15:53:35 +00:00
  • 1534a99630 fix(eval): dataset item ids that survive a URL path Marcos 2026-08-31 15:38:44 +00:00
  • d9eb4d9822 Merge PR #12: langfuse evaluation layer gitea_admin 2026-08-31 14:48:06 +00:00
  • 2f96e66aab feat(pilot): behavioural scorers, feedback ground truth, and an eval dataset feat/langfuse-evaluation Claude 2026-08-31 14:22:55 +00:00
  • a4c35a4472 Merge pull request 'feat(pilot): emit per-review Langfuse traces' (#11) from feat/langfuse-tracing into main gitea_admin 2026-08-31 13:03:14 +00:00
  • 92283c44e8 feat(pilot): emit per-review Langfuse traces Claude 2026-08-31 12:45:35 +00:00
  • 51b81def98 feat(opencode): configure vllm-qwen38 provider for local Qwen3.8-27B Claude 2026-08-24 22:49:50 +00:00
  • 317942e15b fix(pilot): strip opencode $schema + defensive harvest dict-strip Marcos Paulo 2026-08-24 19:38:48 +00:00
  • 0d73a075cd feat(opencode): bump qwen3.8-27b context limit to 57344 Claude 2026-08-22 19:21:53 +00:00
  • e5d4e252de feat(opencode): multi-provider support with local provider for qwen3.8-27b Claude 2026-08-22 19:13:06 +00:00
  • 92020d4d46 feat(ai_review): route per-repo model override through PRICES provider field Claude 2026-08-22 19:13:04 +00:00
  • e344831b05 feat(cost_model): add provider field on Price + register qwen3.8-27b (local) Claude 2026-08-22 19:13:04 +00:00
  • 2ba3ccbd95 docs(pilot): dashboard now behind Logto SSO Claude 2026-08-22 18:05:02 +00:00
  • 99255bb167 feat(dashboard): drop token auth, trust oauth2-proxy X-Forwarded-User Claude 2026-08-22 18:03:33 +00:00
  • c9809bce9b Merge deploy agent: k8s manifest + README Claude 2026-08-22 17:01:34 +00:00
  • 5fe83b0b2a k8s(pilot): dashboard deploy manifest + README; pin NodePort 31540 Claude 2026-08-22 17:01:34 +00:00
  • 218a8dc271 docs(pilot): dashboard README claude 2026-08-22 15:35:00 +00:00
  • e688ea61c5 Merge dashboard agent: data + HTTP server + mutation endpoints Claude 2026-08-22 15:17:58 +00:00
  • dd49d83933 feat(dashboard): model select dropdown in edit form Claude 2026-08-22 15:15:29 +00:00
  • 6f7957010e feat(dashboard): mutate .pr-review.json via Gitea contents API Claude 2026-08-22 15:15:04 +00:00
  • be24ef245c feat(dashboard): stdlib HTTP server with overview/repo/PR pages Claude 2026-08-22 15:11:36 +00:00
  • bb9b6aa12d feat(dashboard): read-only query module over feedback SQLite Claude 2026-08-22 15:07:57 +00:00
  • fe5bebb4cf Merge agent-B: cost-line fix + static_message + per-repo model override Marcos 2026-08-22 15:01:38 +00:00
  • d0f99b9763 feat(ai_review): parse .pr-review.json:model as per-repo override Marcos 2026-08-22 14:46:47 +00:00
  • f3a09b9397 Merge agent-A: move feedback*.py from WIP into tree Marcos 2026-08-22 14:46:46 +00:00
  • 4e5f43ada7 feat(feedback): move feedback poster from WIP into pilot/ Marcos 2026-08-22 14:46:07 +00:00
  • 8472f35a58 feat(feedback): move feedback analyzer from WIP into pilot/ Marcos 2026-08-22 14:46:07 +00:00
  • 69e1fc06a2 feat(feedback): move feedback harvester from WIP into pilot/ Marcos 2026-08-22 14:46:07 +00:00
  • 6cdccb48ad feat(feedback): move feedback storage layer from WIP into pilot/ Marcos 2026-08-22 14:46:04 +00:00
  • 7f37a36722 feat(ai_review): parse .pr-review.json:static_message + render as banner Marcos 2026-08-22 14:43:59 +00:00
  • b6b8173ccb fix(ai_review): show actual model in cost line (was hardcoded glm-5.2:cloud) Marcos 2026-08-22 14:41:56 +00:00
  • a9e1b7ddfc fix(opencode): patch apiKey from PRAGENT_MODEL_API_KEY at install_config Marcos 2026-08-22 13:12:46 +00:00
  • 4c06a9ab3c chore(opencode): swap glm-5.2:cloud → MiniMax-M2.7 Marcos 2026-08-22 03:45:09 +00:00
  • d38e1c8693 test(opencode_review): skip posthash golden when feedback module absent claude 2026-08-22 01:43:05 +00:00
  • 8e8ae54669 Merge feature/pragent-update: 16-task pragent update Marcos 2026-08-22 01:38:49 +00:00
  • 661199dad2 chore(cost_model): drop stale AI-USAGE label references claude 2026-08-22 01:37:23 +00:00
  • 3e03fb80a7 docs: onboarding uses .pr-review.json:enabled, not labels claude 2026-08-22 01:33:42 +00:00
  • 2432228d68 feat(webhook): gate on .pr-review.json:enabled, drop labels claude 2026-08-22 01:30:07 +00:00
  • 2c7d4803f1 feat(webhook): is_repo_enabled reads .pr-review.json:enabled claude 2026-08-22 01:24:10 +00:00
  • 86352a3771 refactor(review): always render usage; drop report_usage flag claude 2026-08-22 01:18:34 +00:00
  • e1b74d982d refactor(ai_review): drop AI_REVIEW/AI_USAGE label plumbing claude 2026-08-22 01:13:59 +00:00
  • 33e4c16782 feat(usage): multi-provider equivalent cost table claude 2026-08-22 01:06:02 +00:00
  • 979c93bdbb feat(review): render walkthrough + risk_verdict + test_coverage claude 2026-08-22 00:58:51 +00:00
  • 66628aae8d fix(opencode_review): harden _synthesize_summary_fields (none-safe, dedupe emoji map) claude 2026-08-22 00:52:35 +00:00
  • e5a6e8923d feat(opencode_review): python fallback for summary fields claude 2026-08-22 00:46:08 +00:00
  • 2e982846d9 feat(review): walkthrough/risk_verdict/test_coverage schema claude 2026-08-22 00:36:50 +00:00
  • 72b77a96e0 fix(confidence): pass multi_lens_observed kwarg to merge_confidence claude 2026-08-22 00:29:28 +00:00
  • f3a125666b feat(ai_review): per-PR merge confidence 1-5 in header claude 2026-08-22 00:23:24 +00:00
  • 9dae850887 test(config): fix cap-at-12 test to actually exercise the cap claude 2026-08-22 00:19:25 +00:00
  • 0f7903377a feat(config): parse enabled + compare_against claude 2026-08-22 00:12:06 +00:00
  • 0b295e2443 fix(severity): extend badge label set + update SYSTEM_PROMPT claude 2026-08-22 00:06:22 +00:00
  • 23ec1bf74a feat(severity): add trivial + info levels claude 2026-08-21 23:58:57 +00:00
  • 2cf4bdbfe8 feat(ai_review): render humanized token counts in usage + inline claude 2026-08-21 23:54:10 +00:00
  • 3bcf825104 feat(ai_review): fmt_tokens() humanizes token counts claude 2026-08-21 23:46:24 +00:00
  • 67339da8d0 feat(cost-model): add GPT, Gemini, Grok prices claude 2026-08-21 23:42:07 +00:00
  • 99014a4cd3 chore(gitignore): exclude .worktrees/ claude 2026-08-21 23:39:44 +00:00
  • f52b8d7803 docs(plans): 2026-08-21 pragent update implementation plan claude 2026-08-21 23:39:11 +00:00
  • f9f6ab4bf0 docs(plans): 2026-08-21 pragent update design claude 2026-08-21 23:32:49 +00:00
  • cdf116ece9 Merge PR #10: read the AI-USAGE opt-in at render time gitea_admin 2026-08-20 23:42:36 +00:00
  • c58c00181e fix(review): read the AI-USAGE opt-in at render time, not at review start Marcos 2026-08-20 23:35:04 +00:00
  • aedea973ab fix(webhook): label re-read must hit /api/v1, not the bare host Marcos 2026-08-20 23:29:03 +00:00
  • 4ef62f28bb fix(webhook): re-read PR labels at review start so a late AI-USAGE counts Marcos 2026-08-20 23:24:54 +00:00
  • 7e4fd1975d Merge PR #9: diff compression + prior-review compaction + multi-lens orchestration gitea_admin 2026-08-20 23:05:31 +00:00
  • 2b1cf750b7 fix(review): correct diff-compression line numbers, prior-review dedupe, triage skip Marcos 2026-08-20 23:05:03 +00:00
  • 78bcf6a9a0 feat(review): multi-lens orchestration — 5 parallel opencode subprocesses (security/docs/code-quality/tests/perf) pragent-bot 2026-08-20 22:16:21 +00:00
  • e8ebc54362 feat(review): ADDITIONAL_CONTEXT_URL — repo-provided static context cached per review Marcos 2026-08-20 17:45:51 +00:00
  • 998f793ec2 feat(agent): tighten prompt to bound beyond-diff reads + de-generalize cost-model labels Marcos 2026-08-20 17:35:06 +00:00
  • f6be2b3c61 feat(review): PR-level collapsible metadata + emoji-tagged inline comments Marcos 2026-08-20 16:51:20 +00:00
  • 5302e8dcd7 fix(review): salvage findings from nested-object fences + bare arrays + unfenced tail JSON Marcos 2026-08-20 16:29:44 +00:00
  • ec26ec000a feat(review): equivalent provider price + enriched .pr-review.json schema Marcos 2026-08-20 16:12:46 +00:00
  • 770581bf53 feat(input): add diff_compress module + prior-review compaction helpers Marcos 2026-08-20 16:12:33 +00:00
  • f59b906395 chore: scrub private infrastructure for a public repo, rewrite README Marcos 2026-08-18 12:59:52 +00:00
  • 46513585ae Merge PR #7: harden the pilot against hostile PR content, add review skills + cost model gitea_admin 2026-08-18 05:31:07 +00:00