Production-grade evaluation framework & turnkey GitHub Action for benchmarking AI coding harnesses (Claude Code, Gemini CLI, Antigravity, OpenCode, DeepSeek), Model Context Protocol (MCP) servers, LSP diagnostics, and agent plugins across CoderEval & Terminal-Bench.
ablation-study
ai-agents
antigravity
benchmark
claude-code
coder-eval
coding-assistant
deepseek
developer-tools
gemini-cli
github-action
language-server-protocol
llm-evaluation
lsp
mcp
model-context-protocol
opencode
terminal-bench
Updated 2026-08-22 20:33:17 +00:00
Open-source Claude Code plugin marketplace framework and distribution CLI deploying fast quality guardrails (ruff, pyright, biome, clippy), MCP tools, and language packs.
agentic-coding
ai-harness
claude-code
claude-code-plugins
code-quality
linter
mcp-server
pre-commit
python
quality-guardrails
rust
typescript
Updated 2026-08-20 19:18:07 +00:00