---
title: "Epoch AI"
section: "entities"
type: "entity"
created: "2026-08-27"
updated: "2026-08-27"
confidence: "high"
tags: ["company", "evaluation"]
canonical: "https://pyweb.dev/wiki/epoch-ai"
---
# Epoch AI

Epoch AI publishes research on AI capabilities and benchmark interpretation. Its analysis of SWE-bench Verified emphasizes the benchmark's concentration in small Python bug fixes, limited repository diversity, contamination risk, and sensitivity to the surrounding scaffold. [[source: epoch-swe-bench-verified-analysis-2025]](/wiki/raw/articles/epoch-swe-bench-verified-analysis-2025)

## Related
- [agentic quality evidence](/wiki/agentic-quality-evidence) — benchmark-validity evidence
- [error analysis and evals](/wiki/error-analysis-and-evals) — evaluation design
- [agentic code quality](/wiki/agentic-code-quality) — oracle-health controls

---

## Agent Navigation

cluster: person (170 pages) | betweenness: 23.2

### References (outbound)
- [Agentic Code Quality — Evidence Map](https://pyweb.dev/wiki/agentic-quality-evidence.md)
- [Error Analysis and Evals](https://pyweb.dev/wiki/error-analysis-and-evals.md)
- [Agentic Code Quality](https://pyweb.dev/wiki/agentic-code-quality.md)

### Referenced by (inbound)
- [Agentic Code Quality Evidence — Entity Accounting](https://pyweb.dev/wiki/agentic-code-quality-entity-accounting.md)

### Evidence (verified primary sources)
- [epoch-swe-bench-verified-analysis-2025](https://pyweb.dev/wiki/raw/articles/epoch-swe-bench-verified-analysis-2025.md) | origin: https://epoch.ai/publications/what-skills-does-swe-bench-verified-evaluate | ingested: 2026-08-27 | sha256: f05fee7402177a3d7e59f352333770bfbc66f47451ad08ad47c3822b8682bfaa

### Machine endpoints
- Knowledge graph: https://pyweb.dev/api/graph.json
- Graph analysis: https://pyweb.dev/api/graph-analysis.json
- Context index: https://pyweb.dev/llms.txt
