Evaluate and implement comprehensive API monitoring
Nadie ha tomado este issue todavía.
Evaluación
- Dificultad
- 5/5
- Tiempo estimado
- Más de una semana
- Aptitud para principiantes
- 25/100
Línea de trabajo
Empieza por inventariar las operaciones de la API de PolicyEngine mencionadas en el issue y revisar las comprobaciones existentes a nivel de host, incluida la cobertura de grupos de rutas de #2155. Compara las opciones de monitorización personalizadas, autoalojadas y alojadas con los requisitos enumerados y, después, documenta la decisión, la cobertura de endpoints, la implementación, las notificaciones, las instrucciones operativas y las comprobaciones conservadas o aplazadas.
Escrito por el modelo de indexación a partir del texto del issue.
Descripción
Problem
PolicyEngine needs functional monitoring across substantially more API behavior than the Better Stack free tier can cover. Existing host-level checks do not detect failures limited to particular route groups, and realistic calculation monitoring may require authenticated requests, response validation, and polling asynchronous operations.
Adding paid Better Stack coverage immediately would commit us to a service and recurring cost before we have compared it with an internally operated solution or other hosted products.
This issue supersedes #2155 and should preserve its required coverage while broadening the work to include option evaluation and platform design.
Objective
Evaluate and implement a cost-effective monitoring approach for PolicyEngine APIs. The selected approach may be:
- a small custom service operated by PolicyEngine;
- an existing self-hosted monitoring product; or
- a paid hosted monitoring service, including Better Stack, if its cost and capabilities are the best fit.
Do not select an implementation until the alternatives have been compared against explicit requirements.
Investigation
- Inventory the API endpoints and complete user operations that need monitoring, including metadata, household, policy, user-profile, household-calculation, economy, and budget-window behavior.
- Define request frequency, acceptable response time, failure conditions, environments, and required geographic coverage.
- Determine requirements for:
- public and authenticated requests;
- safe test data and credential storage;
- multi-request and asynchronous operations;
- response status, content, and schema validation;
- Slack failure and recovery notifications, including duplicate suppression;
- execution history, latency reporting, and diagnostic evidence;
- configuration stored in version control;
- maintenance ownership, security updates, reliability, and data retention.
- Compare custom, self-hosted, and hosted approaches. Document expected recurring cost, implementation effort, operational burden, service limits, and vendor dependence.
- Prototype the leading candidates where documentation alone does not establish whether they satisfy the requirements.
Implementation
After recording the decision, implement the selected approach and migrate or supplement the existing checks. Monitoring should exercise representative successful operations with safe inputs rather than only checking API root responses.
Completion criteria
- The requirements and endpoint coverage inventory are documented.
- The alternatives and their expected costs and maintenance requirements are compared in writing.
- The selected approach and reasons for selecting it are documented.
- Required public, authenticated, and asynchronous API operations can be checked where applicable.
- Failures and recoveries produce actionable Slack notifications without excessive duplicate messages.
- Monitor definitions, credentials guidance, operating instructions, and ownership are documented.
- Existing checks are retained, migrated, or deliberately removed with the reason recorded.
- The route-group coverage previously tracked in #2155 is implemented or explicitly deferred in follow-up issues.
- Lenguaje dominante
- Python
- Estrellas
- 18
- Forks
- 33
- Merge medio
- 1 d 4 h
- PR fusionados (30 d)
- 21
Guía de contribución
Primeros pasos
- Lee el issue completo y luego la guía de contribución del proyecto.
- Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
- Haz un fork del repositorio y trabaja en una rama.
- Abre un pull request que haga referencia al número del issue.
Más de PolicyEngine/policyengine-api
-
Dificultad 3/5 1-2 días Aptitud para principiantes 65/100
PolicyEngine/policyengine-api#3853 ·
-
Dificultad 3/5 1-2 días Aptitud para principiantes 65/100
PolicyEngine/policyengine-api#3851 ·
-
Dificultad 4/5 3-5 días Aptitud para principiantes 45/100
PolicyEngine/policyengine-api#3847 ·
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 38/100
PolicyEngine/policyengine-api#3823 ·
-
PolicyEngine/policyengine-api#3818 · 1 asignado ·
Todos los issues de PolicyEngine/policyengine-api
Issues similares
-
[Bug] reef-hermes tells me to resume with hermes --resume, which does not work from my shell Abiertoarea: harness bug status: needs-triage
Dificultad 2/5 1-3 horas Aptitud para principiantes 75/100
Human-Agent-Society/reef#625 ·
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 70/100
-
Dificultad 1/5 Menos de una hora Aptitud para principiantes 80/100
learningequality/kolibri#15351 · 2 comentarios ·
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 75/100
-
Name consistency Abierto
Dificultad 2/5 1-3 horas Aptitud para principiantes 75/100
eellak/triplestore#65 · 1 comentario ·