metalfrom.eu/apps/geocoder/tests
Nicolas Fryder 578d2aec12
Some checks are pending
CI / javascript (push) Waiting to run
CI / python (push) Waiting to run
CI / mutation (push) Waiting to run
fix(groq): repli d'analyse JSON tronqué sur objet imbriqué + tests du worker
BUG — _parse_json perdait les réponses contenant un objet imbriqué
Le repli utilisé quand le modèle enrobe son JSON de prose s'appuyait sur
`\{[^}]+\}`, qui s'arrête au PREMIER `}`. Dès que la réponse contenait un objet
imbriqué (ex. {"city": "Oslo", "meta": {"confidence": 0.9}}), la capture était
tronquée donc invalide : _parse_json renvoyait None, le lieu comptait comme
« aucune ville trouvée », consommait un essai LLM et finissait par basculer en
'manual'. Aucune erreur levée — défaut silencieux, sur un appel facturé.
Le re.DOTALL passé en argument était de surcroît inopérant, `[^}]` matchant
déjà les retours à la ligne : signe que l'intention était `.`.
Corrigé en `\{.*\}` glouton, du premier `{` au dernier `}`.

TESTS (23) — helpers purs de groq_worker, jusqu'ici sans couverture
- _parse_json : JSON propre, enrobé de prose, imbriqué, multiligne, et tous
  les cas inexploitables — qui doivent rendre None sans jamais lever, sous
  peine d'interrompre le worker.
- _input_hash : c'est la clé du cache LLM, donc ce qui décide de rappeler Groq
  ou non. Vérifié qu'elle normalise casse et espaces (sinon on repaie des
  appels déjà faits) et qu'elle distingue modèle, lieu et pays.
- _cost et PRICING : un modèle absent de PRICING serait facturé au tarif de
  repli sans qu'on le remarque, faussant le coût affiché dans l'admin.
- _apply_clean_query : appelée pour de vrai avec un curseur factice plutôt que
  de réécrire la concaténation dans le test.

conftest reproduit le sys.path du conteneur (src/ ET racine de l'app) :
worker.py et groq_worker.py importent `parser` sans préfixe parce qu'ils sont
lancés en `python src/worker.py`.

Vérification écartée : `COUNTRY_NAMES.get(code, iso2)` retombe sur le code brut
pour un ISO2 inconnu (« Oslo, ZZ »). Mon test l'avait pris pour un bug ; c'est
volontaire — mieux vaut un code qu'aucun contexte pays. Documenté.

Deux tests tautologiques écrits puis supprimés avant commit : ils comparaient
deux f-strings identiques et ne vérifiaient rien.

Co-Authored-By: Claude <noreply@anthropic.com>
2026-08-19 15:10:17 +02:00
..
conftest.py fix(groq): repli d'analyse JSON tronqué sur objet imbriqué + tests du worker 2026-08-19 15:10:17 +02:00
test_groq_worker.py fix(groq): repli d'analyse JSON tronqué sur objet imbriqué + tests du worker 2026-08-19 15:10:17 +02:00
test_parser.py test: propriétés généralisées, scraper HTML et couche réseau couverts 2026-08-18 22:09:37 +02:00
test_parser_property.py test: propriétés généralisées, scraper HTML et couche réseau couverts 2026-08-18 22:09:37 +02:00