498 lines
20 KiB
Python
498 lines
20 KiB
Python
"""
|
|
Tareas Celery para importación CSV de Conductores.
|
|
Flujo: scan_file (validación) → insert_valid_rows (commit).
|
|
Usa layouts_csv.common (storage, normalize, meta, responses); CSV con headers duplicados (dedupe) y clave de estado en Redis.
|
|
Paridad Clarion: actualizar, existing_driver_keys, valid_transporter_keys, valid_country_ame.
|
|
"""
|
|
import csv
|
|
import json
|
|
import logging
|
|
import os
|
|
from typing import Dict, Any, Optional, List, Set, Tuple
|
|
|
|
from core.celery_app import celery_app
|
|
from core.database import CoreSessionLocal
|
|
from sqlalchemy import func
|
|
|
|
from ..common import storage as common_storage
|
|
from ..common import normalize as common_normalize
|
|
from ..common import meta as common_meta
|
|
from ..common import responses as common_responses
|
|
from .template_config import row_from_template
|
|
from .validators import validate_row_driver, validate_row_driver_desfase
|
|
from .common.mappers import row_to_driver_data
|
|
from .common.fk_loader import load_drivers_fk_sets
|
|
|
|
logger = logging.getLogger(__name__)
|
|
|
|
JOB_TYPE = "drv"
|
|
|
|
# Para routes.py
|
|
DRV_IMPORT_FILE_PREFIX = "drv_import_file:"
|
|
DRV_IMPORT_META_PREFIX = "drv_import_meta:"
|
|
DRV_IMPORT_ERROR_LINES_PREFIX = "drv_import_error_lines:"
|
|
DRV_IMPORT_STATUS_PREFIX = "drv_import_status:"
|
|
DRV_IMPORT_REDIS_TTL = common_storage.IMPORT_REDIS_TTL
|
|
DRV_IMPORT_TRANSPORTER_MAP_PREFIX = "drv_import_transporter_map:"
|
|
|
|
|
|
def _get_redis():
|
|
import redis
|
|
url = os.getenv("VALKEY_URL", os.getenv("REDIS_URL", "redis://valkey:6379/0"))
|
|
return redis.Redis.from_url(url, decode_responses=False)
|
|
|
|
|
|
def _dedupe_headers(headers: List[str]) -> List[str]:
|
|
counts: Dict[str, int] = {}
|
|
unique: List[str] = []
|
|
for header in headers:
|
|
name = str(header or "").strip() or "COL"
|
|
count = counts.get(name, 0) + 1
|
|
counts[name] = count
|
|
unique.append(name if count == 1 else f"{name} {count}")
|
|
return unique
|
|
|
|
|
|
def _do_scan(job_id: str, progress_callback: Optional[Any] = None) -> Dict[str, Any]:
|
|
file_path = common_storage.ensure_file_from_redis(JOB_TYPE, job_id, "Drivers import")
|
|
if not file_path:
|
|
return {"status": "failed", "error": "Archivo no encontrado (expirado o no subido). Sube de nuevo."}
|
|
common_storage.ensure_meta_from_redis(JOB_TYPE, job_id, file_path, "Drivers import")
|
|
|
|
error_path = common_storage.error_path_for_job(JOB_TYPE, job_id)
|
|
|
|
try:
|
|
with open(file_path, "r", encoding="utf-8-sig") as f:
|
|
total_rows = sum(1 for _ in f) - 1
|
|
except Exception as e:
|
|
return {"status": "failed", "error": str(e)}
|
|
|
|
try:
|
|
tenant_id, company_id = common_meta.require_tenant_context(file_path)
|
|
except ValueError as e:
|
|
return {"status": "failed", "error": str(e)}
|
|
|
|
meta = common_meta.load_meta(file_path) or {}
|
|
actualizar = meta.get("actualizar", False)
|
|
existing_driver_keys: Set[Tuple[str, int]] = set()
|
|
if actualizar:
|
|
try:
|
|
from api.v1.modules.a76.transportation.drivers.models import Driver
|
|
with CoreSessionLocal() as session:
|
|
for row in (
|
|
session.query(Driver.transporter_key, Driver.line)
|
|
.filter(
|
|
Driver.tenant_id == tenant_id,
|
|
Driver.company_id == company_id,
|
|
)
|
|
.all()
|
|
):
|
|
if row[0] is not None and row[1] is not None:
|
|
existing_driver_keys.add(
|
|
((row[0] or "").strip().upper(), int(row[1]))
|
|
)
|
|
except Exception as e:
|
|
logger.warning("Drivers import: could not load existing_driver_keys for actualizar: %s", e)
|
|
|
|
valid_transporter_keys, valid_country_ame, transporter_key_actual = load_drivers_fk_sets(tenant_id, company_id)
|
|
|
|
try:
|
|
r = _get_redis()
|
|
r.set(
|
|
f"{DRV_IMPORT_TRANSPORTER_MAP_PREFIX}{job_id}",
|
|
json.dumps(transporter_key_actual).encode("utf-8"),
|
|
ex=DRV_IMPORT_REDIS_TTL,
|
|
)
|
|
except Exception as e:
|
|
logger.warning("Drivers import: failed to store transporter map in Redis: %s", e)
|
|
|
|
logger.info(
|
|
"Drivers import scan: job_id=%s tenant_id=%s company_id=%s actualizar=%s transportistas=%d",
|
|
job_id, tenant_id, company_id, actualizar, len(valid_transporter_keys),
|
|
)
|
|
|
|
error_count = 0
|
|
processed_rows = 0
|
|
errors_detail: List[Dict[str, Any]] = []
|
|
error_lines_list: List[int] = []
|
|
|
|
try:
|
|
with open(file_path, "r", encoding="utf-8-sig") as f_in, open(
|
|
error_path, "w", encoding="utf-8"
|
|
) as f_err:
|
|
sample = f_in.read(2048)
|
|
f_in.seek(0)
|
|
try:
|
|
dialect = csv.Sniffer().sniff(sample, delimiters=",;\t")
|
|
except Exception:
|
|
dialect = "excel"
|
|
reader = csv.reader(f_in, dialect=dialect)
|
|
try:
|
|
headers = next(reader)
|
|
except StopIteration:
|
|
headers = []
|
|
headers = _dedupe_headers(headers)
|
|
dict_reader = csv.DictReader(f_in, fieldnames=headers, dialect=dialect)
|
|
|
|
for i, row in enumerate(dict_reader, start=1):
|
|
if progress_callback and i % 500 == 0:
|
|
progress_callback(i, total_rows, error_count)
|
|
|
|
row_norm = row_from_template(row, common_normalize.normalize_header)
|
|
_ = validate_row_driver_desfase(row_norm, i)
|
|
err = validate_row_driver(
|
|
row_norm,
|
|
i,
|
|
actualizar=actualizar,
|
|
existing_driver_keys=existing_driver_keys,
|
|
valid_transporter_keys=valid_transporter_keys,
|
|
valid_country_ame=valid_country_ame,
|
|
)
|
|
if err:
|
|
error_count += 1
|
|
error_lines_list.append(err["line"])
|
|
f_err.write(json.dumps(err) + "\n")
|
|
if len(errors_detail) < 500:
|
|
errors_detail.append({
|
|
"line": err["line"],
|
|
"col": err.get("col", ""),
|
|
"msg": err.get("msg", ""),
|
|
})
|
|
processed_rows += 1
|
|
|
|
if error_lines_list:
|
|
common_storage.store_error_lines(JOB_TYPE, job_id, error_lines_list)
|
|
except Exception as e:
|
|
logger.error("Drivers import scan failed: %s", e)
|
|
return {"status": "failed", "error": str(e)}
|
|
|
|
return common_responses.scan_result(job_id, processed_rows, error_count, errors_detail)
|
|
|
|
|
|
def run_scan_sync(job_id: str) -> Dict[str, Any]:
|
|
result = _do_scan(job_id, progress_callback=None)
|
|
try:
|
|
r = _get_redis()
|
|
r.set(
|
|
f"{DRV_IMPORT_STATUS_PREFIX}{job_id}",
|
|
json.dumps(result).encode("utf-8"),
|
|
ex=DRV_IMPORT_REDIS_TTL,
|
|
)
|
|
except Exception as e:
|
|
logger.warning("Drivers import: failed to store scan status in Redis: %s", e)
|
|
return result
|
|
|
|
|
|
@celery_app.task(bind=True)
|
|
def scan_file(self, job_id: str, config: str = None):
|
|
logger.info("Drivers import: starting scan for job %s", job_id)
|
|
|
|
def on_progress(current: int, total: int, errors: int) -> None:
|
|
self.update_state(state="PROGRESS", meta={"current": current, "total": total, "errors": errors})
|
|
|
|
result = _do_scan(job_id, progress_callback=on_progress)
|
|
try:
|
|
r = _get_redis()
|
|
r.set(
|
|
f"{DRV_IMPORT_STATUS_PREFIX}{job_id}",
|
|
json.dumps(result).encode("utf-8"),
|
|
ex=DRV_IMPORT_REDIS_TTL,
|
|
)
|
|
except Exception as e:
|
|
logger.warning("Drivers import: failed to store scan status in Redis: %s", e)
|
|
return result
|
|
|
|
|
|
def _do_commit(job_id: str) -> Dict[str, Any]:
|
|
file_path = common_storage.ensure_file_from_redis(JOB_TYPE, job_id, "Drivers import")
|
|
if not file_path:
|
|
alt_path = common_storage.file_path_for_job(JOB_TYPE, job_id)
|
|
if not os.path.exists(alt_path):
|
|
return {"status": "failed", "error": "Archivo no encontrado (expirado). Sube y confirma de nuevo."}
|
|
file_path = alt_path
|
|
else:
|
|
common_storage.ensure_meta_from_redis(JOB_TYPE, job_id, file_path, "Drivers import")
|
|
|
|
error_path = common_storage.error_path_for_job(JOB_TYPE, job_id)
|
|
error_lines = common_storage.get_error_lines(JOB_TYPE, job_id, error_path)
|
|
|
|
try:
|
|
tenant_id, company_id = common_meta.require_tenant_context(file_path)
|
|
except ValueError as e:
|
|
return {"status": "failed", "error": str(e)}
|
|
|
|
meta = common_meta.load_meta(file_path) or {}
|
|
actualizar = meta.get("actualizar", False)
|
|
existing_driver_keys: Set[Tuple[str, int]] = set()
|
|
if actualizar:
|
|
try:
|
|
from api.v1.modules.a76.transportation.drivers.models import Driver
|
|
with CoreSessionLocal() as session:
|
|
for row in (
|
|
session.query(Driver.transporter_key, Driver.line)
|
|
.filter(
|
|
Driver.tenant_id == tenant_id,
|
|
Driver.company_id == company_id,
|
|
)
|
|
.all()
|
|
):
|
|
if row[0] is not None and row[1] is not None:
|
|
existing_driver_keys.add(
|
|
((row[0] or "").strip().upper(), int(row[1]))
|
|
)
|
|
except Exception as e:
|
|
logger.warning("Drivers import: could not load existing_driver_keys for actualizar: %s", e)
|
|
|
|
valid_transporter_keys, valid_country_ame, transporter_key_actual = load_drivers_fk_sets(tenant_id, company_id)
|
|
|
|
transporter_map_from_redis: Optional[Dict[str, str]] = None
|
|
try:
|
|
r = _get_redis()
|
|
map_key = f"{DRV_IMPORT_TRANSPORTER_MAP_PREFIX}{job_id}"
|
|
raw = r.get(map_key)
|
|
if raw:
|
|
transporter_map_from_redis = json.loads(raw.decode("utf-8"))
|
|
logger.info(
|
|
"Drivers import commit: using transporter map from Redis (job_id=%s, keys=%d)",
|
|
job_id, len(transporter_map_from_redis),
|
|
)
|
|
else:
|
|
logger.warning(
|
|
"Drivers import commit: no transporter map in Redis for job_id=%s, using DB fallback",
|
|
job_id,
|
|
)
|
|
except Exception as e:
|
|
logger.warning(
|
|
"Drivers import: could not load transporter map from Redis (job_id=%s): %s",
|
|
job_id, e,
|
|
)
|
|
|
|
logger.info(
|
|
"Drivers import commit: job_id=%s tenant_id=%s company_id=%s transportistas=%d",
|
|
job_id, tenant_id, company_id, len(valid_transporter_keys),
|
|
)
|
|
|
|
from api.v1.modules.a76.transportation.drivers.services import DriverService
|
|
from api.v1.modules.a76.transportation.drivers.dto import DriverCreateDTO
|
|
|
|
inserted_count = 0
|
|
updated_count = 0
|
|
skipped_invalid = 0
|
|
skipped_duplicate = 0
|
|
skipped_details: List[Dict[str, Any]] = []
|
|
seen_keys_in_file: Dict[str, int] = {}
|
|
meta_path = common_meta.get_meta_path(file_path)
|
|
|
|
try:
|
|
with CoreSessionLocal() as session:
|
|
with open(file_path, "r", encoding="utf-8-sig") as f:
|
|
sample = f.read(2048)
|
|
f.seek(0)
|
|
try:
|
|
dialect = csv.Sniffer().sniff(sample, delimiters=",;\t")
|
|
except Exception:
|
|
dialect = "excel"
|
|
reader = csv.reader(f, dialect=dialect)
|
|
try:
|
|
headers = next(reader)
|
|
except StopIteration:
|
|
headers = []
|
|
headers = _dedupe_headers(headers)
|
|
dict_reader = csv.DictReader(f, fieldnames=headers, dialect=dialect)
|
|
|
|
for i, row in enumerate(dict_reader, start=1):
|
|
if i in error_lines:
|
|
continue
|
|
|
|
row_norm = row_from_template(row, common_normalize.normalize_header)
|
|
err = validate_row_driver(
|
|
row_norm,
|
|
i,
|
|
actualizar=actualizar,
|
|
existing_driver_keys=existing_driver_keys,
|
|
valid_transporter_keys=valid_transporter_keys,
|
|
valid_country_ame=valid_country_ame,
|
|
)
|
|
if err:
|
|
skipped_invalid += 1
|
|
driver_key = (row_norm.get("CLAVE CONDUCTOR") or "").strip()[:80] or "-"
|
|
skipped_details.append({
|
|
"line": i,
|
|
"driver_key": driver_key,
|
|
"invoice": driver_key,
|
|
"reason": f"{err.get('col', '')}: {err.get('msg', '')}",
|
|
})
|
|
continue
|
|
|
|
data = row_to_driver_data(row_norm, tenant_id, company_id)
|
|
if not data or not data.get("transporter_key") or data.get("line") is None:
|
|
skipped_invalid += 1
|
|
continue
|
|
|
|
tk = (data["transporter_key"] or "").strip()
|
|
# Usar mapa del scan (Redis) si existe; si no, resolver en la sesión del commit (fallback)
|
|
if transporter_map_from_redis is not None:
|
|
tk_upper = tk.upper()
|
|
if tk_upper not in transporter_map_from_redis:
|
|
skipped_invalid += 1
|
|
skipped_details.append({
|
|
"line": i,
|
|
"driver_key": f"{tk}:{data.get('line')}",
|
|
"invoice": f"{tk}:{data.get('line')}",
|
|
"reason": f"El transportista {tk} no existe en el catálogo.",
|
|
})
|
|
continue
|
|
data["transporter_key"] = transporter_map_from_redis[tk_upper]
|
|
else:
|
|
from api.v1.modules.a76.transportation.transporters.models import Transporter
|
|
transporter_row = (
|
|
session.query(Transporter.transporter_key)
|
|
.filter(
|
|
Transporter.tenant_id == tenant_id,
|
|
Transporter.company_id == company_id,
|
|
func.upper(Transporter.transporter_key) == tk.upper(),
|
|
)
|
|
.first()
|
|
)
|
|
if not transporter_row or not transporter_row[0]:
|
|
skipped_invalid += 1
|
|
skipped_details.append({
|
|
"line": i,
|
|
"driver_key": f"{tk}:{data.get('line')}",
|
|
"invoice": f"{tk}:{data.get('line')}",
|
|
"reason": f"El transportista {tk} no existe en el catálogo.",
|
|
})
|
|
continue
|
|
data["transporter_key"] = (transporter_row[0] or "").strip()
|
|
|
|
key = f"{data['transporter_key']}:{data['line']}"
|
|
if key in seen_keys_in_file:
|
|
skipped_duplicate += 1
|
|
skipped_details.append({
|
|
"line": i,
|
|
"driver_key": key,
|
|
"invoice": key,
|
|
"reason": "Clave duplicada en el archivo (se usa la primera)",
|
|
})
|
|
continue
|
|
seen_keys_in_file[key] = i
|
|
|
|
existing = DriverService.get_driver_by_key_and_line(
|
|
session, data["transporter_key"], data["line"], str(company_id), tenant_id
|
|
)
|
|
try:
|
|
if existing:
|
|
update_fields = {
|
|
k: v for k, v in data.items()
|
|
if k not in ("transporter_key", "line", "company_id", "tenant_id")
|
|
}
|
|
for field, value in update_fields.items():
|
|
setattr(existing, field, value)
|
|
session.add(existing)
|
|
updated_count += 1
|
|
else:
|
|
create_data = DriverCreateDTO(**data)
|
|
DriverService.create_driver(session, create_data)
|
|
inserted_count += 1
|
|
except Exception as db_err:
|
|
session.rollback()
|
|
skipped_invalid += 1
|
|
err_msg = str(db_err)
|
|
if "ForeignKeyViolation" in err_msg or "foreign key constraint" in err_msg.lower() or "driver_transporter_key_fkey" in err_msg:
|
|
err_msg = f"El transportista {data.get('transporter_key', '')} no existe en el catálogo."
|
|
logger.warning(
|
|
"Drivers import: FK violation linea %d transporter_key=%r (valid_transporter_keys tiene %d claves)",
|
|
i, data.get("transporter_key"), len(valid_transporter_keys),
|
|
)
|
|
skipped_details.append({
|
|
"line": i, "driver_key": key, "invoice": key, "reason": err_msg,
|
|
})
|
|
continue
|
|
|
|
try:
|
|
session.commit()
|
|
except Exception as db_err:
|
|
session.rollback()
|
|
logger.error("Drivers import DB error: %s", db_err)
|
|
return {"status": "failed", "error": str(db_err)}
|
|
|
|
except Exception as e:
|
|
logger.exception("Drivers import task failed")
|
|
return {"status": "failed", "error": str(e)}
|
|
|
|
common_storage.cleanup_import_job(
|
|
JOB_TYPE, job_id,
|
|
file_path=file_path,
|
|
error_path=error_path,
|
|
meta_path=meta_path,
|
|
)
|
|
try:
|
|
r = _get_redis()
|
|
r.delete(f"{DRV_IMPORT_STATUS_PREFIX}{job_id}")
|
|
r.delete(f"{DRV_IMPORT_TRANSPORTER_MAP_PREFIX}{job_id}")
|
|
except Exception as e:
|
|
logger.warning("Drivers import: failed to delete status key: %s", e)
|
|
|
|
total_ok = inserted_count + updated_count
|
|
if total_ok == 0 and (skipped_invalid + skipped_duplicate) > 0:
|
|
return {
|
|
"status": "warning",
|
|
"inserted": inserted_count,
|
|
"updated": updated_count,
|
|
"skipped_invalid": skipped_invalid,
|
|
"skipped_duplicate": skipped_duplicate,
|
|
"skipped_missing_fk": 0,
|
|
"skipped_details": skipped_details,
|
|
"message": f"No se insertaron registros. {skipped_invalid + skipped_duplicate} rechazados.",
|
|
}
|
|
if total_ok == 0:
|
|
return {
|
|
"status": "failed",
|
|
"error": "No hay registros validos en el archivo CSV",
|
|
"inserted": 0,
|
|
"updated": 0,
|
|
"skipped_invalid": skipped_invalid,
|
|
"skipped_duplicate": skipped_duplicate,
|
|
"skipped_missing_fk": 0,
|
|
"skipped_details": skipped_details,
|
|
}
|
|
return {
|
|
"status": "finished",
|
|
"inserted": inserted_count,
|
|
"updated": updated_count,
|
|
"skipped_invalid": skipped_invalid,
|
|
"skipped_duplicate": skipped_duplicate,
|
|
"skipped_missing_fk": 0,
|
|
"skipped_details": skipped_details,
|
|
}
|
|
|
|
|
|
def run_commit_sync(job_id: str) -> Dict[str, Any]:
|
|
result = _do_commit(job_id)
|
|
try:
|
|
r = _get_redis()
|
|
r.set(
|
|
f"{DRV_IMPORT_STATUS_PREFIX}{job_id}",
|
|
json.dumps(result).encode("utf-8"),
|
|
ex=DRV_IMPORT_REDIS_TTL,
|
|
)
|
|
except Exception as e:
|
|
logger.warning("Drivers import: failed to store commit status in Redis: %s", e)
|
|
return result
|
|
|
|
|
|
@celery_app.task(bind=True)
|
|
def insert_valid_rows(self, job_id: str):
|
|
logger.info("Drivers import: starting commit for job %s", job_id)
|
|
result = _do_commit(job_id)
|
|
try:
|
|
r = _get_redis()
|
|
r.set(
|
|
f"{DRV_IMPORT_STATUS_PREFIX}{job_id}",
|
|
json.dumps(result).encode("utf-8"),
|
|
ex=DRV_IMPORT_REDIS_TTL,
|
|
)
|
|
except Exception as e:
|
|
logger.warning("Drivers import: failed to store commit status in Redis: %s", e)
|
|
return result
|