2026-04-14 16:36:31 - __main__ - INFO - ============================================================ 2026-04-14 16:36:31 - __main__ - INFO - ImdbUpdate v2 - Avvio (DuckDB pipeline) 2026-04-14 16:36:31 - __main__ - INFO - ============================================================ 2026-04-14 16:36:31 - __main__ - INFO - Base directory: C:\PYTHON\ImdbUpdate 2026-04-14 16:36:31 - __main__ - INFO - Temp directory: C:\PYTHON\ImdbUpdate\Temp 2026-04-14 16:36:31 - __main__ - INFO - Parquet output: C:\PYTHON\ImdbUpdate\parquet\imdb_full.parquet 2026-04-14 16:36:31 - __main__ - INFO - Pulizia file residui all'avvio... 2026-04-14 16:36:31 - __main__ - INFO - Nessun file residuo trovato 2026-04-14 16:36:31 - __main__ - INFO - Preparazione directory temporanea 2026-04-14 16:36:31 - __main__ - INFO - Eliminazione C:\PYTHON\ImdbUpdate\Temp 2026-04-14 16:36:31 - __main__ - INFO - Directory creata: C:\PYTHON\ImdbUpdate\Temp 2026-04-14 16:36:31 - __main__ - INFO - ============================================================ 2026-04-14 16:36:31 - __main__ - INFO - FASE 2: Download dataset IMDb 2026-04-14 16:36:31 - __main__ - INFO - ============================================================ 2026-04-14 16:36:31 - src.downloader - INFO - Download name_basics.tsv.gz da https://datasets.imdbws.com/name.basics.tsv.gz 2026-04-14 16:36:39 - src.downloader - INFO - Download completato: C:\PYTHON\ImdbUpdate\Temp\name_basics.tsv.gz 2026-04-14 16:36:39 - src.downloader - INFO - Decompressione name_basics.tsv.gz -> name_basics.tsv 2026-04-14 16:36:42 - src.downloader - INFO - Decompressione completata: C:\PYTHON\ImdbUpdate\Temp\name_basics.tsv 2026-04-14 16:36:42 - src.downloader - INFO - Rinominato name_basics.tsv -> name_basics.txt 2026-04-14 16:36:42 - src.downloader - INFO - Download title_akas.tsv.gz da https://datasets.imdbws.com/title.akas.tsv.gz 2026-04-14 16:36:55 - src.downloader - INFO - Download completato: C:\PYTHON\ImdbUpdate\Temp\title_akas.tsv.gz 2026-04-14 16:36:55 - src.downloader - INFO - Decompressione title_akas.tsv.gz -> title_akas.tsv 2026-04-14 16:37:10 - src.downloader - INFO - Decompressione completata: C:\PYTHON\ImdbUpdate\Temp\title_akas.tsv 2026-04-14 16:37:10 - src.downloader - INFO - Rinominato title_akas.tsv -> title_akas.txt 2026-04-14 16:37:10 - src.downloader - INFO - Download title_basics.tsv.gz da https://datasets.imdbws.com/title.basics.tsv.gz 2026-04-14 16:37:16 - src.downloader - INFO - Download completato: C:\PYTHON\ImdbUpdate\Temp\title_basics.tsv.gz 2026-04-14 16:37:16 - src.downloader - INFO - Decompressione title_basics.tsv.gz -> title_basics.tsv 2026-04-14 16:37:20 - src.downloader - INFO - Decompressione completata: C:\PYTHON\ImdbUpdate\Temp\title_basics.tsv 2026-04-14 16:37:20 - src.downloader - INFO - Rinominato title_basics.tsv -> title_basics.txt 2026-04-14 16:37:20 - src.downloader - INFO - Download title_crew.tsv.gz da https://datasets.imdbws.com/title.crew.tsv.gz 2026-04-14 16:37:23 - src.downloader - INFO - Download completato: C:\PYTHON\ImdbUpdate\Temp\title_crew.tsv.gz 2026-04-14 16:37:23 - src.downloader - INFO - Decompressione title_crew.tsv.gz -> title_crew.tsv 2026-04-14 16:37:24 - src.downloader - INFO - Decompressione completata: C:\PYTHON\ImdbUpdate\Temp\title_crew.tsv 2026-04-14 16:37:24 - src.downloader - INFO - Rinominato title_crew.tsv -> title_crew.txt 2026-04-14 16:37:24 - src.downloader - INFO - Download title_episode.tsv.gz da https://datasets.imdbws.com/title.episode.tsv.gz 2026-04-14 16:37:27 - src.downloader - INFO - Download completato: C:\PYTHON\ImdbUpdate\Temp\title_episode.tsv.gz 2026-04-14 16:37:27 - src.downloader - INFO - Decompressione title_episode.tsv.gz -> title_episode.tsv 2026-04-14 16:37:28 - src.downloader - INFO - Decompressione completata: C:\PYTHON\ImdbUpdate\Temp\title_episode.tsv 2026-04-14 16:37:28 - src.downloader - INFO - Rinominato title_episode.tsv -> title_episode.txt 2026-04-14 16:37:28 - src.downloader - INFO - Download title_principals.tsv.gz da https://datasets.imdbws.com/title.principals.tsv.gz 2026-04-14 16:37:47 - src.downloader - INFO - Download completato: C:\PYTHON\ImdbUpdate\Temp\title_principals.tsv.gz 2026-04-14 16:37:47 - src.downloader - INFO - Decompressione title_principals.tsv.gz -> title_principals.tsv 2026-04-14 16:38:05 - src.downloader - INFO - Decompressione completata: C:\PYTHON\ImdbUpdate\Temp\title_principals.tsv 2026-04-14 16:38:05 - src.downloader - INFO - Rinominato title_principals.tsv -> title_principals.txt 2026-04-14 16:38:05 - src.downloader - INFO - Download title_ratings.tsv.gz da https://datasets.imdbws.com/title.ratings.tsv.gz 2026-04-14 16:38:06 - src.downloader - INFO - Download completato: C:\PYTHON\ImdbUpdate\Temp\title_ratings.tsv.gz 2026-04-14 16:38:06 - src.downloader - INFO - Decompressione title_ratings.tsv.gz -> title_ratings.tsv 2026-04-14 16:38:06 - src.downloader - INFO - Decompressione completata: C:\PYTHON\ImdbUpdate\Temp\title_ratings.tsv 2026-04-14 16:38:06 - src.downloader - INFO - Rinominato title_ratings.tsv -> title_ratings.txt 2026-04-14 16:38:06 - src.downloader - INFO - Processati 7/7 file 2026-04-14 16:38:06 - __main__ - INFO - Download completato: 7 file 2026-04-14 16:38:06 - __main__ - INFO - ============================================================ 2026-04-14 16:38:06 - __main__ - INFO - FASE 3: Transform DuckDB → imdb.parquet 2026-04-14 16:38:06 - __main__ - INFO - ============================================================ 2026-04-14 16:38:06 - src.transformer - INFO - Caricamento title_basics: title_basics.txt 2026-04-14 16:38:11 - src.transformer - INFO - title_basics: 1,265,218 righe (filtrate per titleType) 2026-04-14 16:38:11 - src.transformer - INFO - Caricamento title_akas: title_akas.txt 2026-04-14 16:38:24 - src.transformer - INFO - title_akas: 5,326,342 righe (solo region=IT) 2026-04-14 16:38:24 - src.transformer - INFO - Caricamento title_ratings: title_ratings.txt 2026-04-14 16:38:25 - src.transformer - INFO - title_ratings: 1,660,809 righe 2026-04-14 16:38:25 - src.transformer - INFO - Caricamento title_principals: title_principals.txt 2026-04-14 16:38:52 - src.transformer - INFO - title_principals: 31,803,178 righe (director+actor) 2026-04-14 16:38:52 - src.transformer - INFO - Caricamento name_basics: name_basics.txt 2026-04-14 16:38:57 - src.transformer - INFO - name_basics: 15,242,807 righe 2026-04-14 16:38:57 - src.transformer - INFO - Costruzione new_imdb (step separati)... 2026-04-14 16:38:57 - src.transformer - INFO - Step 1/4: titoli italiani 2026-04-14 16:38:58 - src.transformer - INFO - Step 2/4: registi 2026-04-14 16:39:05 - src.transformer - INFO - Step 3/4: attori 2026-04-14 16:39:17 - src.transformer - INFO - Step 4/4: join finale 2026-04-14 16:39:19 - src.transformer - INFO - new_imdb: 1,265,218 righe 2026-04-14 16:39:19 - src.transformer - INFO - Scrittura parquet: C:\PYTHON\ImdbUpdate\parquet\imdb_full.parquet 2026-04-14 16:39:21 - src.transformer - INFO - Parquet scritto: 1,265,218 righe, 51.2 MB 2026-04-14 16:39:21 - __main__ - INFO - Transform completato: 1,265,218 righe in parquet 2026-04-14 16:39:23 - __main__ - INFO - Parquet copiato in: I:\SOFTWARE\PYTHON_SRV\parquet_layer1\imdb_full.parquet 2026-04-14 16:39:23 - __main__ - INFO - ============================================================ 2026-04-14 16:39:23 - __main__ - INFO - FASE 4: Export Parquet → MS Access 2026-04-14 16:39:23 - __main__ - INFO - ============================================================ 2026-04-14 16:39:23 - src.access_exporter - INFO - Copia template Access: db_split_IMDB.accdb -> db_split_IMDB.accdb 2026-04-14 16:39:23 - src.access_exporter - INFO - Database Access creato: C:\PYTHON\ImdbUpdate\Temp\db_split_IMDB.accdb 2026-04-14 16:39:24 - src.access_exporter - INFO - Export Parquet -> Access: C:\PYTHON\ImdbUpdate\Temp\db_split_IMDB.accdb 2026-04-14 16:39:24 - __main__ - ERROR - Errore fatale: Unable to find a usable engine; tried using: 'pyarrow', 'fastparquet'. A suitable version of pyarrow or fastparquet is required for parquet support. Trying to import the above resulted in these errors: - `Import pyarrow` failed. pyarrow is required for parquet support. Use pip or conda to install the pyarrow package. - `Import fastparquet` failed. fastparquet is required for parquet support. Use pip or conda to install the fastparquet package. Traceback (most recent call last): File "C:\PYTHON\ImdbUpdate\main.py", line 256, in main if not export_to_access(): ^^^^^^^^^^^^^^^^^^ File "C:\PYTHON\ImdbUpdate\main.py", line 117, in export_to_access exporter.export_parquet_to_access(PARQUET_OUTPUT_PATH, ACCESS_DB_FINAL, "IMDB") File "C:\PYTHON\ImdbUpdate\src\access_exporter.py", line 65, in export_parquet_to_access df = pd.read_parquet(parquet_path, columns=_ACCESS_COLUMNS) ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ File "C:\PYTHON\_runtimes\venv\Lib\site-packages\pandas\io\parquet.py", line 668, in read_parquet impl = get_engine(engine) ^^^^^^^^^^^^^^^^^^ File "C:\PYTHON\_runtimes\venv\Lib\site-packages\pandas\io\parquet.py", line 68, in get_engine raise ImportError( ImportError: Unable to find a usable engine; tried using: 'pyarrow', 'fastparquet'. A suitable version of pyarrow or fastparquet is required for parquet support. Trying to import the above resulted in these errors: - `Import pyarrow` failed. pyarrow is required for parquet support. Use pip or conda to install the pyarrow package. - `Import fastparquet` failed. fastparquet is required for parquet support. Use pip or conda to install the fastparquet package.