Compare commits
4 commits
3640f163fc
...
da62af835c
| Author | SHA1 | Date | |
|---|---|---|---|
|
da62af835c |
|||
|
32987d5557 |
|||
|
9d0b922db9 |
|||
|
a450601b80 |
2 changed files with 138 additions and 2 deletions
|
|
@ -113,13 +113,15 @@ def check_path_format(result: pd.Series, ensembles: list[str], projects: list[st
|
||||||
|
|
||||||
meas_key = p.split('::')[1]
|
meas_key = p.split('::')[1]
|
||||||
ensemble = p.split('/')[1]
|
ensemble = p.split('/')[1]
|
||||||
project = p.split('/')[2].split('::')[0]
|
project = p.split('/')[3].split('.')[0]
|
||||||
if not len(meas_key) == 64:
|
if not len(meas_key) == 64:
|
||||||
raise ValueError(f'meas_key of {p} is scrambled')
|
raise ValueError(f'meas_key of {p} is scrambled')
|
||||||
if ensemble not in ensembles:
|
if ensemble not in ensembles:
|
||||||
raise ValueError(f'meas_key of {p} points to an unknown ensemble')
|
raise ValueError(f'meas_key of {p} points to an unknown ensemble')
|
||||||
if project not in projects:
|
if project not in projects:
|
||||||
raise ValueError(f'meas_key of {p} points to an unknown project id')
|
raise ValueError(f'meas_key of {p} points to an unknown project id ({project})')
|
||||||
|
if not ensemble == result['ensemble']:
|
||||||
|
raise ValueError(f'Ensemble in database and file does not match for path {p}.')
|
||||||
|
|
||||||
|
|
||||||
|
|
||||||
|
|
|
||||||
|
|
@ -5,6 +5,9 @@ import corrlib.initialization as cinit
|
||||||
import sqlite3
|
import sqlite3
|
||||||
from pathlib import Path
|
from pathlib import Path
|
||||||
import os
|
import os
|
||||||
|
import pandas as pd
|
||||||
|
import datetime as dt
|
||||||
|
import pytest
|
||||||
|
|
||||||
|
|
||||||
def test_list_ensembles(tmp_path: Path) -> None:
|
def test_list_ensembles(tmp_path: Path) -> None:
|
||||||
|
|
@ -53,3 +56,134 @@ def test_list_projects(tmp_path: Path) -> None:
|
||||||
assert len(find_results) == 3
|
assert len(find_results) == 3
|
||||||
for f,i in zip(find_results, integ_results):
|
for f,i in zip(find_results, integ_results):
|
||||||
assert f == i
|
assert f == i
|
||||||
|
|
||||||
|
|
||||||
|
def test_has_valid_time() -> None:
|
||||||
|
record_A = ["f_A", "ensA", "sfcf", "archive/SF_A/f_A/Project_A.json.gz::asdfasdfasdf0", "SF_A", '{"par_A": 5.0, "par_B": 5.0}', "projects/SF_A/input.in",
|
||||||
|
'2025-03-26 12:55:18.229966', '2025-03-26 12:55:18.229966'] # only created
|
||||||
|
record_B = ["f_A", "ensA", "sfcf", "archive/SF_A/f_A/Project_A.json.gz::asdfasdfasdf1", "SF_A", '{"par_A": 5.0, "par_B": 5.0}', "projects/SF_A/input.in",
|
||||||
|
'2025-03-26 12:55:18.229966', '2025-04-26 12:55:18.229966'] # created and updated
|
||||||
|
record_C = ["f_A", "ensA", "sfcf", "archive/SF_A/f_A/Project_A.json.gz::asdfasdfasdf2", "SF_A", '{"par_A": 5.0, "par_B": 5.0}', "projects/SF_A/input.in",
|
||||||
|
'2026-03-26 12:55:18.229966', '2026-04-14 12:55:18.229966'] # created and updated later
|
||||||
|
record_D = ["f_A", "ensA", "sfcf", "archive/SF_A/f_A/Project_A.json.gz::asdfasdfasdf3", "SF_A", '{"par_A": 5.0, "par_B": 5.0}', "projects/SF_A/input.in",
|
||||||
|
'2026-03-26 12:55:18.229966', '2026-03-27 12:55:18.229966']
|
||||||
|
record_E = ["f_A", "ensA", "sfcf", "archive/SF_A/f_A/Project_A.json.gz::asdfasdfasdf4", "SF_A", '{"par_A": 5.0, "par_B": 5.0}', "projects/SF_A/input.in",
|
||||||
|
'2024-03-26 12:55:18.229966', '2024-03-26 12:55:18.229966'] # only created, earlier
|
||||||
|
record_F = ["f_A", "ensA", "sfcf", "archive/SF_A/f_A/Project_A.json.gz::asdfasdfasdf5", "SF_A", '{"par_A": 5.0, "par_B": 5.0}', "projects/SF_A/input.in",
|
||||||
|
'2026-03-26 12:55:18.229966', '2024-03-26 12:55:18.229966'] # this is invalid...
|
||||||
|
record_G = ["f_A", "ensA", "sfcf", "archive/SF_A/f_A/Project_A.json.gz::asdfasdfasdf2", "SF_A", '{"par_A": 5.0, "par_B": 5.0}', "projects/SF_A/input.in",
|
||||||
|
'2026-03-26 12:55:18.229966', str(dt.datetime.now() + dt.timedelta(days=2, hours=3, minutes=5, seconds=30))] # created and updated later
|
||||||
|
cols = ["name",
|
||||||
|
"ensemble",
|
||||||
|
"code",
|
||||||
|
"path",
|
||||||
|
"project",
|
||||||
|
"parameters",
|
||||||
|
"parameter_file",
|
||||||
|
"created_at",
|
||||||
|
"updated_at"]
|
||||||
|
data = [record_A, record_B, record_C, record_D, record_E]
|
||||||
|
|
||||||
|
df = pd.DataFrame(data,columns=cols)
|
||||||
|
for _, result in df.iterrows():
|
||||||
|
assert integ.has_valid_times(result)
|
||||||
|
data = [record_F, record_G]
|
||||||
|
df = pd.DataFrame(data,columns=cols)
|
||||||
|
for _, result in df.iterrows():
|
||||||
|
assert not integ.has_valid_times(result)
|
||||||
|
|
||||||
|
|
||||||
|
def test_are_keys_unique(tmp_path: Path) -> None:
|
||||||
|
db = tmp_path / 'test_success.db'
|
||||||
|
|
||||||
|
record_A = ["f_A", "ensA", "sfcf", "archive/SF_A/f_A/Project_A.json.gz::asdfasdfasdf0", "SF_A", '{"par_A": 5.0, "par_B": 5.0}', "projects/SF_A/input.in",
|
||||||
|
'2025-03-26 12:55:18.229966', '2025-03-26 12:55:18.229966'] # only created
|
||||||
|
record_B = ["f_A", "ensA", "sfcf", "archive/SF_A/f_A/Project_A.json.gz::asdfasdfasdf1", "SF_A", '{"par_A": 5.0, "par_B": 5.0}', "projects/SF_A/input.in",
|
||||||
|
'2025-03-26 12:55:18.229966', '2025-04-26 12:55:18.229966'] # created and updated
|
||||||
|
record_C = ["f_A", "ensA", "sfcf", "archive/SF_A/f_A/Project_A.json.gz::asdfasdfasdf2", "SF_A", '{"par_A": 5.0, "par_B": 5.0}', "projects/SF_A/input.in",
|
||||||
|
'2026-03-26 12:55:18.229966', '2026-04-14 12:55:18.229966'] # created and updated later
|
||||||
|
record_D = ["f_A", "ensA", "sfcf", "archive/SF_A/f_A/Project_A.json.gz::asdfasdfasdf3", "SF_A", '{"par_A": 5.0, "par_B": 5.0}', "projects/SF_A/input.in",
|
||||||
|
'2026-03-26 12:55:18.229966', '2026-03-27 12:55:18.229966']
|
||||||
|
record_E = ["f_A", "ensA", "sfcf", "archive/SF_A/f_A/Project_A.json.gz::asdfasdfasdf4", "SF_A", '{"par_A": 5.0, "par_B": 5.0}', "projects/SF_A/input.in",
|
||||||
|
'2024-03-26 12:55:18.229966', '2024-03-26 12:55:18.229966'] # only created, earlier
|
||||||
|
record_F = ["f_A", "ensA", "sfcf", "archive/SF_A/f_A/Project_A.json.gz::asdfasdfasdf5", "SF_A", '{"par_A": 5.0, "par_B": 5.0}', "projects/SF_A/input.in",
|
||||||
|
'2026-03-26 12:55:18.229966', '2024-03-26 12:55:18.229966'] # this is invalid...
|
||||||
|
record_G = ["f_A", "ensA", "sfcf", "archive/SF_A/f_A/Project_A.json.gz::asdfasdfasdf2", "SF_A", '{"par_A": 5.0, "par_B": 5.0}', "projects/SF_A/input.in",
|
||||||
|
'2026-03-26 12:55:18.229966', str(dt.datetime.now() + dt.timedelta(days=2, hours=3, minutes=5, seconds=30))] # created and updated later
|
||||||
|
|
||||||
|
cols = ["name",
|
||||||
|
"ensemble",
|
||||||
|
"code",
|
||||||
|
"path",
|
||||||
|
"project",
|
||||||
|
"parameters",
|
||||||
|
"parameter_file",
|
||||||
|
"created_at",
|
||||||
|
"updated_at"]
|
||||||
|
|
||||||
|
data = [record_A, record_B, record_C, record_D, record_E, record_F]
|
||||||
|
df = pd.DataFrame(data,columns=cols)
|
||||||
|
conn = sqlite3.connect(db)
|
||||||
|
df.to_sql('backlogs', conn)
|
||||||
|
conn.close()
|
||||||
|
assert integ.are_keys_unique(db, 'backlogs', 'path')
|
||||||
|
|
||||||
|
db = tmp_path / 'test_fail.db'
|
||||||
|
data = [record_A, record_B, record_C, record_D, record_E, record_F, record_G]
|
||||||
|
|
||||||
|
df = pd.DataFrame(data,columns=cols)
|
||||||
|
conn = sqlite3.connect(db)
|
||||||
|
df.to_sql('backlogs', conn)
|
||||||
|
conn.close()
|
||||||
|
assert not integ.are_keys_unique(db, 'backlogs', 'path')
|
||||||
|
|
||||||
|
|
||||||
|
def test_check_path_format() -> None:
|
||||||
|
record_A = ["f_A", "ensA", "sfcf", "archive/ensA/f_A/Project_A.json.gz::asdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdf", "SF_A", '{"par_A": 5.0, "par_B": 5.0}', "projects/SF_A/input.in",
|
||||||
|
'2025-03-26 12:55:18.229966', '2025-03-26 12:55:18.229966'] # only created
|
||||||
|
record_B = ["f_A", "ensA", "sfcf", "archive/ensA/f_A/Project_B.json.gz::asdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdf", "SF_A", '{"par_A": 5.0, "par_B": 5.0}', "projects/SF_A/input.in",
|
||||||
|
'2025-03-26 12:55:18.229966', '2025-04-26 12:55:18.229966'] # created and updated
|
||||||
|
record_C = ["f_A", "ensA", "sfcf", "archive/ensA/f_A/Project_A.json.gz::asdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdf", "SF_A", '{"par_A": 5.0, "par_B": 5.0}', "projects/SF_A/input.in",
|
||||||
|
'2026-03-26 12:55:18.229966', '2026-04-14 12:55:18.229966'] # created and updated later
|
||||||
|
record_D = ["f_A", "ensA", "sfcf", "archive/ensA/f_A/Project_B.json.gz::asdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdf", "SF_A", '{"par_A": 5.0, "par_B": 5.0}', "projects/SF_A/input.in",
|
||||||
|
'2026-03-26 12:55:18.229966', '2026-03-27 12:55:18.229966']
|
||||||
|
record_E = ["f_A", "ensA", "sfcf", "archive/ensA/f_A/Project_A.json.gz::asdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdf", "SF_A", '{"par_A": 5.0, "par_B": 5.0}', "projects/SF_A/input.in",
|
||||||
|
'2024-03-26 12:55:18.229966', '2024-03-26 12:55:18.229966'] # only created, earlier
|
||||||
|
record_F = ["f_A", "ensA", "sfcf", "archive/ensA/f_A/Project_B.json.gz::asdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdf", "SF_A", '{"par_A": 5.0, "par_B": 5.0}', "projects/SF_A/input.in",
|
||||||
|
'2026-03-26 12:55:18.229966', '2024-03-26 12:55:18.229966'] # this is invalid...
|
||||||
|
record_G = ["f_A", "ensA", "sfcf", "archive/ensA/f_A/Project_A.json.gz::asdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfasdfas", "SF_A", '{"par_A": 5.0, "par_B": 5.0}', "projects/SF_A/input.in",
|
||||||
|
'2026-03-26 12:55:18.229966', str(dt.datetime.now() + dt.timedelta(days=2, hours=3, minutes=5, seconds=30))] # created and updated later
|
||||||
|
|
||||||
|
projects = ['Project_A', 'Project_B']
|
||||||
|
ensembles = ['ensA']
|
||||||
|
cols = ["name",
|
||||||
|
"ensemble",
|
||||||
|
"code",
|
||||||
|
"path",
|
||||||
|
"project",
|
||||||
|
"parameters",
|
||||||
|
"parameter_file",
|
||||||
|
"created_at",
|
||||||
|
"updated_at"]
|
||||||
|
|
||||||
|
data = [record_A, record_B, record_C, record_D, record_E, record_F]
|
||||||
|
df = pd.DataFrame(data,columns=cols)
|
||||||
|
for _, result in df.iterrows():
|
||||||
|
integ.check_path_format(result, ensembles, projects)
|
||||||
|
|
||||||
|
projects = ['Project_A', 'Project_B']
|
||||||
|
ensembles = ['ensB']
|
||||||
|
for _, result in df.iterrows():
|
||||||
|
with pytest.raises(ValueError):
|
||||||
|
integ.check_path_format(result, ensembles, projects)
|
||||||
|
|
||||||
|
projects = ['Project_A', 'Project_B']
|
||||||
|
ensembles = ['ensA', 'ensB']
|
||||||
|
for _, result in df.iterrows():
|
||||||
|
integ.check_path_format(result, ensembles, projects)
|
||||||
|
|
||||||
|
data = [record_G]
|
||||||
|
df = pd.DataFrame(data,columns=cols)
|
||||||
|
for _, result in df.iterrows():
|
||||||
|
with pytest.raises(ValueError):
|
||||||
|
integ.check_path_format(result, ensembles, projects)
|
||||||
|
|
|
||||||
Loading…
Add table
Add a link
Reference in a new issue