Esc
Ask AIAnswers may be inaccurate; check the linked pages.Esc
Ask anything about these docs, like how to get started or what a function does.

LSFEvaluator

lsf_evaluator.LSFEvaluator

Class to evaluate model on Long Sequence Forecasting benchmark datasets, maintained at https://github.com/thuml/Time-Series-Library.

Uses GluonTS's evaluation tools.

__init__(self, metrics=POINT_FORECAST_METRICS, datasets=[LSFDatasetName.ETTh1, LSFDatasetName.ETTh2, LSFDatasetName.ETTm1, LSFDatasetName.ETTm2, LSFDatasetName.weather], prediction_lengths=[96, 192, 336, 720], context_lengths=[1280], mode=Multivariate(1), num_samples=30, lsf_path='./data/', data_split='test', eval_stride=256, samples_per_batch=30, use_kv_cache=False)

Initializes the LSF Evaluator with configuration parameters for datasets, lengths, and evaluation settings.

Parameter Type Default Description
metrics list[gluon_metrics.Metric] POINT_FORECAST_METRICS (undocumented)
datasets list[LSFDatasetName] [LSFDatasetName.ETTh1, LSFDatasetName.ETTh2, LSFDatasetName.ETTm1, LSFDatasetName.ETTm2, LSFDatasetName.weather] (undocumented)
prediction_lengths list[int] [96, 192, 336, 720] (undocumented)
context_lengths list[int] [1280] (undocumented)
mode Multivariate Multivariate(1) (undocumented)
num_samples int | None 30 (undocumented)
lsf_path str "./data/" (undocumented)
data_split str "test" (undocumented)
eval_stride int 256 (undocumented)
samples_per_batch int 30 (undocumented)
use_kv_cache bool False (undocumented)

eval(self, model, checkpoint_name=None) -> tuple[pd.DataFrame, list[list[TotoSampleForecast]], list[TestData]]

Runs the evaluation loop over all configured datasets, prediction lengths, and context lengths using the provided model.

Parameters:

Parameter Type Default Description
model Toto - (undocumented)
checkpoint_name str | None None (undocumented)

Returns: A tuple containing the evaluation results, the generated forecasts, and the test data used. - pd.DataFrame: Evaluation metrics aggregated across all configurations. - list[list[TotoSampleForecast]]: All generated forecasts. - list[TestData]: The test data used for evaluation.