diff --git a/tensorflow_datasets/datasets/dsprites/dsprites_dataset_builder.py b/tensorflow_datasets/datasets/dsprites/dsprites_dataset_builder.py index 3a4b6685fcf..4d25d2f8dae 100644 --- a/tensorflow_datasets/datasets/dsprites/dsprites_dataset_builder.py +++ b/tensorflow_datasets/datasets/dsprites/dsprites_dataset_builder.py @@ -62,7 +62,7 @@ def _split_generators(self, dl_manager): # There is no predefined train/val/test split for this dataset. return [ tfds.core.SplitGenerator( - name=tfds.Split.TRAIN, gen_kwargs=dict(filepath=filepath) + name=tfds.Split.TRAIN, gen_kwargs=dict(filepath=filepath) # pyrefly: ignore[missing-attribute] ), ] diff --git a/tensorflow_datasets/datasets/e2e_cleaned/e2e_cleaned_dataset_builder.py b/tensorflow_datasets/datasets/e2e_cleaned/e2e_cleaned_dataset_builder.py index f625855b43c..729ab98259a 100644 --- a/tensorflow_datasets/datasets/e2e_cleaned/e2e_cleaned_dataset_builder.py +++ b/tensorflow_datasets/datasets/e2e_cleaned/e2e_cleaned_dataset_builder.py @@ -77,17 +77,17 @@ def _split_generators(self, dl_manager): ) return [ tfds.core.SplitGenerator( - name=tfds.Split.TRAIN, + name=tfds.Split.TRAIN, # pyrefly: ignore[missing-attribute] # These kwargs will be passed to _generate_examples gen_kwargs={'csv_path': extracted_path['train_path']}, ), tfds.core.SplitGenerator( - name=tfds.Split.VALIDATION, + name=tfds.Split.VALIDATION, # pyrefly: ignore[missing-attribute] # These kwargs will be passed to _generate_examples gen_kwargs={'csv_path': extracted_path['dev_path']}, ), tfds.core.SplitGenerator( - name=tfds.Split.TEST, + name=tfds.Split.TEST, # pyrefly: ignore[missing-attribute] # These kwargs will be passed to _generate_examples gen_kwargs={'csv_path': extracted_path['test_path']}, ), diff --git a/tensorflow_datasets/datasets/efron_morris75/efron_morris75_dataset_builder.py b/tensorflow_datasets/datasets/efron_morris75/efron_morris75_dataset_builder.py index 543e07d35f8..1e18efbeed3 100644 --- a/tensorflow_datasets/datasets/efron_morris75/efron_morris75_dataset_builder.py +++ b/tensorflow_datasets/datasets/efron_morris75/efron_morris75_dataset_builder.py @@ -54,7 +54,7 @@ def _info(self) -> tfds.core.DatasetInfo: def _split_generators(self, dl_manager: tfds.download.DownloadManager): """Returns SplitGenerators.""" path = dl_manager.download_and_extract(URL) - return {tfds.Split.TRAIN: self._generate_examples(path)} + return {tfds.Split.TRAIN: self._generate_examples(path)} # pyrefly: ignore[missing-attribute] def _generate_examples(self, path): """Yields examples.""" diff --git a/tensorflow_datasets/datasets/flic/flic_dataset_builder.py b/tensorflow_datasets/datasets/flic/flic_dataset_builder.py index c1263b7e97e..20b3aa5ae27 100644 --- a/tensorflow_datasets/datasets/flic/flic_dataset_builder.py +++ b/tensorflow_datasets/datasets/flic/flic_dataset_builder.py @@ -99,10 +99,10 @@ def _info(self): def _split_generators(self, dl_manager): """Returns SplitGenerators.""" - extract_path = dl_manager.download_and_extract(self.builder_config.url) + extract_path = dl_manager.download_and_extract(self.builder_config.url) # pyrefly: ignore[missing-attribute] mat_path = os.path.join( - extract_path, self.builder_config.dir, "examples.mat" + extract_path, self.builder_config.dir, "examples.mat" # pyrefly: ignore[missing-attribute] ) with tf.io.gfile.GFile(mat_path, "rb") as f: data = tfds.core.lazy_imports.scipy.io.loadmat( @@ -111,7 +111,7 @@ def _split_generators(self, dl_manager): return [ tfds.core.SplitGenerator( - name=tfds.Split.TRAIN, + name=tfds.Split.TRAIN, # pyrefly: ignore[missing-attribute] gen_kwargs={ "extract_path": extract_path, "data": data, @@ -119,7 +119,7 @@ def _split_generators(self, dl_manager): }, ), tfds.core.SplitGenerator( - name=tfds.Split.TEST, + name=tfds.Split.TEST, # pyrefly: ignore[missing-attribute] gen_kwargs={ "extract_path": extract_path, "data": data, @@ -133,7 +133,7 @@ def _generate_examples(self, extract_path, data, selection_column): for u_id, example in enumerate(data["examples"]): if example[selection_column]: img_path = os.path.join( - extract_path, self.builder_config.dir, "images", example[3] + extract_path, self.builder_config.dir, "images", example[3] # pyrefly: ignore[missing-attribute] ) yield u_id, { "image": img_path, diff --git a/tensorflow_datasets/datasets/groove/groove_dataset_builder.py b/tensorflow_datasets/datasets/groove/groove_dataset_builder.py index 50f84e257b9..f74d53067e2 100644 --- a/tensorflow_datasets/datasets/groove/groove_dataset_builder.py +++ b/tensorflow_datasets/datasets/groove/groove_dataset_builder.py @@ -130,12 +130,12 @@ def _info(self): }, "midi": tf.string, } - if self.builder_config.include_audio: - features_dict["audio"] = tfds.features.Audio( - dtype=np.float32, sample_rate=self.builder_config.audio_rate + if self.builder_config.include_audio: # pyrefly: ignore[missing-attribute] + features_dict["audio"] = tfds.features.Audio( # pyrefly: ignore[bad-assignment] + dtype=np.float32, sample_rate=self.builder_config.audio_rate # pyrefly: ignore[missing-attribute] ) return self.dataset_info_from_configs( - features=tfds.features.FeaturesDict(features_dict), + features=tfds.features.FeaturesDict(features_dict), # pyrefly: ignore[bad-argument-type] homepage="https://g.co/magenta/groove-dataset", ) diff --git a/tensorflow_datasets/datasets/imagenet2012/imagenet2012_dataset_builder.py b/tensorflow_datasets/datasets/imagenet2012/imagenet2012_dataset_builder.py index 40b6a649aa4..e965a4e22c5 100644 --- a/tensorflow_datasets/datasets/imagenet2012/imagenet2012_dataset_builder.py +++ b/tensorflow_datasets/datasets/imagenet2012/imagenet2012_dataset_builder.py @@ -101,20 +101,20 @@ def _split_generators(self, dl_manager): splits = [] _add_split_if_exists( split_list=splits, - split=tfds.Split.TRAIN, + split=tfds.Split.TRAIN, # pyrefly: ignore[missing-attribute] split_path=train_path, dl_manager=dl_manager, ) _add_split_if_exists( split_list=splits, - split=tfds.Split.VALIDATION, + split=tfds.Split.VALIDATION, # pyrefly: ignore[missing-attribute] split_path=val_path, dl_manager=dl_manager, validation_labels=imagenet_common.get_validation_labels(val_path), ) _add_split_if_exists( split_list=splits, - split=tfds.Split.TEST, + split=tfds.Split.TEST, # pyrefly: ignore[missing-attribute] split_path=test_path, dl_manager=dl_manager, labels_exist=False, diff --git a/tensorflow_datasets/datasets/imagenet2012_corrupted/imagenet2012_corrupted_dataset_builder.py b/tensorflow_datasets/datasets/imagenet2012_corrupted/imagenet2012_corrupted_dataset_builder.py index 31eb3d20adb..58c73e9fa05 100644 --- a/tensorflow_datasets/datasets/imagenet2012_corrupted/imagenet2012_corrupted_dataset_builder.py +++ b/tensorflow_datasets/datasets/imagenet2012_corrupted/imagenet2012_corrupted_dataset_builder.py @@ -168,7 +168,7 @@ def _split_generators(self, dl_manager): splits = super(Builder, self)._split_generators(dl_manager) corruptions.FROST_FILENAMES = dl_manager.download(_FROST_FILENAMES) - return [s for s in splits if s.name != tfds.Split.TRAIN] + return [s for s in splits if s.name != tfds.Split.TRAIN] # pyrefly: ignore[missing-attribute] def _generate_examples( self, archive, validation_labels=None, labels_exist=None @@ -215,8 +215,8 @@ def _get_corrupted_example(self, x): Returns: numpy array, corrupted images. """ - corruption_type = self.builder_config.corruption_type - severity = self.builder_config.severity + corruption_type = self.builder_config.corruption_type # pyrefly: ignore[missing-attribute] + severity = self.builder_config.severity # pyrefly: ignore[missing-attribute] x = np.clip(x, 0, 255) return { diff --git a/tensorflow_datasets/datasets/imagenet2012_fewshot/imagenet2012_fewshot_dataset_builder.py b/tensorflow_datasets/datasets/imagenet2012_fewshot/imagenet2012_fewshot_dataset_builder.py index c9c17c5d1a0..94c7bd47178 100644 --- a/tensorflow_datasets/datasets/imagenet2012_fewshot/imagenet2012_fewshot_dataset_builder.py +++ b/tensorflow_datasets/datasets/imagenet2012_fewshot/imagenet2012_fewshot_dataset_builder.py @@ -68,7 +68,7 @@ def _split_generators(self, dl_manager): ) # Download and load subset file. - subset_file = SUBSET2FILES[self.builder_config.name] + subset_file = SUBSET2FILES[self.builder_config.name] # pyrefly: ignore[missing-attribute] if isinstance(subset_file, list): # it will only be a list during testing, subset_file = subset_file[0] # where the first entry is 1shot.txt. subset = set(subset_file.read_text().splitlines()) @@ -77,13 +77,13 @@ def _split_generators(self, dl_manager): tuneset = set(TUNE_FILE.read_text().splitlines()) return { - tfds.Split.TRAIN: self._generate_examples( + tfds.Split.TRAIN: self._generate_examples( # pyrefly: ignore[missing-attribute] archive=dl_manager.iter_archive(train_path), subset=subset ), tfds.Split('tune'): self._generate_examples( archive=dl_manager.iter_archive(train_path), subset=tuneset ), - tfds.Split.VALIDATION: self._generate_examples( + tfds.Split.VALIDATION: self._generate_examples( # pyrefly: ignore[missing-attribute] archive=dl_manager.iter_archive(val_path), validation_labels=imagenet_common.get_validation_labels(val_path), ), diff --git a/tensorflow_datasets/datasets/imagenet2012_real/imagenet2012_real_dataset_builder.py b/tensorflow_datasets/datasets/imagenet2012_real/imagenet2012_real_dataset_builder.py index b3147508e6b..30c8170c00d 100644 --- a/tensorflow_datasets/datasets/imagenet2012_real/imagenet2012_real_dataset_builder.py +++ b/tensorflow_datasets/datasets/imagenet2012_real/imagenet2012_real_dataset_builder.py @@ -72,7 +72,7 @@ def _split_generators(self, dl_manager): ) return [ tfds.core.SplitGenerator( - name=tfds.Split.VALIDATION, + name=tfds.Split.VALIDATION, # pyrefly: ignore[missing-attribute] gen_kwargs={ 'archive': dl_manager.iter_archive(val_path), 'original_labels': imagenet_common.get_validation_labels( diff --git a/tensorflow_datasets/datasets/imagenet2012_subset/imagenet2012_subset_dataset_builder.py b/tensorflow_datasets/datasets/imagenet2012_subset/imagenet2012_subset_dataset_builder.py index 0b7f88d0739..4186ca7c239 100644 --- a/tensorflow_datasets/datasets/imagenet2012_subset/imagenet2012_subset_dataset_builder.py +++ b/tensorflow_datasets/datasets/imagenet2012_subset/imagenet2012_subset_dataset_builder.py @@ -72,7 +72,7 @@ def _split_generators(self, dl_manager): ) # Download and load subset file. - subset_file = dl_manager.download(SUBSET2FILES[self.builder_config.name]) + subset_file = dl_manager.download(SUBSET2FILES[self.builder_config.name]) # pyrefly: ignore[missing-attribute] if isinstance(subset_file, list): # it will only be a list during testing, subset_file = subset_file[0] # where the first entry is 1percent.txt. with epath.Path(subset_file).open() as fp: @@ -80,14 +80,14 @@ def _split_generators(self, dl_manager): return [ tfds.core.SplitGenerator( - name=tfds.Split.TRAIN, + name=tfds.Split.TRAIN, # pyrefly: ignore[missing-attribute] gen_kwargs={ 'archive': dl_manager.iter_archive(train_path), 'subset': subset, }, ), tfds.core.SplitGenerator( - name=tfds.Split.VALIDATION, + name=tfds.Split.VALIDATION, # pyrefly: ignore[missing-attribute] gen_kwargs={ 'archive': dl_manager.iter_archive(val_path), 'validation_labels': imagenet_common.get_validation_labels( diff --git a/tensorflow_datasets/datasets/imagenet_a/imagenet_a_dataset_builder.py b/tensorflow_datasets/datasets/imagenet_a/imagenet_a_dataset_builder.py index 26804821bac..b33be08a638 100644 --- a/tensorflow_datasets/datasets/imagenet_a/imagenet_a_dataset_builder.py +++ b/tensorflow_datasets/datasets/imagenet_a/imagenet_a_dataset_builder.py @@ -51,7 +51,7 @@ def _split_generators(self, dl_manager): return [ tfds.core.SplitGenerator( # The dataset provides only a test split. - name=tfds.Split.TEST, + name=tfds.Split.TEST, # pyrefly: ignore[missing-attribute] # These kwargs will be passed to _generate_examples gen_kwargs={'imagenet_a_root': imagenet_a_root}, ), diff --git a/tensorflow_datasets/datasets/imagenet_r/imagenet_r_dataset_builder.py b/tensorflow_datasets/datasets/imagenet_r/imagenet_r_dataset_builder.py index 1217c1d0a2c..4cda4d3773a 100644 --- a/tensorflow_datasets/datasets/imagenet_r/imagenet_r_dataset_builder.py +++ b/tensorflow_datasets/datasets/imagenet_r/imagenet_r_dataset_builder.py @@ -60,7 +60,7 @@ def _split_generators(self, dl_manager): return [ tfds.core.SplitGenerator( # The dataset provides only a test split. - name=tfds.Split.TEST, + name=tfds.Split.TEST, # pyrefly: ignore[missing-attribute] # These kwargs will be passed to _generate_examples gen_kwargs={'imagenet_r_root': imagenet_r_root}, ), diff --git a/tensorflow_datasets/datasets/imagenet_resized/imagenet_resized_dataset_builder.py b/tensorflow_datasets/datasets/imagenet_resized/imagenet_resized_dataset_builder.py index ae1fd8381c7..9a2458e9023 100644 --- a/tensorflow_datasets/datasets/imagenet_resized/imagenet_resized_dataset_builder.py +++ b/tensorflow_datasets/datasets/imagenet_resized/imagenet_resized_dataset_builder.py @@ -64,7 +64,7 @@ class Builder(tfds.core.GeneratorBasedBuilder): def _info(self): names_file = tfds.core.tfds_path(_LABELS_FNAME) - size = self.builder_config.size + size = self.builder_config.size # pyrefly: ignore[missing-attribute] return self.dataset_info_from_configs( features=tfds.features.FeaturesDict({ 'image': tfds.features.Image(shape=(size, size, 3)), @@ -75,7 +75,7 @@ def _info(self): ) def _split_generators(self, dl_manager): - size = self.builder_config.size + size = self.builder_config.size # pyrefly: ignore[missing-attribute] if size in [8, 16, 32]: train_path, val_path = dl_manager.download([ @@ -96,7 +96,7 @@ def _split_generators(self, dl_manager): return [ tfds.core.SplitGenerator( - name=tfds.Split.TRAIN, + name=tfds.Split.TRAIN, # pyrefly: ignore[missing-attribute] gen_kwargs={ 'archive': itertools.chain( *[ @@ -107,7 +107,7 @@ def _split_generators(self, dl_manager): }, ), tfds.core.SplitGenerator( - name=tfds.Split.VALIDATION, + name=tfds.Split.VALIDATION, # pyrefly: ignore[missing-attribute] gen_kwargs={ 'archive': dl_manager.iter_archive(val_path), }, @@ -121,7 +121,7 @@ def _generate_examples(self, archive): if content: fobj_mem = io.BytesIO(content) data = np.load(fobj_mem, allow_pickle=False) - size = self.builder_config.size + size = self.builder_config.size # pyrefly: ignore[missing-attribute] for i, (image, label) in enumerate(zip(data['data'], data['labels'])): record = { # The data is packed flat as CHW where as most image datasets diff --git a/tensorflow_datasets/datasets/imagenet_sketch/imagenet_sketch_dataset_builder.py b/tensorflow_datasets/datasets/imagenet_sketch/imagenet_sketch_dataset_builder.py index 8617f1342ed..06177f729ab 100644 --- a/tensorflow_datasets/datasets/imagenet_sketch/imagenet_sketch_dataset_builder.py +++ b/tensorflow_datasets/datasets/imagenet_sketch/imagenet_sketch_dataset_builder.py @@ -48,7 +48,7 @@ def _split_generators(self, dl_manager: tfds.download.DownloadManager): path = dl_manager.download(_IMAGENET_SKETCH_URL) return [ tfds.core.SplitGenerator( - name=tfds.Split.TEST, + name=tfds.Split.TEST, # pyrefly: ignore[missing-attribute] gen_kwargs={ 'archive': dl_manager.iter_archive(path), }, diff --git a/tensorflow_datasets/datasets/imagenet_v2/imagenet_v2_dataset_builder.py b/tensorflow_datasets/datasets/imagenet_v2/imagenet_v2_dataset_builder.py index 3d24b12a13a..96512971bb3 100644 --- a/tensorflow_datasets/datasets/imagenet_v2/imagenet_v2_dataset_builder.py +++ b/tensorflow_datasets/datasets/imagenet_v2/imagenet_v2_dataset_builder.py @@ -100,15 +100,15 @@ def _info(self): def _split_generators(self, dl_manager): """Returns a SplitGenerator for the test set.""" - variant_url = _IMAGENET_V2_URLS[self.builder_config.variant] + variant_url = _IMAGENET_V2_URLS[self.builder_config.variant] # pyrefly: ignore[missing-attribute] imagenet_v2_root = os.path.join( dl_manager.download_and_extract(variant_url), - _TAR_TOPDIR[self.builder_config.variant], + _TAR_TOPDIR[self.builder_config.variant], # pyrefly: ignore[missing-attribute] ) return [ tfds.core.SplitGenerator( # The dataset provides only a test split. - name=tfds.Split.TEST, + name=tfds.Split.TEST, # pyrefly: ignore[missing-attribute] # These kwargs will be passed to _generate_examples gen_kwargs={'imagenet_v2_root': imagenet_v2_root}, ), diff --git a/tensorflow_datasets/datasets/imagenette/imagenette_dataset_builder.py b/tensorflow_datasets/datasets/imagenette/imagenette_dataset_builder.py index 869eb8367b1..9701eac1463 100644 --- a/tensorflow_datasets/datasets/imagenette/imagenette_dataset_builder.py +++ b/tensorflow_datasets/datasets/imagenette/imagenette_dataset_builder.py @@ -77,7 +77,7 @@ def _info(self): def _split_generators(self, dl_manager): """Returns SplitGenerators.""" - dirname = self.builder_config.dirname + dirname = self.builder_config.dirname # pyrefly: ignore[missing-attribute] url = _URL_PREFIX + "{}.tgz".format(dirname) path = dl_manager.download_and_extract(url) train_path = os.path.join(path, dirname, "train") @@ -85,13 +85,13 @@ def _split_generators(self, dl_manager): return [ tfds.core.SplitGenerator( - name=tfds.Split.TRAIN, + name=tfds.Split.TRAIN, # pyrefly: ignore[missing-attribute] gen_kwargs={ "datapath": train_path, }, ), tfds.core.SplitGenerator( - name=tfds.Split.VALIDATION, + name=tfds.Split.VALIDATION, # pyrefly: ignore[missing-attribute] gen_kwargs={ "datapath": val_path, }, diff --git a/tensorflow_datasets/datasets/imagewang/imagewang_dataset_builder.py b/tensorflow_datasets/datasets/imagewang/imagewang_dataset_builder.py index 5fd26eb4ac1..40c5f2f9a1a 100644 --- a/tensorflow_datasets/datasets/imagewang/imagewang_dataset_builder.py +++ b/tensorflow_datasets/datasets/imagewang/imagewang_dataset_builder.py @@ -73,7 +73,7 @@ def _info(self): def _split_generators(self, dl_manager): """Returns SplitGenerators.""" - size = self.builder_config.size + size = self.builder_config.size # pyrefly: ignore[missing-attribute] if size in _SIZES: size_str = "" if size == "full-size" else "-" + size[:-2] url = "/".join([_URL_PREFIX, "imagewang%s.tgz" % size_str]) @@ -85,13 +85,13 @@ def _split_generators(self, dl_manager): return [ tfds.core.SplitGenerator( - name=tfds.Split.TRAIN, + name=tfds.Split.TRAIN, # pyrefly: ignore[missing-attribute] gen_kwargs={ "datapath": train_path, }, ), tfds.core.SplitGenerator( - name=tfds.Split.VALIDATION, + name=tfds.Split.VALIDATION, # pyrefly: ignore[missing-attribute] gen_kwargs={ "datapath": val_path, }, diff --git a/tensorflow_datasets/datasets/imdb_reviews/imdb_reviews_dataset_builder.py b/tensorflow_datasets/datasets/imdb_reviews/imdb_reviews_dataset_builder.py index c09cb597713..d3ea6142c23 100644 --- a/tensorflow_datasets/datasets/imdb_reviews/imdb_reviews_dataset_builder.py +++ b/tensorflow_datasets/datasets/imdb_reviews/imdb_reviews_dataset_builder.py @@ -61,7 +61,7 @@ def _info(self): return self.dataset_info_from_configs( features=tfds.features.FeaturesDict({ "text": tfds.features.Text( - encoder_config=self.builder_config.text_encoder_config + encoder_config=self.builder_config.text_encoder_config # pyrefly: ignore[missing-attribute] ), "label": tfds.features.ClassLabel(names=["neg", "pos"]), }), @@ -86,14 +86,14 @@ def _split_generators(self, dl_manager): return [ tfds.core.SplitGenerator( - name=tfds.Split.TRAIN, + name=tfds.Split.TRAIN, # pyrefly: ignore[missing-attribute] gen_kwargs={ "archive": archive(), "directory": os.path.join("aclImdb", "train"), }, ), tfds.core.SplitGenerator( - name=tfds.Split.TEST, + name=tfds.Split.TEST, # pyrefly: ignore[missing-attribute] gen_kwargs={ "archive": archive(), "directory": os.path.join("aclImdb", "test"), diff --git a/tensorflow_datasets/datasets/irc_disentanglement/irc_disentanglement_dataset_builder.py b/tensorflow_datasets/datasets/irc_disentanglement/irc_disentanglement_dataset_builder.py index 8cf4e567d75..70712215a08 100644 --- a/tensorflow_datasets/datasets/irc_disentanglement/irc_disentanglement_dataset_builder.py +++ b/tensorflow_datasets/datasets/irc_disentanglement/irc_disentanglement_dataset_builder.py @@ -167,7 +167,7 @@ def _split_generators( return [ tfds.core.SplitGenerator( - name=tfds.Split.TRAIN, + name=tfds.Split.TRAIN, # pyrefly: ignore[missing-attribute] gen_kwargs={ "day_to_paths": _get_day_to_paths( os.path.join(data_dir, "train") @@ -175,13 +175,13 @@ def _split_generators( }, ), tfds.core.SplitGenerator( - name=tfds.Split.VALIDATION, + name=tfds.Split.VALIDATION, # pyrefly: ignore[missing-attribute] gen_kwargs={ "day_to_paths": _get_day_to_paths(os.path.join(data_dir, "dev")) }, ), tfds.core.SplitGenerator( - name=tfds.Split.TEST, + name=tfds.Split.TEST, # pyrefly: ignore[missing-attribute] gen_kwargs={ "day_to_paths": _get_day_to_paths( os.path.join(data_dir, "test") diff --git a/tensorflow_datasets/datasets/kddcup99/kddcup99_dataset_builder.py b/tensorflow_datasets/datasets/kddcup99/kddcup99_dataset_builder.py index edf91355d89..07a8c3db64d 100644 --- a/tensorflow_datasets/datasets/kddcup99/kddcup99_dataset_builder.py +++ b/tensorflow_datasets/datasets/kddcup99/kddcup99_dataset_builder.py @@ -230,8 +230,8 @@ def _split_generators(self, dl_manager: tfds.download.DownloadManager): }) return { - tfds.Split.TRAIN: self._generate_examples(paths['train']), - tfds.Split.TEST: self._generate_examples(paths['test']), + tfds.Split.TRAIN: self._generate_examples(paths['train']), # pyrefly: ignore[missing-attribute] + tfds.Split.TEST: self._generate_examples(paths['test']), # pyrefly: ignore[missing-attribute] } def _generate_examples(self, gz_path): diff --git a/tensorflow_datasets/datasets/kitti/kitti_dataset_builder.py b/tensorflow_datasets/datasets/kitti/kitti_dataset_builder.py index a203849bd8d..9860f916f33 100644 --- a/tensorflow_datasets/datasets/kitti/kitti_dataset_builder.py +++ b/tensorflow_datasets/datasets/kitti/kitti_dataset_builder.py @@ -118,7 +118,7 @@ def _info(self): features=tfds.features.FeaturesDict({ "image": tfds.features.Image(), "image/file_name": tfds.features.Text(), # E.g. "000001.png". - "objects": tfds.features.Sequence(annotations), + "objects": tfds.features.Sequence(annotations), # pyrefly: ignore[bad-argument-type] }), homepage=_HOMEPAGE_URL, ) @@ -136,7 +136,7 @@ def _split_generators(self, dl_manager): return [ tfds.core.SplitGenerator( - name=tfds.Split.TRAIN, + name=tfds.Split.TRAIN, # pyrefly: ignore[missing-attribute] gen_kwargs={ "images": dl_manager.iter_archive(files["images"]), "annotations": dl_manager.iter_archive(files["annotations"]), @@ -145,7 +145,7 @@ def _split_generators(self, dl_manager): }, ), tfds.core.SplitGenerator( - name=tfds.Split.VALIDATION, + name=tfds.Split.VALIDATION, # pyrefly: ignore[missing-attribute] gen_kwargs={ "images": dl_manager.iter_archive(files["images"]), "annotations": dl_manager.iter_archive(files["annotations"]), @@ -154,7 +154,7 @@ def _split_generators(self, dl_manager): }, ), tfds.core.SplitGenerator( - name=tfds.Split.TEST, + name=tfds.Split.TEST, # pyrefly: ignore[missing-attribute] gen_kwargs={ "images": dl_manager.iter_archive(files["images"]), "annotations": dl_manager.iter_archive(files["annotations"]), diff --git a/tensorflow_datasets/datasets/lambada/lambada_dataset_builder.py b/tensorflow_datasets/datasets/lambada/lambada_dataset_builder.py index 5bcf22452eb..5e4f1a7af14 100644 --- a/tensorflow_datasets/datasets/lambada/lambada_dataset_builder.py +++ b/tensorflow_datasets/datasets/lambada/lambada_dataset_builder.py @@ -52,7 +52,7 @@ def _split_generators(self, dl_manager: tfds.download.DownloadManager): return [ tfds.core.SplitGenerator( - name=tfds.Split.TRAIN, + name=tfds.Split.TRAIN, # pyrefly: ignore[missing-attribute] gen_kwargs={ 'filepath': os.path.join( dl_dir, 'lambada_development_plain_text.txt' @@ -60,7 +60,7 @@ def _split_generators(self, dl_manager: tfds.download.DownloadManager): }, ), tfds.core.SplitGenerator( - name=tfds.Split.TEST, + name=tfds.Split.TEST, # pyrefly: ignore[missing-attribute] gen_kwargs={ 'filepath': os.path.join(dl_dir, 'lambada_test_plain_text.txt') }, diff --git a/tensorflow_datasets/datasets/lbpp/lbpp_dataset_builder.py b/tensorflow_datasets/datasets/lbpp/lbpp_dataset_builder.py index f7d5a3edf82..3d129566a30 100644 --- a/tensorflow_datasets/datasets/lbpp/lbpp_dataset_builder.py +++ b/tensorflow_datasets/datasets/lbpp/lbpp_dataset_builder.py @@ -130,7 +130,7 @@ def _info(self): def _split_generators(self, dl_manager): # Map alias to actual language data_loading_name = _LANGUAGE_ALIAS_MAP.get( - self.builder_config.name, self.builder_config.name + self.builder_config.name, self.builder_config.name # pyrefly: ignore[missing-attribute] ) hf_url_prefix = ( "https://huggingface.co/datasets/CohereForAI/lbpp/resolve/main/" @@ -147,7 +147,7 @@ def _split_generators(self, dl_manager): return [ tfds.core.SplitGenerator( - name=tfds.Split.TEST, + name=tfds.Split.TEST, # pyrefly: ignore[missing-attribute] gen_kwargs={ "filepaths": downloaded_files, }, diff --git a/tensorflow_datasets/datasets/lfw/lfw_dataset_builder.py b/tensorflow_datasets/datasets/lfw/lfw_dataset_builder.py index 3cd503346ae..7ea90c6ec63 100644 --- a/tensorflow_datasets/datasets/lfw/lfw_dataset_builder.py +++ b/tensorflow_datasets/datasets/lfw/lfw_dataset_builder.py @@ -49,7 +49,7 @@ def _split_generators(self, dl_manager): # There is no train/test split predefined return [ tfds.core.SplitGenerator( - name=tfds.Split.TRAIN, + name=tfds.Split.TRAIN, # pyrefly: ignore[missing-attribute] gen_kwargs={ "data_path": path, }, diff --git a/tensorflow_datasets/datasets/librispeech/librispeech_dataset_builder.py b/tensorflow_datasets/datasets/librispeech/librispeech_dataset_builder.py index f31a551e666..f310b21d2a0 100644 --- a/tensorflow_datasets/datasets/librispeech/librispeech_dataset_builder.py +++ b/tensorflow_datasets/datasets/librispeech/librispeech_dataset_builder.py @@ -75,7 +75,7 @@ def _info(self): "speech": tfds.features.Audio( sample_rate=16000, dtype=np.int16, - lazy_decode=self.builder_config.lazy_decode, + lazy_decode=self.builder_config.lazy_decode, # pyrefly: ignore[missing-attribute] file_format="flac", ), "text": tfds.features.Text(), @@ -125,10 +125,10 @@ def _read_metadata_file(self, path: epath.Path, field_names: List[str]): def _split_generators(self, dl_manager: tfds.download.DownloadManager): extracted_dirs = dl_manager.download_and_extract(_DL_URLS) - self._populate_metadata(extracted_dirs.values()) + self._populate_metadata(extracted_dirs.values()) # pyrefly: ignore[missing-attribute] splits = { split: self._generate_examples(directory) - for split, directory in extracted_dirs.items() + for split, directory in extracted_dirs.items() # pyrefly: ignore[missing-attribute] } return splits diff --git a/tensorflow_datasets/datasets/librispeech_lm/librispeech_lm_dataset_builder.py b/tensorflow_datasets/datasets/librispeech_lm/librispeech_lm_dataset_builder.py index 6f76ca58242..c5a6fc9cfee 100644 --- a/tensorflow_datasets/datasets/librispeech_lm/librispeech_lm_dataset_builder.py +++ b/tensorflow_datasets/datasets/librispeech_lm/librispeech_lm_dataset_builder.py @@ -43,7 +43,7 @@ def _split_generators(self, dl_manager): archive_path = dl_manager.download(_DL_URL) return [ tfds.core.SplitGenerator( - name=tfds.Split.TRAIN, + name=tfds.Split.TRAIN, # pyrefly: ignore[missing-attribute] gen_kwargs={'files_iter': dl_manager.iter_archive(archive_path)}, ), ] diff --git a/tensorflow_datasets/datasets/libritts/libritts_dataset_builder.py b/tensorflow_datasets/datasets/libritts/libritts_dataset_builder.py index bf8ec81b4f7..2013a295fd6 100644 --- a/tensorflow_datasets/datasets/libritts/libritts_dataset_builder.py +++ b/tensorflow_datasets/datasets/libritts/libritts_dataset_builder.py @@ -69,7 +69,7 @@ def _populate_metadata(self, archive_paths): with tf.io.gfile.GFile(archive_path, "rb") as f: tarf = tarfile.open(mode="r:gz", fileobj=f) speakers_tsv = tarf.extractfile("LibriTTS/speakers.tsv") - for n, line in enumerate(speakers_tsv): + for n, line in enumerate(speakers_tsv): # pyrefly: ignore[bad-argument-type] # Skip the first line which is just a header. if n == 0: continue diff --git a/tensorflow_datasets/datasets/ljspeech/ljspeech_dataset_builder.py b/tensorflow_datasets/datasets/ljspeech/ljspeech_dataset_builder.py index ba5c43859fb..afb5a469d64 100644 --- a/tensorflow_datasets/datasets/ljspeech/ljspeech_dataset_builder.py +++ b/tensorflow_datasets/datasets/ljspeech/ljspeech_dataset_builder.py @@ -52,7 +52,7 @@ def _split_generators(self, dl_manager): extracted_dir = dl_manager.download_and_extract(_DL_URL) return [ tfds.core.SplitGenerator( - name=tfds.Split.TRAIN, + name=tfds.Split.TRAIN, # pyrefly: ignore[missing-attribute] gen_kwargs={"directory": extracted_dir}, ), ] diff --git a/tensorflow_datasets/datasets/lm1b/lm1b_dataset_builder.py b/tensorflow_datasets/datasets/lm1b/lm1b_dataset_builder.py index d1fdd7f9c4c..831a4594f9f 100644 --- a/tensorflow_datasets/datasets/lm1b/lm1b_dataset_builder.py +++ b/tensorflow_datasets/datasets/lm1b/lm1b_dataset_builder.py @@ -67,10 +67,10 @@ def _split_generators(self, dl_manager): test_files = _test_data_filenames(lm1b_path) return [ tfds.core.SplitGenerator( - name=tfds.Split.TRAIN, gen_kwargs={"files": train_files} + name=tfds.Split.TRAIN, gen_kwargs={"files": train_files} # pyrefly: ignore[missing-attribute] ), tfds.core.SplitGenerator( - name=tfds.Split.TEST, gen_kwargs={"files": test_files} + name=tfds.Split.TEST, gen_kwargs={"files": test_files} # pyrefly: ignore[missing-attribute] ), ] diff --git a/tensorflow_datasets/datasets/lost_and_found/lost_and_found_dataset_builder.py b/tensorflow_datasets/datasets/lost_and_found/lost_and_found_dataset_builder.py index 83524af8541..bb06a3bcb3e 100644 --- a/tensorflow_datasets/datasets/lost_and_found/lost_and_found_dataset_builder.py +++ b/tensorflow_datasets/datasets/lost_and_found/lost_and_found_dataset_builder.py @@ -125,9 +125,9 @@ def _info(self): ), } features = { - feat: possible_features[feat] for feat in self.builder_config.features + feat: possible_features[feat] for feat in self.builder_config.features # pyrefly: ignore[missing-attribute] } - features['image_id'] = tfds.features.Text() + features['image_id'] = tfds.features.Text() # pyrefly: ignore[unsupported-operation] features = tfds.features.FeaturesDict(features) return self.dataset_info_from_configs( # tfds.features.FeatureConnectors @@ -145,8 +145,8 @@ def _split_generators(self, dl_manager): # For each feature, this is the name of the zipfile and # root-directory in the archive zip_file_names = { - 'image_left': self.builder_config.left_image_string, - 'image_right': self.builder_config.right_image_string, + 'image_left': self.builder_config.left_image_string, # pyrefly: ignore[missing-attribute] + 'image_right': self.builder_config.right_image_string, # pyrefly: ignore[missing-attribute] 'segmentation_label': 'gtCoarse', 'instance_id': 'gtCoarse', 'disparity_map': 'disparity', @@ -154,7 +154,7 @@ def _split_generators(self, dl_manager): download_urls = { feat: base_url.format(zip_file_names[feat]) - for feat in self.builder_config.features + for feat in self.builder_config.features # pyrefly: ignore[missing-attribute] } # Split download and extract in two functions such that mock-data can # replace the result of the download function and is still used as input to @@ -163,19 +163,19 @@ def _split_generators(self, dl_manager): return [ tfds.core.SplitGenerator( - name=tfds.Split.TRAIN, + name=tfds.Split.TRAIN, # pyrefly: ignore[missing-attribute] # These kwargs will be passed to _generate_examples gen_kwargs={ feat: path.join(dl_paths[feat], zip_file_names[feat], 'train') - for feat in self.builder_config.features + for feat in self.builder_config.features # pyrefly: ignore[missing-attribute] }, ), tfds.core.SplitGenerator( - name=tfds.Split.TEST, + name=tfds.Split.TEST, # pyrefly: ignore[missing-attribute] # These kwargs will be passed to _generate_examples gen_kwargs={ feat: path.join(dl_paths[feat], zip_file_names[feat], 'test') - for feat in self.builder_config.features + for feat in self.builder_config.features # pyrefly: ignore[missing-attribute] }, ), ] @@ -184,8 +184,8 @@ def _generate_examples(self, **paths): """Yields examples.""" # different file-suffixes dependent on the feature to load file_suffix = { - 'image_left': self.builder_config.left_image_string, - 'image_right': self.builder_config.right_image_string, + 'image_left': self.builder_config.left_image_string, # pyrefly: ignore[missing-attribute] + 'image_right': self.builder_config.right_image_string, # pyrefly: ignore[missing-attribute] 'segmentation_label': 'gtCoarse_labelIds', 'instance_id': 'gtCoarse_instanceIds', 'disparity_map': 'disparity', @@ -232,4 +232,4 @@ def _get_id_from_left_image(left_image): Returns: id of the image. """ - return LEFT_IMAGE_FILE_RE.match(left_image).group(1) + return LEFT_IMAGE_FILE_RE.match(left_image).group(1) # pyrefly: ignore[missing-attribute] diff --git a/tensorflow_datasets/datasets/lvis/lvis_dataset_builder.py b/tensorflow_datasets/datasets/lvis/lvis_dataset_builder.py index dafa540128d..a348c0d3b96 100644 --- a/tensorflow_datasets/datasets/lvis/lvis_dataset_builder.py +++ b/tensorflow_datasets/datasets/lvis/lvis_dataset_builder.py @@ -123,8 +123,8 @@ def _info(self) -> tfds.core.DatasetInfo: def _split_generators(self, dl_manager: tfds.download.DownloadManager): """Returns SplitGenerators.""" paths = { - **dl_manager.download_and_extract(_EXTRACT_URLS), - **dl_manager.download(_URLS), + **dl_manager.download_and_extract(_EXTRACT_URLS), # pyrefly: ignore[invalid-argument] + **dl_manager.download(_URLS), # pyrefly: ignore[invalid-argument] } image_dirs = [ paths['train_images'] / 'train2017', @@ -132,13 +132,13 @@ def _split_generators(self, dl_manager: tfds.download.DownloadManager): paths['test_images'] / 'test2017', ] return { - tfds.Split.TRAIN: self._generate_examples( + tfds.Split.TRAIN: self._generate_examples( # pyrefly: ignore[missing-attribute] image_dirs, paths['train_annotation'] / 'lvis_v1_train.json' ), - tfds.Split.VALIDATION: self._generate_examples( + tfds.Split.VALIDATION: self._generate_examples( # pyrefly: ignore[missing-attribute] image_dirs, paths['validation_annotation'] / 'lvis_v1_val.json' ), - tfds.Split.TEST: self._generate_examples( + tfds.Split.TEST: self._generate_examples( # pyrefly: ignore[missing-attribute] image_dirs, paths['test_annotation'] / 'lvis_v1_image_info_test_dev.json', ), diff --git a/tensorflow_datasets/datasets/malaria/malaria_dataset_builder.py b/tensorflow_datasets/datasets/malaria/malaria_dataset_builder.py index 4a991ab4ef8..338055bc2ea 100644 --- a/tensorflow_datasets/datasets/malaria/malaria_dataset_builder.py +++ b/tensorflow_datasets/datasets/malaria/malaria_dataset_builder.py @@ -56,7 +56,7 @@ def _split_generators(self, dl_manager): return [ tfds.core.SplitGenerator( - name=tfds.Split.TRAIN, + name=tfds.Split.TRAIN, # pyrefly: ignore[missing-attribute] gen_kwargs={ "data_dir_path": os.path.join(path, "cell_images"), }, diff --git a/tensorflow_datasets/datasets/math_dataset/math_dataset_dataset_builder.py b/tensorflow_datasets/datasets/math_dataset/math_dataset_dataset_builder.py index a3a6787e1fb..50a094159d8 100644 --- a/tensorflow_datasets/datasets/math_dataset/math_dataset_dataset_builder.py +++ b/tensorflow_datasets/datasets/math_dataset/math_dataset_dataset_builder.py @@ -208,11 +208,11 @@ def _split_generators(self, dl_manager): """Returns SplitGenerators.""" directory = dl_manager.download_and_extract(_DATA_URL) - config = self.builder_config.name + ".txt" + config = self.builder_config.name + ".txt" # pyrefly: ignore[missing-attribute] return [ tfds.core.SplitGenerator( - name=tfds.Split.TRAIN, + name=tfds.Split.TRAIN, # pyrefly: ignore[missing-attribute] gen_kwargs={ "directory": directory, "config": config, @@ -220,7 +220,7 @@ def _split_generators(self, dl_manager): }, ), tfds.core.SplitGenerator( - name=tfds.Split.TEST, + name=tfds.Split.TEST, # pyrefly: ignore[missing-attribute] gen_kwargs={ "directory": directory, "config": config, diff --git a/tensorflow_datasets/datasets/math_qa/math_qa_dataset_builder.py b/tensorflow_datasets/datasets/math_qa/math_qa_dataset_builder.py index 6cb68121bd8..01d22808b05 100644 --- a/tensorflow_datasets/datasets/math_qa/math_qa_dataset_builder.py +++ b/tensorflow_datasets/datasets/math_qa/math_qa_dataset_builder.py @@ -58,13 +58,13 @@ def _split_generators(self, dl_manager: tfds.download.DownloadManager): """Returns SplitGenerators.""" path = dl_manager.download_and_extract(_URL) return { - tfds.Split.TRAIN: self._generate_examples( + tfds.Split.TRAIN: self._generate_examples( # pyrefly: ignore[missing-attribute] os.path.join(path, 'train.json') ), - tfds.Split.VALIDATION: self._generate_examples( + tfds.Split.VALIDATION: self._generate_examples( # pyrefly: ignore[missing-attribute] os.path.join(path, 'dev.json') ), - tfds.Split.TEST: self._generate_examples( + tfds.Split.TEST: self._generate_examples( # pyrefly: ignore[missing-attribute] os.path.join(path, 'test.json') ), } diff --git a/tensorflow_datasets/datasets/mlqa/mlqa_dataset_builder.py b/tensorflow_datasets/datasets/mlqa/mlqa_dataset_builder.py index ab404a1fd55..dc42a54f491 100644 --- a/tensorflow_datasets/datasets/mlqa/mlqa_dataset_builder.py +++ b/tensorflow_datasets/datasets/mlqa/mlqa_dataset_builder.py @@ -62,7 +62,7 @@ def _info(self): ) def _split_generators(self, dl_manager): - lang = self.builder_config.language + lang = self.builder_config.language # pyrefly: ignore[missing-attribute] filepaths = dl_manager.download_and_extract({ "test": _DOWNLOAD_URL, "validation": _DOWNLOAD_URL, diff --git a/tensorflow_datasets/datasets/multi_news/multi_news_dataset_builder.py b/tensorflow_datasets/datasets/multi_news/multi_news_dataset_builder.py index d1b7225abe6..7127ca27842 100644 --- a/tensorflow_datasets/datasets/multi_news/multi_news_dataset_builder.py +++ b/tensorflow_datasets/datasets/multi_news/multi_news_dataset_builder.py @@ -69,12 +69,12 @@ def _split_generators(self, dl_manager: tfds.download.DownloadManager): files = dl_manager.download_and_extract(data_dict) return { "train": self._generate_examples( - files["train_src"], files["train_tgt"] + files["train_src"], files["train_tgt"] # pyrefly: ignore[bad-index] ), "validation": self._generate_examples( - files["val_src"], files["val_tgt"] + files["val_src"], files["val_tgt"] # pyrefly: ignore[bad-index] ), - "test": self._generate_examples(files["test_src"], files["test_tgt"]), + "test": self._generate_examples(files["test_src"], files["test_tgt"]), # pyrefly: ignore[bad-index] } def _generate_examples(self, src_file, tgt_file): diff --git a/tensorflow_datasets/datasets/natural_instructions/natural_instructions_dataset_builder.py b/tensorflow_datasets/datasets/natural_instructions/natural_instructions_dataset_builder.py index f803c7e3612..86ce4d4fdde 100644 --- a/tensorflow_datasets/datasets/natural_instructions/natural_instructions_dataset_builder.py +++ b/tensorflow_datasets/datasets/natural_instructions/natural_instructions_dataset_builder.py @@ -58,7 +58,7 @@ def _split_generators(self, dl_manager: tfds.download.DownloadManager): # Downloads the data and defines the splits data_dir = dl_manager.download_and_extract(name_to_paths) return { - tfds.Split.TRAIN: self._generate_examples(path=data_dir), + tfds.Split.TRAIN: self._generate_examples(path=data_dir), # pyrefly: ignore[missing-attribute] } def _generate_examples(self, path): diff --git a/tensorflow_datasets/datasets/natural_questions/natural_questions_dataset_builder.py b/tensorflow_datasets/datasets/natural_questions/natural_questions_dataset_builder.py index 24d88b121bc..7ada0daf8ef 100644 --- a/tensorflow_datasets/datasets/natural_questions/natural_questions_dataset_builder.py +++ b/tensorflow_datasets/datasets/natural_questions/natural_questions_dataset_builder.py @@ -147,7 +147,7 @@ class Builder(tfds.core.BeamBasedBuilder): def _info(self): return self.dataset_info_from_configs( - features=self.builder_config.features, + features=self.builder_config.features, # pyrefly: ignore[missing-attribute] supervised_keys=None, homepage=_URL, ) @@ -159,11 +159,11 @@ def _split_generators(self, dl_manager): return [ tfds.core.SplitGenerator( - name=tfds.Split.TRAIN, + name=tfds.Split.TRAIN, # pyrefly: ignore[missing-attribute] gen_kwargs={'filepaths': files['train']}, ), tfds.core.SplitGenerator( - name=tfds.Split.VALIDATION, + name=tfds.Split.VALIDATION, # pyrefly: ignore[missing-attribute] gen_kwargs={'filepaths': files['validation']}, ), ] @@ -316,7 +316,7 @@ def _build_pcollection(self, pipeline, filepaths): parse_example = { 'default': self._parse_example_default, 'longt5': self._parse_example_longt5, - }[self.builder_config.name] + }[self.builder_config.name] # pyrefly: ignore[missing-attribute] return ( pipeline diff --git a/tensorflow_datasets/datasets/newsroom/newsroom_dataset_builder.py b/tensorflow_datasets/datasets/newsroom/newsroom_dataset_builder.py index 3e7eeb042d2..e1b42cdab93 100644 --- a/tensorflow_datasets/datasets/newsroom/newsroom_dataset_builder.py +++ b/tensorflow_datasets/datasets/newsroom/newsroom_dataset_builder.py @@ -55,7 +55,7 @@ def _info(self): k: tfds.features.Text() for k in [_DOCUMENT, _SUMMARY] + _ADDITIONAL_TEXT_FEATURES } - features.update( + features.update( # pyrefly: ignore[no-matching-overload] { k: tfds.features.Tensor(shape=[], dtype=np.float32) for k in _ADDITIONAL_FLOAT_FEATURES @@ -71,19 +71,19 @@ def _split_generators(self, dl_manager): """Returns SplitGenerators.""" return [ tfds.core.SplitGenerator( - name=tfds.Split.TRAIN, + name=tfds.Split.TRAIN, # pyrefly: ignore[missing-attribute] gen_kwargs={ "input_file": os.path.join(dl_manager.manual_dir, "train.jsonl") }, ), tfds.core.SplitGenerator( - name=tfds.Split.VALIDATION, + name=tfds.Split.VALIDATION, # pyrefly: ignore[missing-attribute] gen_kwargs={ "input_file": os.path.join(dl_manager.manual_dir, "dev.jsonl") }, ), tfds.core.SplitGenerator( - name=tfds.Split.TEST, + name=tfds.Split.TEST, # pyrefly: ignore[missing-attribute] gen_kwargs={ "input_file": os.path.join(dl_manager.manual_dir, "test.jsonl") }, @@ -92,7 +92,7 @@ def _split_generators(self, dl_manager): def _generate_examples(self, input_file=None): """Yields examples.""" - with epath.Path(input_file).open() as f: + with epath.Path(input_file).open() as f: # pyrefly: ignore[bad-argument-type] for i, line in enumerate(f): d = json.loads(line) # fields are "url", "archive", "title", "date", "text", diff --git a/tensorflow_datasets/datasets/nsynth/nsynth_dataset_builder.py b/tensorflow_datasets/datasets/nsynth/nsynth_dataset_builder.py index b91b5bf3ccd..b706fc5f78d 100644 --- a/tensorflow_datasets/datasets/nsynth/nsynth_dataset_builder.py +++ b/tensorflow_datasets/datasets/nsynth/nsynth_dataset_builder.py @@ -293,20 +293,20 @@ def _info(self): }, "qualities": {quality: tf.bool for quality in _QUALITIES}, } - if self.builder_config.estimate_f0_and_loudness: + if self.builder_config.estimate_f0_and_loudness: # pyrefly: ignore[missing-attribute] f0_and_ld_shape = (_F0_AND_LOUDNESS_RATE * _NUM_SECS,) - features["f0"] = { + features["f0"] = { # pyrefly: ignore[bad-assignment] "hz": tfds.features.Tensor(shape=f0_and_ld_shape, dtype=np.float32), "midi": tfds.features.Tensor(shape=f0_and_ld_shape, dtype=np.float32), "confidence": tfds.features.Tensor( shape=f0_and_ld_shape, dtype=np.float32 ), } - features["loudness"] = { + features["loudness"] = { # pyrefly: ignore[bad-assignment] "db": tfds.features.Tensor(shape=f0_and_ld_shape, dtype=np.float32) } return self.dataset_info_from_configs( - features=tfds.features.FeaturesDict(features), + features=tfds.features.FeaturesDict(features), # pyrefly: ignore[bad-argument-type] homepage="https://g.co/magenta/nsynth-dataset", metadata=tfds.core.BeamMetadataDict( sample_rate=_AUDIO_RATE, @@ -322,7 +322,7 @@ def _split_generators(self, dl_manager): for split in _SPLITS } dl_urls["instrument_labels"] = _BASE_DOWNLOAD_PATH + "instrument_labels.txt" - if self.builder_config.gansynth_subset: + if self.builder_config.gansynth_subset: # pyrefly: ignore[missing-attribute] dl_urls["gansynth_splits"] = _BASE_DOWNLOAD_PATH + "gansynth_splits.csv" dl_paths = dl_manager.download_and_extract(dl_urls) @@ -365,7 +365,7 @@ def _build_pcollection(self, pipeline, tfrecord_dirs, ids, split): | beam.Map(_emit_base_example, split=split) | beam.Filter(_in_split, split_ids=ids, split=split) ) - if self.builder_config.estimate_f0_and_loudness: + if self.builder_config.estimate_f0_and_loudness: # pyrefly: ignore[missing-attribute] examples = ( examples | beam.Reshuffle() diff --git a/tensorflow_datasets/datasets/nyu_depth_v2/nyu_depth_v2_dataset_builder.py b/tensorflow_datasets/datasets/nyu_depth_v2/nyu_depth_v2_dataset_builder.py index e97992095e3..ec56e21c28f 100644 --- a/tensorflow_datasets/datasets/nyu_depth_v2/nyu_depth_v2_dataset_builder.py +++ b/tensorflow_datasets/datasets/nyu_depth_v2/nyu_depth_v2_dataset_builder.py @@ -46,13 +46,13 @@ def _split_generators(self, dl_manager): return [ tfds.core.SplitGenerator( - name=tfds.Split.TRAIN, + name=tfds.Split.TRAIN, # pyrefly: ignore[missing-attribute] gen_kwargs={ 'root_dir': os.path.join(base_path, 'nyudepthv2', 'train') }, ), tfds.core.SplitGenerator( - name=tfds.Split.VALIDATION, + name=tfds.Split.VALIDATION, # pyrefly: ignore[missing-attribute] gen_kwargs={ 'root_dir': os.path.join(base_path, 'nyudepthv2', 'val') }, diff --git a/tensorflow_datasets/datasets/open_images_challenge2019_detection/open_images_challenge2019_detection_dataset_builder.py b/tensorflow_datasets/datasets/open_images_challenge2019_detection/open_images_challenge2019_detection_dataset_builder.py index 3126509701c..7a494bf0fd2 100644 --- a/tensorflow_datasets/datasets/open_images_challenge2019_detection/open_images_challenge2019_detection_dataset_builder.py +++ b/tensorflow_datasets/datasets/open_images_challenge2019_detection/open_images_challenge2019_detection_dataset_builder.py @@ -97,15 +97,15 @@ def _split_generators(self, dl_manager): paths = dl_manager.download(urls) return [ tfds.core.SplitGenerator( - name=tfds.Split.TRAIN, + name=tfds.Split.TRAIN, # pyrefly: ignore[missing-attribute] gen_kwargs=dict(paths=paths, split="train"), ), tfds.core.SplitGenerator( - name=tfds.Split.TEST, + name=tfds.Split.TEST, # pyrefly: ignore[missing-attribute] gen_kwargs=dict(paths=paths, split="test"), ), tfds.core.SplitGenerator( - name=tfds.Split.VALIDATION, + name=tfds.Split.VALIDATION, # pyrefly: ignore[missing-attribute] gen_kwargs=dict(paths=paths, split="validation"), ), ] @@ -188,7 +188,7 @@ def _build_pcollection(self, pipeline, paths, split): | "ProcessImages" >> beam.ParDo( oi_beam.ProcessImageFn( - target_pixels=self.builder_config.target_pixels, jpeg_quality=72 + target_pixels=self.builder_config.target_pixels, jpeg_quality=72 # pyrefly: ignore[missing-attribute] ) ) | "GenerateExamples" diff --git a/tensorflow_datasets/datasets/open_images_v4/open_images_v4_dataset_builder.py b/tensorflow_datasets/datasets/open_images_v4/open_images_v4_dataset_builder.py index 83b4384da4b..33963f1455e 100644 --- a/tensorflow_datasets/datasets/open_images_v4/open_images_v4_dataset_builder.py +++ b/tensorflow_datasets/datasets/open_images_v4/open_images_v4_dataset_builder.py @@ -215,7 +215,7 @@ def load_boxes(name): validation_bbox = load_boxes('validation-annotations-bbox') return [ tfds.core.SplitGenerator( - name=tfds.Split.TRAIN, + name=tfds.Split.TRAIN, # pyrefly: ignore[missing-attribute] gen_kwargs=dict( archive_paths=paths['train_images'], objects_getter=train_objects, @@ -224,7 +224,7 @@ def load_boxes(name): ), ), tfds.core.SplitGenerator( - name=tfds.Split.TEST, + name=tfds.Split.TEST, # pyrefly: ignore[missing-attribute] gen_kwargs=dict( archive_paths=[paths['test_images']], objects_getter=test_objects, @@ -232,7 +232,7 @@ def load_boxes(name): ), ), tfds.core.SplitGenerator( - name=tfds.Split.VALIDATION, + name=tfds.Split.VALIDATION, # pyrefly: ignore[missing-attribute] gen_kwargs=dict( archive_paths=[paths['validation_images']], objects_getter=validation_objects, @@ -266,7 +266,7 @@ def _generate_examples( ] record = { 'image': _resize_image_if_necessary( - fobj, target_pixels=self.builder_config.target_pixels + fobj, target_pixels=self.builder_config.target_pixels # pyrefly: ignore[missing-attribute] ), 'image/filename': fname, 'objects': image_objects, diff --git a/tensorflow_datasets/datasets/openbookqa/openbookqa_dataset_builder.py b/tensorflow_datasets/datasets/openbookqa/openbookqa_dataset_builder.py index 2754f57152c..e1cf64277bf 100644 --- a/tensorflow_datasets/datasets/openbookqa/openbookqa_dataset_builder.py +++ b/tensorflow_datasets/datasets/openbookqa/openbookqa_dataset_builder.py @@ -60,7 +60,7 @@ def _split_generators(self, dl_manager): data_dir = os.path.join(dl_dir, 'OpenBookQA-V1-Sep2018/Data/Additional') return [ tfds.core.SplitGenerator( - name=tfds.Split.TRAIN, + name=tfds.Split.TRAIN, # pyrefly: ignore[missing-attribute] # These kwargs will be passed to _generate_examples gen_kwargs={ 'data_dir': data_dir, @@ -68,7 +68,7 @@ def _split_generators(self, dl_manager): }, ), tfds.core.SplitGenerator( - name=tfds.Split.VALIDATION, + name=tfds.Split.VALIDATION, # pyrefly: ignore[missing-attribute] # These kwargs will be passed to _generate_examples gen_kwargs={ 'data_dir': data_dir, @@ -76,7 +76,7 @@ def _split_generators(self, dl_manager): }, ), tfds.core.SplitGenerator( - name=tfds.Split.TEST, + name=tfds.Split.TEST, # pyrefly: ignore[missing-attribute] # These kwargs will be passed to _generate_examples gen_kwargs={ 'data_dir': data_dir, diff --git a/tensorflow_datasets/datasets/opinion_abstracts/opinion_abstracts_dataset_builder.py b/tensorflow_datasets/datasets/opinion_abstracts/opinion_abstracts_dataset_builder.py index 55b2aef6c0f..6586dbd24fc 100644 --- a/tensorflow_datasets/datasets/opinion_abstracts/opinion_abstracts_dataset_builder.py +++ b/tensorflow_datasets/datasets/opinion_abstracts/opinion_abstracts_dataset_builder.py @@ -81,14 +81,14 @@ def _info(self) -> tfds.core.DatasetInfo: config = self.builder_config return self.dataset_info_from_configs( features=tfds.features.FeaturesDict({ - config.name_key: np.str_, - config.id_key: np.str_, - config.summary_key: np.str_, - config.opinions_key: tfds.features.Sequence( + config.name_key: np.str_, # pyrefly: ignore[missing-attribute] + config.id_key: np.str_, # pyrefly: ignore[missing-attribute] + config.summary_key: np.str_, # pyrefly: ignore[missing-attribute] + config.opinions_key: tfds.features.Sequence( # pyrefly: ignore[missing-attribute] tfds.features.FeaturesDict({"key": np.str_, "value": np.str_}) ), }), - supervised_keys=(config.opinions_key, config.summary_key), + supervised_keys=(config.opinions_key, config.summary_key), # pyrefly: ignore[missing-attribute] homepage="https://web.eecs.umich.edu/~wangluxy/data.html", ) @@ -98,11 +98,11 @@ def _split_generators( """Returns SplitGenerators.""" dl_path = dl_manager.download_and_extract(_URL) path = os.path.join( - dl_path, "opinion_abstracts", self.builder_config.filename + dl_path, "opinion_abstracts", self.builder_config.filename # pyrefly: ignore[missing-attribute] ) return [ tfds.core.SplitGenerator( - name=tfds.Split.TRAIN, + name=tfds.Split.TRAIN, # pyrefly: ignore[missing-attribute] gen_kwargs={"path": path}, ), ] @@ -116,7 +116,7 @@ def _generate_examples( config = self.builder_config opinions = example[config.opinions_key].items() opinions = [{"key": k, "value": v} for k, v in opinions] - features = {config.opinions_key: opinions} - for k in [config.name_key, config.id_key, config.summary_key]: + features = {config.opinions_key: opinions} # pyrefly: ignore[missing-attribute] + for k in [config.name_key, config.id_key, config.summary_key]: # pyrefly: ignore[missing-attribute] features[k] = example[k] yield example[config.id_key], features diff --git a/tensorflow_datasets/datasets/opinosis/opinosis_dataset_builder.py b/tensorflow_datasets/datasets/opinosis/opinosis_dataset_builder.py index 4c71becf935..5bc5f43530e 100644 --- a/tensorflow_datasets/datasets/opinosis/opinosis_dataset_builder.py +++ b/tensorflow_datasets/datasets/opinosis/opinosis_dataset_builder.py @@ -46,21 +46,21 @@ def _split_generators(self, dl_manager): extract_path = dl_manager.download_and_extract(_URL) return [ tfds.core.SplitGenerator( - name=tfds.Split.TRAIN, + name=tfds.Split.TRAIN, # pyrefly: ignore[missing-attribute] gen_kwargs={"path": extract_path}, ), ] def _generate_examples(self, path=None): """Yields examples.""" - topics_path = os.path.join(path, "topics") + topics_path = os.path.join(path, "topics") # pyrefly: ignore[no-matching-overload] filenames = tf.io.gfile.listdir(topics_path) for filename in filenames: file_path = os.path.join(topics_path, filename) topic_name = filename.split(".txt")[0] with tf.io.gfile.GFile(file_path, "rb") as src_f: input_data = src_f.read() - summaries_path = os.path.join(path, "summaries-gold", topic_name) + summaries_path = os.path.join(path, "summaries-gold", topic_name) # pyrefly: ignore[no-matching-overload] summary_lst = [] for summ_filename in sorted(tf.io.gfile.listdir(summaries_path)): file_path = os.path.join(summaries_path, summ_filename) diff --git a/tensorflow_datasets/datasets/opus/opus_dataset_builder.py b/tensorflow_datasets/datasets/opus/opus_dataset_builder.py index 9daab6d40b8..13312b0b638 100644 --- a/tensorflow_datasets/datasets/opus/opus_dataset_builder.py +++ b/tensorflow_datasets/datasets/opus/opus_dataset_builder.py @@ -907,26 +907,26 @@ class Builder(tfds.core.GeneratorBasedBuilder): @property def subsets(self): # Return only the datasets that exist for the language pair. - source, target = self.builder_config.language_pair + source, target = self.builder_config.language_pair # pyrefly: ignore[missing-attribute] filtered_subsets = [] - for dataset in [DATASET_MAP[name] for name in self.builder_config.subsets]: + for dataset in [DATASET_MAP[name] for name in self.builder_config.subsets]: # pyrefly: ignore[missing-attribute] if (source, target) in dataset.language_pairs: filtered_subsets.append(dataset) return filtered_subsets def _info(self): - src, target = self.builder_config.language_pair + src, target = self.builder_config.language_pair # pyrefly: ignore[missing-attribute] return self.dataset_info_from_configs( features=tfds.features.Translation( - languages=self.builder_config.language_pair + languages=self.builder_config.language_pair # pyrefly: ignore[missing-attribute] ), supervised_keys=(src, target), homepage="http://opus.nlpl.eu/", ) def _split_generators(self, dl_manager): - source, target = self.builder_config.language_pair + source, target = self.builder_config.language_pair # pyrefly: ignore[missing-attribute] file_ext = "%s-%s" % (source, target) subsets = [] @@ -948,12 +948,12 @@ def _split_generators(self, dl_manager): return [ tfds.core.SplitGenerator( - name=tfds.Split.TRAIN, gen_kwargs={"subsets": subsets} + name=tfds.Split.TRAIN, gen_kwargs={"subsets": subsets} # pyrefly: ignore[missing-attribute] ) ] def _generate_examples(self, subsets): - source, target = self.builder_config.language_pair + source, target = self.builder_config.language_pair # pyrefly: ignore[missing-attribute] for item in subsets: logging.info("Generating examples from: %s", item["name"]) diff --git a/tensorflow_datasets/datasets/oxford_flowers102/oxford_flowers102_dataset_builder.py b/tensorflow_datasets/datasets/oxford_flowers102/oxford_flowers102_dataset_builder.py index b5f3f943b56..a2764b0b7e5 100644 --- a/tensorflow_datasets/datasets/oxford_flowers102/oxford_flowers102_dataset_builder.py +++ b/tensorflow_datasets/datasets/oxford_flowers102/oxford_flowers102_dataset_builder.py @@ -163,15 +163,15 @@ def _split_generators(self, dl_manager): return [ tfds.core.SplitGenerator( - name=tfds.Split.TRAIN, + name=tfds.Split.TRAIN, # pyrefly: ignore[missing-attribute] gen_kwargs=dict(split_name="trnid", **gen_kwargs), ), tfds.core.SplitGenerator( - name=tfds.Split.TEST, + name=tfds.Split.TEST, # pyrefly: ignore[missing-attribute] gen_kwargs=dict(split_name="tstid", **gen_kwargs), ), tfds.core.SplitGenerator( - name=tfds.Split.VALIDATION, + name=tfds.Split.VALIDATION, # pyrefly: ignore[missing-attribute] gen_kwargs=dict(split_name="valid", **gen_kwargs), ), ] diff --git a/tensorflow_datasets/datasets/para_crawl/para_crawl_dataset_builder.py b/tensorflow_datasets/datasets/para_crawl/para_crawl_dataset_builder.py index 6f29bcf5459..34595f449e1 100644 --- a/tensorflow_datasets/datasets/para_crawl/para_crawl_dataset_builder.py +++ b/tensorflow_datasets/datasets/para_crawl/para_crawl_dataset_builder.py @@ -114,7 +114,7 @@ class Builder(tfds.core.GeneratorBasedBuilder): ] def _info(self): - target_language = self.builder_config.target_language + target_language = self.builder_config.target_language # pyrefly: ignore[missing-attribute] return self.dataset_info_from_configs( features=tfds.features.Translation( languages=("en", target_language), @@ -126,17 +126,17 @@ def _info(self): def _split_generators(self, dl_manager): # Download the data file. data_file = dl_manager.download_and_extract( - {"data_file": self.builder_config.data_url} + {"data_file": self.builder_config.data_url} # pyrefly: ignore[missing-attribute] ) # Return the single split of the data. return [ - tfds.core.SplitGenerator(name=tfds.Split.TRAIN, gen_kwargs=data_file) + tfds.core.SplitGenerator(name=tfds.Split.TRAIN, gen_kwargs=data_file) # pyrefly: ignore[missing-attribute] ] def _generate_examples(self, data_file): """This function returns the examples in the raw (text) form.""" - target_language = self.builder_config.target_language + target_language = self.builder_config.target_language # pyrefly: ignore[missing-attribute] with epath.Path(data_file).open() as f: for idx, line in enumerate(f): diff --git a/tensorflow_datasets/datasets/pass/pass_dataset_builder.py b/tensorflow_datasets/datasets/pass/pass_dataset_builder.py index 81f77305560..0921dd2b377 100644 --- a/tensorflow_datasets/datasets/pass/pass_dataset_builder.py +++ b/tensorflow_datasets/datasets/pass/pass_dataset_builder.py @@ -78,14 +78,14 @@ def _split_generators(self, dl_manager: tfds.download.DownloadManager): """Returns SplitGenerators.""" pd = tfds.core.lazy_imports.pandas paths = dl_manager.download(_URLS) - with tf.io.gfile.GFile(paths['meta_data']) as f: + with tf.io.gfile.GFile(paths['meta_data']) as f: # pyrefly: ignore[bad-index] meta = pd.read_csv(f) meta = meta.set_index('hash') return [ tfds.core.SplitGenerator( - name=tfds.Split.TRAIN, + name=tfds.Split.TRAIN, # pyrefly: ignore[missing-attribute] gen_kwargs=dict( - parts=paths['train_images'], meta=meta, dl_manager=dl_manager + parts=paths['train_images'], meta=meta, dl_manager=dl_manager # pyrefly: ignore[bad-index] ), ) ]