--- dataset_info: features: - name: identifier dtype: string - name: embedding list: float64 - name: tokens list: string splits: - name: train num_bytes: 186803728 num_examples: 8841 download_size: 186463659 dataset_size: 186803728 configs: - config_name: default data_files: - split: train path: data/train-* ---