Executors
Running DataVec transform processes — LocalTransformExecutor and SparkTransformExecutor
LocalTransformExecutor
Execute on a List
import org.datavec.local.transforms.LocalTransformExecutor;
// Load all records into memory first (suitable for small datasets)
List<List<Writable>> originalData = new ArrayList<>();
while (reader.hasNext()) {
originalData.add(reader.next());
}
List<List<Writable>> processedData = LocalTransformExecutor.execute(originalData, transformProcess);Execute on a RecordReader
Execute Sequences (2D records -> sequences)
Execute a Join Locally
Error Handling
SparkTransformExecutor
Setup
Basic Execution
Execute to Sequence
Execute from Sequence
Execute a Join on Spark
Error Handling on Spark
Choosing Local vs. Spark
Criterion
LocalTransformExecutor
SparkTransformExecutor
Using TransformProcessRecordReader Instead
Last updated
Was this helpful?