-
Notifications
You must be signed in to change notification settings - Fork 344
All issues
Issue creation is restricted in this repository
Issues
is:issue state:open
is:issue state:open
Search results
Sort-aware Iceberg reads in Comet via a per-partition streaming merge
area:scanParquet scan / data readingParquet scan / data readingenhancementNew feature or requestNew feature or requestStatus: Open.Support Iceberg
SparkCopyOnWriteScaninIcebergReflection.ICEBERG_SCAN_CLASSESarea:scanParquet scan / data readingParquet scan / data readingenhancementNew feature or requestNew feature or requestStatus: Open.#5319 In apache/datafusion-comet;refactor: centralize Spark-to-Arrow batch encoding in ArrowWriter
area:ffiArrow FFI / JNI boundaryArrow FFI / JNI boundaryenhancementNew feature or requestNew feature or requestStatus: Open.#5317 In apache/datafusion-comet;Support S3-compliant object stores
area:scanParquet scan / data readingParquet scan / data readingenhancementNew feature or requestNew feature or requestStatus: Open.Evaluate extending collect_set input normalization to Spark 3.4 through 4.1
area:aggregationHash aggregates, aggregate expressionsHash aggregates, aggregate expressionsenhancementNew feature or requestNew feature or requestStatus: Open.#5312 In apache/datafusion-comet;WideDecimalBinaryExpr: write nulls directly for overflow
area:expressionsExpression evaluationExpression evaluationenhancementNew feature or requestNew feature or requestStatus: Open.#5309 In apache/datafusion-comet;feat: Write Iceberg Parquet data files natively via iceberg-rust (part 3 of 3)
area:writerNative Parquet writerNative Parquet writerenhancementNew feature or requestNew feature or requestStatus: Open.#5308 In apache/datafusion-comet;Native Parquet writes report row counts but not row contents to WriteTaskStatsTrackers
area:writerNative Parquet writerNative Parquet writerenhancementNew feature or requestNew feature or requestStatus: Open.#5307 In apache/datafusion-comet;Reconcile the two config namespaces for native writes
area:writerNative Parquet writerNative Parquet writerenhancementNew feature or requestNew feature or requestStatus: Open.#5306 In apache/datafusion-comet;Native Parquet writer derives schema nullability and field IDs from Arrow rather than Catalyst
area:writerNative Parquet writerNative Parquet writerbugSomething isn't workingSomething isn't workingpriority:mediumFunctional bugs, performance regressions, broken featuresFunctional bugs, performance regressions, broken featuresStatus: Open.#5305 In apache/datafusion-comet;Native Parquet writer ignores Spark's Parquet writer properties (block size, page size, dictionary, writer version, statistics)
area:writerNative Parquet writerNative Parquet writerenhancementNew feature or requestNew feature or requestStatus: Open.#5304 In apache/datafusion-comet;Native Parquet write of a zero-partition RDD produces no output file
area:writerNative Parquet writerNative Parquet writerbugSomething isn't workingSomething isn't workingpriority:mediumFunctional bugs, performance regressions, broken featuresFunctional bugs, performance regressions, broken featuresStatus: Open.#5303 In apache/datafusion-comet;