Messages by Thread
-
-
[I] Cleanup aggregation planning [datafusion]
via GitHub
-
[I] Extract common aggregation spill logic [datafusion]
via GitHub
-
[PR] perf: resolve schema fields by name index instead of scanning [datafusion]
via GitHub
-
Re: [PR] feat(parquet): sub-column projection pushdown for struct fields [datafusion]
via GitHub
-
Re: [PR] Reject negative ln inputs [datafusion]
via GitHub
-
Re: [PR] Reuse Subplan with multiple references [Part 1 / 3] [datafusion]
via GitHub
-
Re: [PR] Fix volatile scalar subquery deduplication [datafusion]
via GitHub
-
Re: [PR] feat: Add comprehensive metrics tracking to CSV reader [datafusion]
via GitHub
-
Re: [I] Add physical plan optimization to decide dictionary encoding [datafusion]
via GitHub
-
Re: [I] Allow users to define the cardinality threshold for dictionary reads [datafusion]
via GitHub
-
[PR] feat(parquet): clip nested wrappers during schema pruning [datafusion]
via GitHub
-
[PR] [branch-55] Update changelog [datafusion]
via GitHub
-
[PR] perf: direct mapped group values for dense primitive group by keys [datafusion]
via GitHub
-
[I] Support transformed sort orders (bucket / truncate / etc.) [datafusion-comet]
via GitHub
-
[I] Merge on sort keys even when they are not selected [datafusion-comet]
via GitHub
-
[I] Bound memory when a partition has many files [datafusion-comet]
via GitHub
-
[I] Broaden storage-partitioned-join tests, then enable reportPartitioning by default [datafusion-comet]
via GitHub
-
[I] Skip the merge wrapper for single-file partitions [datafusion-comet]
via GitHub
-
[I] Keep read concurrency in the sorted merge path [datafusion-comet]
via GitHub
-
[I] Sort-aware Iceberg reads: per-partition streaming merge + report ordering and grouping (v1) [datafusion-comet]
via GitHub
-
[I] Remove old `dfbench` runner once benchmarks are migrated to the new SQL benchmark framework [datafusion]
via GitHub
-
[I] Update `bench.sh` to use the new `benchmark_runner` [datafusion]
via GitHub
-
[I] TPC-H SF1000 Q17 stops completing after #2173; task-launch message overflow is misread as executor loss [datafusion-ballista]
via GitHub
-
[I] Significant overhead in datafusion_common::utils::memory::get_record_batch_memory_size [datafusion]
via GitHub
-
[PR] Minor: avoid a few clones in sum accumulator setup [datafusion]
via GitHub
-
Re: [PR] perf: Concretely typed TopK StringHeap, and StringHashTable slot reuse [datafusion]
via GitHub
-
[PR] chore(deps): bump the all-other-cargo-deps group with 2 updates [datafusion]
via GitHub
-
[PR] chore(deps): bump Swatinem/rust-cache from 2.8.1 to 2.9.2 in /.github/actions/setup-macos-aarch64-builder [datafusion]
via GitHub
-
[PR] chore(deps): bump taiki-e/install-action from 2.85.10 to 2.85.11 [datafusion]
via GitHub
-
[PR] chore(deps): bump pygithub from 2.8.1 to 2.9.1 [datafusion]
via GitHub
-
[PR] chore(deps): bump rich from 14.3.2 to 15.0.0 [datafusion]
via GitHub
-
[PR] chore(deps-dev): bump webpack-cli from 5.1.4 to 7.2.2 in /datafusion/wasmtest/datafusion-wasm-app [datafusion]
via GitHub
-
[PR] chore(deps): bump typing-extensions from 4.15.0 to 4.16.0 [datafusion]
via GitHub
-
[PR] chore(deps): bump requests from 2.33.0 to 2.34.2 [datafusion]
via GitHub
-
[PR] chore(deps-dev): bump webpack from 5.105.0 to 5.109.2 in /datafusion/wasmtest/datafusion-wasm-app in the all-npm-deps group [datafusion]
via GitHub
-
[PR] chore(deps): bump setuptools from 83.0.0 to 84.0.0 [datafusion]
via GitHub
-
Re: [I] [Parquet] Pruning predicates are evaluated in bloom filter codepaths, even when there are no bloom filters [datafusion]
via GitHub
-
[PR] fix: drain PiecewiseMergeJoin output before state transitions [datafusion]
via GitHub
-
[I] `PiecewiseMergeJoin` changes state before draining its output coalescer: the Left/Full unmatched pass repeats forever, queued Right/Full rows can be dropped [datafusion]
via GitHub
-
[PR] Backport of refactor(physical-plan): Simplify `ExecutionPlan` API with `replace_children` [datafusion]
via GitHub
-
[PR] docs: document regular expression function arguments [datafusion-python]
via GitHub
-
Re: [I] refactor(physical-plan): simplify `ExecutionPlan` children-replacement API [datafusion]
via GitHub
-
[I] Add mode to run Comet planning but execute with Spark, so users can assess potential Comet coverage [datafusion-comet]
via GitHub
-
[PR] fix(docs): k8s executors dial the registration Service; scheduler needs maxUnavailable: 1 [datafusion-ballista]
via GitHub
-
[PR] BigQuery: support `CREATE VECTOR INDEX` [datafusion-sqlparser-rs]
via GitHub
-
[I] Task input metrics are unreliable when a native block mixes a native scan with a JVM input [datafusion-comet]
via GitHub
-
Re: [I] Track DataFusion git main via a pinned rev and bump it periodically [datafusion-ballista]
via GitHub
-
Re: [PR] fix: GROUP BY returns two rows for the NULL group with a nullable UNIQUE constraint [datafusion]
via GitHub
-
Re: [PR] Window function perf: Cache nth_value valid indices [datafusion]
via GitHub
-
[PR] [branch-55] Update additional references to version number [datafusion]
via GitHub
-
[PR] doc: Update documentation version number [datafusion]
via GitHub
-
Re: [PR] perf: sort multi-column runs via row format and coalesce them [datafusion]
via GitHub
-
Re: [PR] feat: memory accounting for WindowAggExec [datafusion]
via GitHub
-
Re: [PR] Window function perf: Speed up rank window materialization [datafusion]
via GitHub
-
Re: [PR] perf: vectorized output for first_value/last_value/nth_value over a window frame [datafusion]
via GitHub
-
Re: [PR] perf: split row groups by file range (morsel splitting) [datafusion]
via GitHub
-
Re: [PR] perf: emit WindowAggExec output in batch_size chunks [datafusion]
via GitHub
-
Re: [PR] perf: vectorized RANGE frame boundary search for a single primitive column [datafusion]
via GitHub
-
Re: [PR] feat: add CollectLeft partition mode to SortMergeJoinExec [datafusion]
via GitHub
-
[PR] Add branch-55 protection [datafusion]
via GitHub
-
[PR] Prepare for 55 release - version number, changelog [datafusion]
via GitHub
-
[PR] refactor: CrossJoinStream (simplifying, less state, async) [datafusion]
via GitHub
-
Re: [PR] refactor: CrossJoinStream (simplifying, less state, async generator pattern) [datafusion]
via GitHub
-
Re: [PR] refactor: CrossJoinStream (simplifying, less state, async generator pattern) [datafusion]
via GitHub
-
Re: [PR] refactor: CrossJoinStream (simplifying, less state, async generator pattern) [datafusion]
via GitHub
-
Re: [PR] refactor: CrossJoinStream (simplifying, less state, async generator pattern) [datafusion]
via GitHub
-
Re: [PR] refactor: CrossJoinStream (simplifying, less state, async generator pattern) [datafusion]
via GitHub
-
Re: [PR] fix: preserve concat binary string bytes [datafusion-comet]
via GitHub
-
[I] Boolean-to-decimal cast produces invalid Decimal128 when 10^scale does not fit precision [datafusion-comet]
via GitHub
-
Re: [I] Delegate int/float/boolean to decimal cast arms to arrow safe cast [datafusion-comet]
via GitHub
-
[PR] chore: Expand dependabot coverage [datafusion]
via GitHub
-
[PR] chore: Update depcheck toolchain and dependencies [datafusion]
via GitHub
-
[I] [Follow-up #23696] Extract generic empty-row-group stripping from strip_empty_row_groups [datafusion]
via GitHub
-
[I] Load and cache Parquet page indexes only for the columns and row groups a scan needs [datafusion]
via GitHub
-
[I] [Follow-up #23696] Extract the initial push-decoder setup into a named struct [datafusion]
via GitHub
-
[PR] perf: optimize non-null FixedSizeBinary grouping [datafusion]
via GitHub