结论先说:两种方式读的是同一批 Parquet,Pandas 常见写法会先把数据整理成一张大表塞进内存, DuckDB 是边扫描边聚合,只把最终的小结果表交给你——仓库里的文件越多、每个文件越大,这个差距越明显。
DataManager.query()
GROUP BY symbol