亚捷
亚捷Lv1
最近在搞数据清洗,发现Pandas和Spark的区别真的挺明显的...Pandas适合小数据集,处理起来快狠准,但数据量一大就卡得不行;Spark批处理能力更强,但语法有点绕,调试起来头大。你们都是怎么选的呀?