{"avoid_when":"单机数据帧已够","content_hash":"9fd61709b5c4a3b4b85e582051be26c3acc52a72df5df0e4302979ce7eb0036b","domain":"data-ml","evidence_urls":["https://github.com/apache/spark"],"id":"apache-spark","language":"Scala","license":"","name":"Apache Spark","niche":"distributed data","repo":"https://github.com/apache/spark","source_updated_at":null,"status":"active","summary":"大规模分布式数据处理引擎。","tags":["bigdata","etl"],"use_when":"集群级批/流数据处理","verification_status":"unverified","verified_at":null}
