我计划建立一个MySQL to Kafka流程,最终目标是安排一个流程,根据更改后的数据重新计算mongoDB文档。
这可能涉及直接修补mongoDB文档,或者运行将重新创建整个文档的进程。我的问题是,如果对MySQL数据库的一组更改都与一个mongoDB文档相关,那么我不想为每个更改实时地重新运行重新计算过程,我希望等待更改“结算”,以便只在需要时运行重新计算过程。
我想将mysql与hadoop中的一个项目集成起来。我搜索了很多不同的方法,有两种方法:实时使用mysql applier for hadoop和为非实时使用使用"apache“。Gora是实时还是不实时?gora和mysql应用程序或sqoop有什么区别?
对于hadoop和mysql的集成,是否需要任何nosql作为接口?