1.技能 如果你有兴趣成为数据科学家,你应该在日常工作中胜任和能够运用以下技能。 2.编程 作为数据分析师,具有编程能力很重要。曾经很多次你使用过非编程工具,如Excel,但是较好和较常用的一些工具,以及其他一些库,都是基于编程的。使用这些基于编程的工具,你能够做更深入、更高效的分析。由于流行度高,Python和R都是很好的入门编程语言。 3.统计学 较低要求,你应该能理解基本的统计描述和统计推断。你应该理解分布的不同类型,哪种统计检验适用于哪种文本,还要能够在面试中解释线性回归的基础知识。 4.机器学习 如果你有大量数据,机器学习中的技术是难以置信的强大。你需要用这些数据去预测未来,或者给出合适的建议。你应该懂得一些较常用的监督学习和非监督学习的算法(他们是两种不同类别的机器学习算法),比如k较近邻算法、支持向量机和k均值聚类。你可能不必懂得这些算法背后的理论和实现细节,但知道什么时候使用这些算法很重要。 5.数据清理 在理想的世界里,你面对的数据集是干净的、准备好进行分析的。然而,现实世界中,绝少是这样的。你的数据集很可能缺失数值、格式错误、或者输入错误。例如,让我们讨论一些日期,一些系统表示2014年9月1日为9.1.2014,其他一些系统会表示为09/01/2014。像这样的情况,你的数据清理技能会派上用场。 6.沟通和数据可视化 作为数据分析师,你的工作不仅要解释数据,还要同其他利益相关者高效交流你的发现,这样你就能帮他们做出数据提供的决策。许多利益相关者不会对你的分析背后的技术细节感兴趣,这就是为什么你能通过易于理解的途径交流和展示你的发现很重要。 本文来自上海西线学院官/ 高薪等你来拿,快来报名吧!