首页(175) 数据挖掘研究(27) 数据挖掘实践(53) 数据挖掘介绍(25) 杂谈(59) 管理页面   写新日志   退出   关于IDMer

 Blog信息
 
blog名称:IDMer (数据挖掘者)
日志总数:175
评论数量:848
留言数量:119
访问次数:2489310
建立时间:2005年6月24日

 日志更新
 

 我的相册
 

It's me!


 最新评论
 

 留言板
 

 链接
 

 联系方式

 日志搜索





 公告
“数据挖掘者”博客已经搬家,欢迎光临新博客网址:http://idmer.blog.sohu.com
我的新浪微博:
@张磊IDMer
 网络日志
   
给DMman的回复 
数据挖掘者 发表于 2007/5/21 22:22:59
张前辈:您好!    我是中国海洋大学一名研一生,专业是数据库。我想自己选择一门方向,认真的学习,作为终身职业。譬如 java程序员、数据挖掘人员、数据库管理人员等等。我比较喜欢数据挖掘,但是若干问题难以释惑。 问题1:现在选择数据挖掘作为终身职业是明智之举吗?   现在网上对数据挖掘的前景讨论的很厉害,褒贬不一。但是至少可以确定的是数据挖掘已经越来越被重视了。如你所言,大家看到的只是表面,许多成功的案例企业没有对外公开。但不可否认的是,数据挖掘在中国的应用有屠龙之技的嫌疑,广大的企业还没有重视起来。  总之,男怕投错行,这个问题总是敲击着我。如果我是您的弟弟,您会鼓励我走数据挖掘之路吗?还是推荐其他的IT职业?  IDMer:   就我个人的观点,数据挖掘的发展还是前途很广阔的。说白了,数据挖掘就是一种分析问题的手段,问题一直会有,解决问题的手段也就一直有存在的必要。也许你听说过美国早期西部淘金热的时候,富起来的不是淘金者,而是为淘金者提供工具、水的人,甚至因为矿工需要结实耐磨的衣服,以致于牛仔裤风行起来并经久不衰。   至于你提到“屠龙之技”之说,只是很多人因为不熟悉数据挖掘的内部技术而产生的莫测高深的感觉。其实,数据挖掘本身并不是新技术,它融合了来自于统计学、数据库和机器学习等多学科已经成熟的内容,冠上了一个看起来比较时髦的名字而已。  组成数据挖掘的这三门支柱学科都已经发展了多年,也已得到了广泛的应用。那么我们也有理由相信它们的融合,能帮助我们解决更多的分析方面的问题。何况,业界还是有很多的成功案例,体现出数据挖掘所带了独特优势,而这些,是传统的BI(报表、OLAP等)无法支持的。     以上说了不少数据挖掘的好话,下面再看看硬币的另一面。如果你是我的弟弟(呵呵,虽然我没有,但也和很多年轻的师弟师妹聊过择业的话题),我会建议你不做IT业,哈哈,一句半真半假的玩笑。因为在IT这个行业看起来还是满辛苦的,而且在很多项目中,常常需要重复一些没什么技术含量的任务,消耗的精力不少,获得的成就感却不多。     Anyway,我的建议,其实也是我原来给自己的一句座右铭:认为对的就去做。找到自己的兴趣所在,并且感觉也有发展,那就尽力去做好了。问题2:如果我现在选择了数据挖掘,应该怎么做?    您曾经在博客上回复一位北邮同学,建议熟悉学习各种算法;建立模型,创新思路改进算法撰写论文。    我当前的计划是 学习各种算法的原理;学习java语言;研究weka源码,深入了解几种经典算法的步骤;学习了解ETL,数据仓库、OLAP等;通过使用的数据集建立挖掘模型;思考论文;有空的话 还得SPSS或其他一个流行软件的使用方法。其中,我觉得难点是对数据集的整理形成挖掘流程的输入。    其中,我也有若干疑惑:掌握一门数据库是很重要的,但是没有时间一一了解SQL Server、Oracle、DB2等,但是在求职时,又说不定单位要求会哪门数据库!?我想就SQL Server单独进行深入的学习,包括学习在SQL Server中数据仓库的建立和数据挖掘的应用,其他的也就不管了。不知我这个选一而弃其他的打算可取不可取?  IDMer:   从你的计划来看,还是对自己要掌握的知识和技能,划出了一个范围。看上去还不错,我只是从个人的经验出发,建议你不必苛求自己十八般武艺样样精通,很多方面只需基本了解,选择几个重点来练成自己的绝活。人的精力毕竟有限,目标越大就越难实现。   至于选择那些作为重点,就需要在广泛了解的基础上,结合自己的兴趣进行筛选了。   关于数据库的掌握,我觉得熟悉一种产品已经足够。SQL Server、Oracle、DB2都是关系数据库,在学生阶段把关系数据库的基础理论打牢,熟练运用SQL语句就可以了。这些主流数据库之间的差异,不是遵循的标准不同,而是产品的特性有别,以及在性能调优时的技巧。问题3:如何使学习阶段与行业应用靠拢?    有一位学长,建议我学技术的时候要和行业靠拢,否则,“没有行业背景的技术会很飘”。我觉得他说的有道理,技术是相当宽泛的,你不可能面面俱到;而且,当你实际工作后,也就专于一个行业,技术的需要面也就变窄了。这样,有利于学习重点,不至于在学习时,面面俱到,没有突出。    但是,在数据挖掘方面,曾经请教过你,数据挖掘人员的工作性质。一种是在甲方做分析人员,利用所掌握的数据挖掘知识来解决一些业务问题。一种是在IT公司,为甲方实施DM、DW和BI等项目(前辈自己便属于此类?)。    在这里,我不太明白作为甲方,日常具体做些什么?难道是类似于网管性质的?那样不更倾向于数据库管理人员?他们还算是专业的数据挖掘人员吗,怎么觉得公司不大会安排这样的职位呢?    我比较倾向于做乙方,那样好像更专业似的。但是,乙方的话,都说数据挖掘在金融、电信、银行还是销售等方面主要应用。难道这意味着要学习或了解金融电信的背景、CRM、经济学、Excel……?    还有,您曾提到,毕业后也可以做研究工作,我觉得提供研究工作的岗位毕竟是少的。而且,那样挣钱多吗(流汗中)?    是否现在应该考虑以后进哪个(哪类)公司,现在根据它的要求来强化自己呢?  IDMer:   你这位学长说得没错,脱离实际的纯理论大多会消散于无形。至于甲乙方的区别,实际上也没有想像中那么大,特别是对于刚刚参加工作的基层员工来说,可能差不多。   先在乙方历练几年,然后跳到甲方,这种状况我看到不少。也许是因为在乙方接受的锻炼和学习到新知识经验的机会更多些吧,可以在年轻时有更多的积累。当然,如果有很好的在甲方工作的机会,也是不错的选择。   到乙方工作,特别是对一直待在校园里的应届生来说,招聘方重点考察的大多是你的知识是否扎实、性格是否有利于融入团队等方面。至于对行业的了解,一般很少有过多的期望,除非你有多年在相关行业做项目的经验。   国内的研究机构还是以科研院所和高校为主,待遇一般要比公司低,但也有很多人,包括我的师兄师姐以及同学,选择了继续做研究,因为他们会从研究中获得很多乐趣。另外一些研究机构是企业特别是外企的研究院,待遇也很好,但就要求你很出色才有机会加入。做研究还有一个很好的地方,就是国外的院校或研究所。   后记:觉得自己的提问没有意义,好像有些是明摆着的问题,又抑或是些不值得回答的问题似的。前辈若有时间,还望指点一二。我不急,若忙的话,啥时候回复都可以。    致谢!   DMman 2007-5-13

阅读全文(17521) | 回复(9) | 编辑 | 精华
回复:给DMman的回复
fanchen(游客)发表评论于2009/4/15 20:17:31
张老师,您太热心了,我感觉这篇回复太有价值了,尤其是对我们这些刚刚接触数据挖掘的学生来说,今天看了这个网站上的一些帖子,包括您IDMer、DMman(我海大的师哥),还有一个DMFighter,这些都是我学习的榜样,感谢您-我们的领路人,呵呵 以下为blog主人的回复: 呵呵,不客气,you are welcome!

个人主页 | 引用回复 | 主人回复 | 返回 | 编辑 | 删除
回复:给DMman的回复
游客(游客)发表评论于2008/10/9 19:57:56
感谢
个人主页 | 引用回复 | 主人回复 | 返回 | 编辑 | 删除
回复:给DMman的回复
清风(游客)发表评论于2008/10/1 21:58:01
每一个回复都是经典,是年轻的DMman的旅途航标,感谢IDMer的热心。
个人主页 | 引用回复 | 主人回复 | 返回 | 编辑 | 删除
回复:给DMman的回复
路人乙(游客)发表评论于2008/8/22 13:38:35
怎样在实际环境中应用数据挖掘呢? 如果采用专门团队进行开发来实现数据挖掘,感觉周期和风险太大(而且本人对JAVA开发不熟,只有进行C/C++开发的经验)。 如果想在数据挖掘中拿出对企业公司有价值的回报,应该怎么做? 以下为blog主人的回复: 大可不必自行开发数据挖掘软件,比较实际的做法是采用商用数据挖掘工具,实施一期数据挖掘项目甚至是POC(概念验证),就可以得到一些对企业有价值的东西。当然,也有可能证明数据挖掘还不适合您企业的现状。
个人主页 | 引用回复 | 主人回复 | 返回 | 编辑 | 删除
回复:给DMman的回复
Ray(游客)发表评论于2008/4/19 22:54:23
赞! 您发此篇BLOG的意义 觉不亚与您在EI上发表篇文章   您让千万大学生都受益非浅  
个人主页 | 引用回复 | 主人回复 | 返回 | 编辑 | 删除
回复:给DMman的回复
巧遇(游客)发表评论于2007/7/2 23:58:28
谢谢学长的指导,我也是受益者了!
个人主页 | 引用回复 | 主人回复 | 返回 | 编辑 | 删除
回复:给DMman的回复
数据挖掘青年发表评论于2007/5/22 14:45:49
非常感谢,醍醐灌顶,受益颇深! 我爱IT,我不怕辛苦,我要为它奋斗终生! 数据挖掘,我把青春献给您! 再次感谢前辈的详细指导! 以下为blog主人的回复: You are welcome!
个人主页 | 引用回复 | 主人回复 | 返回 | 编辑 | 删除
回复:给DMman的回复
数据挖掘青年发表评论于2007/5/22 14:38:00
是啊,比我动作都快许多,呵呵
个人主页 | 引用回复 | 主人回复 | 返回 | 编辑 | 删除
» 1 2 »

发表评论:
昵称:
密码:
主页:
标题:
验证码:  (不区分大小写,请仔细填写,输错需重写评论内容!)


站点首页 | 联系我们 | 博客注册 | 博客登陆

Sponsored By W3CHINA
W3CHINA Blog 0.8 Processed in 0.422 second(s), page refreshed 144765921 times.
《全国人大常委会关于维护互联网安全的决定》  《计算机信息网络国际联网安全保护管理办法》
苏ICP备05006046号