折腾windows 8和ubuntu 12
By 苏剑林 | 2012-08-30 | 20638位读者 | 引用这是一篇用Windows 8完成的文章。
快开学了,华师2号就要报道了,所以就提前入手一台手提电脑,联想Z575AM-ASI,四千元的AMD,4核,64位机器。
我的台式机已经是六年前的产品了,联想的家悦系列,只有512MB内存。所以相比之下,这新机器配置还过得去吧,对于CPU,我个人还是倾向于AMD的,因为我的那台家悦台式也是AMD的CPU,所以对它很有好感。新兴的联想专卖店没有AMD手提,所以还得提前向他们预订。
Windows8
手提本身没有预装操作系统,专卖店很随手地为我装了一个win7,而且还只是ghost版本的,时不时会卡死,感觉很不好,刚好前些日子在网上开始发布Windows8了,所以就马上把Win7格掉,装上Windows8了。安装过程很顺利,由于还没有正式发布,所以还没有激活,这段时间纯粹体验中。等正式版发布了,再计划买一个正版光盘吧
2012诺贝尔奖...
By 苏剑林 | 2012-10-11 | 36743位读者 | 引用又是一年诺奖公布时......每年的这个时候,诺贝尔奖又会被热门地提及到,现在三个自然科学方面的奖项都已经公开了。简略收集如下:
诺贝尔生理学或医学奖
京都大学物质-细胞统合系统据点iPS细胞研究中心主任长山中伸弥(Shinya Yamanaka)、英国发育生物学家约翰-戈登因(John B. Gurdon)。
原因:在细胞核重新编程研究领域的杰出贡献而获奖。所谓细胞核重编程即将成年体细胞重新诱导回早期干细胞状态,以用于形成各种类型的细胞,应用于临床医学。细胞核重编程指细胞内的基因表达由一种类型变成另一种类型。通过这一技术,可在同一个体上将较容易获得的细胞(如皮肤细胞)类型转变成另一种较难获得的细胞类型(如脑细胞)。这一技术的实现将能避免异体移植产生的排异反应。
校外通过VPN通道访问华师资源
By 苏剑林 | 2013-01-23 | 37954位读者 | 引用在学校使用校园网时,是很容易访问到华师内部的各个网站的,比如教务系统、图书馆电子资源等,但是如果使用校外网或者是在家时就不那么容易了。另外一种情况是,期末同学回家了,很想早点知道成绩,一般我们会上http://jwc.scnu.edu.cn查询,这个网站在校内校外都可以登陆,但是通常来说为了成绩的录入,会把成绩查询功能关闭掉一段时间,事实上,大部分的成绩都已经录入了。在校园网时,心急的朋友可以访问http://222.201.93.5:211来查询,可是这个网址在校外是不能用的。VPN通道就是为这些校外需求而开通的。
使用方法很简单,打开
https://121.8.171.37/
输入校园卡的账号密码登陆就行了。登录后就会出现校内网的各种链接,包括图书馆资源、教务系统等等。
视频演示:费曼的茶杯
By 苏剑林 | 2014-02-07 | 18794位读者 | 引用【备忘】访问Google的方法(更新)
By 苏剑林 | 2014-06-04 | 80693位读者 | 引用把Python脚本放到手机上定时运行
By 苏剑林 | 2015-10-21 | 41797位读者 | 引用毫无疑问,数据是数据分析的基础,而对于我等平民来说,获取大量数据的方式自然是通过爬虫采集,而对于笔者来说,写爬虫最自然的方式就是用Python写了。短短几行代码,就可以完成一个实用的爬虫,多清爽。(请参考:《记录一次爬取淘宝/天猫评论数据的过程》)
爬虫要住在哪里?
接下来的一个问题是,这个爬虫放到哪里运行?为了爬取每天更新的数据,往往需要每天都要运行一次爬虫,特别地,是在某个点定时运行。这样的话,老挂在自己的电脑运行是不大现实,因为自己的电脑总有关机的时候。也许有读者会想到放在云服务器里边,这是个方法,但是需要额外的成本。受到小虾大神的启发,我开始想把它放到路由器里边运行,某些比较好的路由器是可以外接U盘,且可以刷open-wrt系统的(一个Linux内核的路由器系统,可以像普通Linux那样装Python)。这对我来说是一种很吸引人的做法,但是我对Linux环境下的编译并不熟悉,尤其是路由器环境下的操作;另外路由器配置很低,一般都只是16M闪存、64M内存,如果没有耐心,那么是很难受得了的。
ARXIV数学论文分布:偏微分方程最热门!
By 苏剑林 | 2015-11-13 | 31031位读者 | 引用笔者成功地保研到了中山大学的基础数学专业,这个专业自然是比较理论性的,虽然如此,我还会保持着我对数据分析、计算机等方面的兴趣。这几天兴致来了,想做一下结合我的专业跟数据挖掘相结合的研究,所以就爬取了ARXIV上面近五年(2010年到2014年)的数学论文(包含的数据有:标题、分类、年份、月份),想对这几年来数学的“行情”做一下简单的分析。个人认为,ARVIX作为目前全球最大的论文预印本的电子数据库,对它的数据进行分析,所得到的结论是能够具有一定的代表性的。
当然,本文只是用来练手爬虫和基本数据分析的文章,并没有挖掘出特别有价值的信息。文末附录了笔者爬取到的数据,供有兴趣的读者进一步分析研究。
整体情况
这五年来,ARXIV的数学论文总数为135009篇,平均每年27000篇,或者每天74篇。
最近评论