以下是网站 do1234.com 在 2014-07 的历史页面存档,小提示:CTRL+U 查看源码
本站和 do1234.com 的作者无关,不对其内容负责。本历史页面谨为网络历史索引,不代表被查询网站的即时页面。 *号[x]表示已屏蔽显示的敏感字。
原网页标题:来自星星的博客 - 莫山SEO随笔,数据分析_吐槽:我说的都是错的
"View all posts by 莫山" rel="author">莫山

微信总裁张小龙内部邮件诠释产品七大价值观

腾讯公司宣布成立微信事业群(WeiXin Group,简称WXG),张小龙出任微信事业群总裁。微信事业群负责微信基础平台、微信开放平台,以及微信支付拓展、O2O等微信延伸业务的发展,并包括邮箱、通讯录等产品开发和运营,致力于打造微信大平台,为用户和合作伙伴创造更多价值。

以下为张小龙今天发出的内部邮件全文,并诠释了七大价值观,值得我们思考:

微信BG的兄弟姐妹们,

想必大家都已看到公司发文的消息:今天,微信BG正式成立,将负责以微信为基础建设移动互联网社交、开放与O2O平台,为用户提供即时通信与线上娱乐、生活和商业化的综合性服务,创造更多价值。这意味着微信已完成第一阶段的孵化,从产品升级为腾讯战略级的业务体系,全面助力公司在移动互联网领域发挥更大作用。

2010年10月微信立项,2011年1月微信发布第一版。我们从QQ邮箱团队分出一支10个人的小团队开始起步,成长到现在的微信BG。微信的用户量,也成长到几亿之大。我们欣喜看到移动互联时代,微信融入了几亿人日常的线上生活,让时间和空间在这个时代有了新的涵义。在此,我要特别感谢每位微信同学的全力付出,并且为大家在这三年里面创造的微信之旅感到骄傲!

新的BG,也吸纳了ECC和财付通的一些团队。欢迎新同学的加入!

作为一个新的业务团队,我也希望之前微信团队的一些理念能继续保持和发扬。这些理念,其实也是公司一直倡导的。在这里总结几点。

1,做对用户有价值的事情。

我们经常会在各种权衡中做取舍,在任何时候,我们都要想,这个事情是不是从用户价值本身出发的来考虑的。如果我们想的策略和用户价值有违背,哪怕舍弃短期利益,也应该维护用户价值。让用户看到你的努力,而不是同事和上级。

2,保持我们自身的价值观,因为它会体现在我们的产品和服务中。

解决纷争时,它会帮我们做出决定。如果我们认为用户不能被骚扰,我们就不会在产品中做出骚扰用户的行为。如果我们没有一致的价值观,我们的产品和服务就会割裂为利益的集合体。不做个人价值观和产品价值观的双面人。

3,保持小团队,保持敏捷。

希望我们在BG成立规模变大后,还能保持小团队心态,避免陷入官僚化和流程化里面。我们曾经禁止写PPT,认为那是形式化的体现。这有些武断,但目标是效率的最大化。我们还将继续限制招聘的人员数目,只招聘最优秀的人员加入团队。对一个优秀团队来说,人员也是少比多好。

4,学习和快速迭代比过去的经验更重要。

移动互联网变化太快,我们的产品和业务思路,也希望是面向新的环境而产生。

5,系统思维。

记住我们的愿景:连接人,连接企业,连接物体。让它们组成有机的自运转的系统,而不是构建分割的局部的商业模式。我们专注于基于连接能力的平台,并将平台开放给第三方接入,和第三方一起建造基于微信的人和服务的生态系统。系统思维也会帮助我们建造透明公正的商业体系,让系统在规则下运转,避免人为的干预。

6,让用户带来用户,口碑赢得口碑。

用互联网的网状传递效应来推动产品和服务。一个例子是一个小小的飞机大战可以引发一场手机游戏的风暴。我们处在一个人人互联的时代,如果我们能让一个用户说好,这个口碑就会传播出去。将我们的创造力体现在各个细节中。创意不是宏图大略,而在于我们每天工作的点点滴滴,用户都能感知到。

7,思辨胜于执行。

执行力很重要,但更希望我们的日常工作是一个思辨的过程。我们提倡争论,在工作中通过辩理来找到正确的解决方法,而非为了团队利益或者人际关系放弃思辨能力甚至思辨习惯。进步来自思辨。

这些朴素的价值观,希望能融入到我们团队的日常工作中。

过去的三年,是微信从无到有的成长的三年。未来的三年,希望微信能成长为一个真正的具备开放能力的系统,并培育出健康的生态。

“微信因你而美“,这是我们去年年会的主题,也以此来感谢大家。在新的微信BG下,相信我们会一起努力,让我们的产品和服务做得更好!

allenzhang

中小型网站日志分析深入浅出之SEO实战

这篇博客里面的内容全部吸收的话,日志分析这一块就能按照你能想到的维度来分析了。当然任何好事都需要付出才能得到,想要吸收所有内容,必须学习shell这门脚本语言的一小部分命令符的使用,当然学一门语言的一小部分内容是个很简单的事情哈。市面上那些的日志分析工具都是个摆设,包括光年的那个。我们可以按照各种我们想到的维度对数据进行拆分组合。得出我们想要的结果,并不止在SEO领域,其他在运营等各个领域都有用处。

1、在Windows下的用户要使用shell命令符的话请先安装cygwin,安装方法自行Google(搜技术问题请使用google,百度搜不到活该)。

2、下面笔者粗略介绍下SEO日志分析常用的命令符用法,需要详细了解每个命令符请使用Google

  • less  log.log   查看文件内容  按“q” 退出
  • cat  log.log   打开文件,可以多次打开几个文件 |     cat 1.log 2.log   |cat *.cat
  • grep -参数  文件名
    1. -i 不区分大小写
    2. -v 显示不符合条件的所有行
    3. -c  显示符合条件的所有行数(符合条件的数量)
  • egrep 属于grep的升级版,在正则这一块的支持更完善,使用正则的时候建议使用egrep
  • head -2   显示2行
  • head -100  log.log  | tail -10 >>a.log   提取文件第91-100行数据
  • wc -参数   文件名      统计文本大小,字符多少,行数
    1. -c 统计文本字节数
    2. -m 统计文本字符数
    3. -l 统计文本有多少行
  • sort  - 参数 文件名      对文件进行排序
    1. -n 对文件按照数字排序
    2. -r 反向排序
  • uniq -参数      对文件去重,去重前需要使用排序sort
    1. -c  显示数据重复的次数
  • split  -参数  文件名       对文件进行切割
    1. -100   (每100行切割成一个文件)
    2. -C    25m/b/k   (每25兆/字节/K 分割成一个文件)
  • |    管道,把上一条命令的结果传输给下一条命令
  • “>” 和“>> ” 重定向写入文件中 “>”相当于“w”清空并写入   “>>”相当于“a” 追加进文件 
  • awk -F  Pattern {action}  文件名     使用指定的字符对每一行数据进行分段,默认是空格(网站日志就是空格分开)
    1. -F后面跟的是分隔符
    2. pattern 就是action执行的条件,这里可以使用正则表达式
    3. $n 即时第几段数据  $0表示整行数据
    4. NF表示当前记录的字段数
    5. $NF 表示最后一个字段
    6. BEGIN和END,这两者都可用于pattern中,提供BEGIN和END的作用是给程序赋予初始状态和在程序结束之后执行一些扫尾的工作
    7. 案例:$ awk ‘{print $10}’ baidu.log |awk ‘BEGIN{total=0}{total+=$1}END{print total}’  计算baiduspider下载文件总大小
  • bash shell.sh   运行shell.sh脚本
  • nslookup ip   查询地址是否是百度蜘蛛
  • dos2unix   xxoo.sh 将“\r\n”转换成“\n”   Windows——>linux (由于Windows和Linux下的换行符不同,所以我们在Windows下面下的代码需要使用dos2unix 转换成Linux下的换行符,否则运行shell脚本会报错)
  • unix2dos    xxoo.sh 将“\n”转换成“\r\n”  linux——>Windows
  • rm xx.txt  删除xx.txt文件

3、一些简单的命令符介绍到这里,需要了解shell,建议大家查看相关的书籍,下面我们开始使用shell分析日志。

日志格式如下:
less baidu.log

1 中小型网站日志分析深入浅出之SEO实战

1、切割百度的抓取数据(将文件切割出来对专门的蜘蛛进行处理能提高效率)
cat log.log |grep -i ‘baiduspider’ >baidu.log

2、网站状态码个数查询(隐藏的是状态码个数)
awk ‘{print $9}’  baidu.log|sort|uniq -c|sort -nr

3、百度总抓取量 
wc -l baidu.log

4、百度不重复抓取量
awk ‘{print $7}’      baidu.log|sort|uniq|wc -l

5、百度平均每次抓取的数据大小(结果是KB)
awk ‘{print $10}’   baidu.log|awk ‘BEGIN{a=0}{a+=$1}END{ print a/NR/1024}’

6、首页抓取量
awk ‘$7~/\.com\/$/’   baidu.log|wc -l

7、某目录抓取量
grep   ‘/news/’   baidu.log|wc -l

8、抓取最多的10个页面
awk ‘{print $7}’ baidu.log|sort|uniq -c|sort -nr|head -10

9、找出抓取的404页面
awk ‘$9~ /^404$/ {print $7}’ baidu.log|sort|uniq|sort -nr

10、找出抓取了多少js文件和文件抓取的次数(可以看出百度基本不抓JS)
awk ‘$7~ /.js$/ {print $7}’ baidu.log|sort|uniq -c  |sort -nr

相信看到这里大家已经有了想试一把手的冲动了,只要你搞懂了上述的内容,上面的操作都可以轻而易举的完成,没有任何困难,还可以有更多的维度进行分析,不仅仅是SEO领域。只要你敢想,就能挖掘更多的数据出来(当然更复杂的纬度可能需要学习shell更多的内容哟,当然,以我的努力程度之低都能做到的事情,大家应该都不是问题)。

根据不同的设备跳转到pc页面或者wap页面

随着互联网发展,现在网站基本上都有wap页面和pc页面两套,当给用户一个pc页面的URL的时候,用户使用移动设备访问的时候需要跳转到对应的移动页面,这时候需要做js跳转了,反之同理给用户wap页面URL,用户pc访问的时候需要跳转到wap页面,不过从seo这一块考虑,最好在服务器端使用302进行跳转,如果不会弄的情况下,可以考虑使用js。下面分享下代码(只正对域名不同其他URL结构相同的网站有用,复杂的需要根据实际情况来改动):

pc页面跳转到wap页面,代码放在pc页面上

 
<script type="text/javascript">  
var url = window.location.pathname;
var wapurl="http://3g.xxx.com"+url
if(/AppleWebKit.*Mobile/i.test(navigator.userAgent) || (/MIDP|SymbianOS|NOKIA|SAMSUNG|LG|NEC|TCL|Alcatel|BIRD|DBTEL|Dopod|PHILIPS|HAIER|LENOVO|MOT-|Nokia|SonyEricsson|SIE-|Amoi|ZTE/.test(navigator.userAgent))){
if(window.location.href.indexOf("?mobile")<0){
try{
if(/Android|webOS|iPhone|iPod|BlackBerry/i.test(navigator.userAgent)){
window.location.href=wapurl; 
}else{ 
window.location.href=wapurl;
}
}catch(e){}
}
}
</script>  

wap页面跳转到pc页面,代码放在wap页面上:

<script type="text/javascript">  
var url = window.location.pathname;
var pcurl="http://www.xxx.com"+url
if(/AppleWebKit.*Mobile/i.test(navigator.userAgent)==false || (/MIDP|SymbianOS|NOKIA|SAMSUNG|LG|NEC|TCL|Alcatel|BIRD|DBTEL|Dopod|PHILIPS|HAIER|LENOVO|MOT-|Nokia|SonyEricsson|SIE-|Amoi|ZTE/.test(navigator.userAgent))==false){
if(window.location.href.indexOf("?mobile")<0){
try{
if(/Android|webOS|iPhone|iPod|BlackBerry/i.test(navigator.userAgent)==false){
window.location.href=pcurl; 
}
}catch(e){}
}
}
</script>  

《舌尖上的中国2》是包藏祸心的毒草

《舌尖上的中国2》今晚播出第一集,没有电视机的我,生是用在线视频直播的方式看完了声音和字幕完全不同步整一集。

作为一名德高望重、德艺双馨的老同志,中国吃货界资深彩钻会员,皇冠持有者,虽然已经退居二线多年,看完视频之后,怒不可遏,不得不拍案而起,怒斥这部纪录片!

首先,《舌尖上的中国2》是包藏祸心的毒草,在观众沉迷于影像的同时,公然夹带私货,悍然私自宣布了咸豆花的合法性!众所周知,豆花究竟是吃甜还是吃咸,在我国互联网上是一件头等大事。甜党和咸党长期争论不休,造成了网民群体的族群分裂。

全靠我们一批吃货界老同志殚精竭力,呕心沥血,执中调和,才使得两部分网民平静下来,接受“一种豆花,两种表达;搁置争议,共同下筷”的方针。让我极度心痛的是,我们费尽移山心力好不容易创建出来的良好局面,一夜之间就被《舌尖上的中国2》彻底破坏。

第一集里面,尚未播放过半,就已经出现咸辣豆花,并且绑定夫妻情深。这是对豆花甜党的偷袭,更是豆花界的珍珠港事变!这一集播出之后,甜党和咸党的争议势必再次升温,文明、友好、和谐的中文互联网环境也必将遭到沉重打击。对此,我表示最强烈的遗憾。

其次,第一集给人的感觉整体太碎。谈及食物的来源和变迁,在一集之中提到了十几种不同的食材,食物更超过30种之多。如此走马观花、昙花一现,给人的感觉是高潮尚未到来,注意力就已经率先崩坏。

加上镜头的各种快速切换,多重叙事线路的并举,第一集失之慌张,略显草率。尤其是把食材的得来不易、传统家常小菜和食物的流变三条线并举,弹跳太强,让我这样的中老年观众觉得眼花缭乱,难以跟上进度。

最后,突入其来的人文关怀破坏了纪录片的节奏。许多吃货届的同志纷纷来电来微信投诉,说一边流口水,一边流眼泪的感觉实在太过怪异。大脑因为短时间内无法处理两种截然不同的情感,频频造成死机。

这里,我不得不提醒剧组:人类,是一种虚伪的动物。“君子远鲍厨”,那么,君子因此而少吃过一口吗?没有!君子说,食物割不正不食!诗人说“君看一叶舟,出没风波里”,诗人因此而不吃鲈鱼了吗?没有!君子说:要蒸得嫩一点,眼珠子爆出来就赶紧下屉。

不要让我在吃饭的时候感觉到任何焦虑,这是一切美食之所以成为美食的精髓,为此,我们宁可不进厨房看看究竟有多脏!

就这样,太生气了,必须去煮包方便面。

by:菜头叔

连黄网都找不到你还能干什么?

两周前,在前往深圳黄田机场的路上,听司机先生讲起那些嫖客的故事。说是一位客人上车,立即要求他直奔中国的性都东莞斯特丹。抵达东莞直接进桑拿房,请司机在楼下等着。45分钟后,这位仁兄意气风发又略带疲惫地下楼,上车返回深圳。司机先生说:“这一趟的士费就要800块,就为了那半个小时。”言下之意颇为客人觉得不值,我很不赞同司机先生的看法,但当时没有做任何反驳。

生存和繁衍,这是任何生物种群最为顽固和强大的需求。自人类发明避孕套之后,繁衍已经不再是重点,性成为了一种娱乐。即便如此,它的驱动力也依然异常强大。在我看来,力必多是否强劲有力,表征着生命力是否依然旺盛。如果这点心思都没有了,很难相信这个人还能做出点别的什么来。

所以,我理解不了所谓“找不到黄网”是什么意思。找不到,说明力必多不够强大,不足以促使一个人产生各种必要的行动。同样的,连黄网都找不到,连最强力和原始的驱动力都无法使得一个人产生行动,得到结果,那么我根本不相信这个人还能做点别的什么。除非,他无需上网满足这一部分需求,在现实中已经拥有了足够的供给。

我相信的确有许多人当真找不到黄网,这就是人生的一种。所以,他们用不了Twitter也就不用,看不了Youtube就不看,有天Gmail也无法访问了,他们可以写航空信。当然,你还会听到他们叫嚷说:我实在是没有方法呀!谁能教教我?

没有人应该去教这种人,他们确实也不需要某些方法。那些真正需要的人,他们一定能找到通路。黄网也好,Twitter也罢,并不会真有多大的障碍。因为这些人的人生中,早已经习惯了自行寻找解决方案。他们不会坐等,也不会干嚎,而是挽起袖管,径直动手。这已经成为了人生的一种常态,遇见问题,解决问题,不等不靠。所以,他们的欲望会被得到尊重,总能得到满足。真心寻求,哪怕是一个黄网,你总是能找到的。而且,这种找寻过程会上升为个人处世的方法论,在其它事物上同样得到体现。

一个连黄网都找不到的人,大概也就不能希望他可以创造出点什么新鲜玩意,发表什么新鲜见解。他们是最失败的填鸭学生,最失败的板凳员工,需要在屁股上来上一烙铁,才能勉强往前挪动一小步。我丝毫不怀疑,他们没有多少活泛气,对于他们而言一天就是一世,所以天天雷同,世世如此。因为对人之大欲,都是这样一种态度和行动力,那就别去奢望他们在其它小欲望,小任务,小目标上会有什么过人的表现。

今天,找不到一个黄网,至少说明这个人缺乏一套方法论。寻找的过程中有障碍,找不到意味着没有克服困难的能力。而能力不足反应的是意愿不足,一个人想钱想疯了,最后多少也能赚点骗点抢点,钱夹的皮革、银行的厚壁、保险箱的钢锁,都不会成为问题。最怕的是小孬,说不想也想,说想又懒得动弹,那么这种人就应该交给老天,让天养活。什么时候老天慈悲,兴许会空降一个充气娃娃下凡,所有问题也都解决了。

而对于那些一贯能够找到出路找到方法的人来说,能否访问黄网不是问题的关键,是这种意愿以及贯彻意愿的行动本身,使得他们能在这个世界上强悍地活下去。如同一个个工兵,逢山铺路、遇水搭桥。十年二十年之后,各人所取得的进境因此而完全不同。百年之后,各人成就的一生会因此而大不相同。

在墙外看到的风景,正应了那句话:相逢的人总能相逢。这无非是因为所有最终能够相逢的人都具备相同的人生态度,故而有相同的行动能力,最终也就总能成为幸福的少数人。他们和自己作战,和不可能作战,这种人生态度如同无法阻遏的力必多一样,驱动他们走上前去,走到一起,走进风景。

而那些连自己的欲望都无法尊重和实现的人,还能干点什么?

by:菜头叔

python计算关键字长度

有时候我们会根据关键字长度对关键字进行分类,分享下使用python的实现方式:

1.主要使用python的len()函数计算每个字符的字节数,由于中文一个字为3个字节(utf-8编码下),英文为1个字节,所以这里的处理需要区别对待,我想到的办法是分别处理两种状态,使用正则表达式的\w和\W来提取中英文。

2.排序,计算好每个关键字长度后,需要对其进行排序,这里使用了字典排序功能,关键字做key,关键字长度做value(需要注意的是不可以使用关键字长度做key,因为很多关键字长度是相同的,那么必然会被替换掉,这不是我们想要的,且关键字长度添加到字典里面去的时候必须是int(),否则排序时候不会当作数值处理)。

  
#coding:utf-8
#计算关键字长度并排序
#2014年4月11日 23:41:58
#by M.Shan
#需处理数据格式:关键字,URL
import re,csv
key=csv.reader(file('uz.csv','rb'))
key1=open('uz1.csv','w')
zidian={}
lists=[]
for line in key:
reges=re.compile(r'\w',re.M)
E=reges.findall(line[0])   #获取数字和英文
reges1=re.compile(r'\W',re.M)
C=reges1.findall(line[0])  #获取到中文
English= len(E)  #获取英文长度
China=len(C)/3   #获取中文长度,中文一个汉字3个字节,除以3得到汉字个数
length=line[0]+','+line[1]+','+`English+China`
lists.append(length)
for ls in lists:
ls=ls.split(',')
ls_value=int(ls[2])      #这一步必须转成int,否则下面的字典排序的时候不会当作数值处理,而是当作字符来处理,导致排序错误
ls_key=ls[0]+','+ls[1]
zidian1={ls_key:ls_value}
zidian.update(zidian1)
cc=sorted(zidian.items(), key=lambda d:d[1], reverse=True )   #字典排序之降序,针对字典value排序(d:d[1]), reverse=true为降序
for key in cc:    #keys()字典的键值
key1.writelines(key[0]+","+`key[1]`+"\n" )   #文件写入key1
print key[0]+","+`key[1]`    #分别输出里面的数
key1.close()

处理后截图:

111 python计算关键字长度

谈谈面试SEO岗位

本文局限在我个人经验。仅供参考,面试不上不要怪我。

说几个我面试会问的问题,以及常见的问题。

  1. 谈谈你是怎么做SEO?可以围绕个别细节单独展开

错误回答:只说改改页面,发发外链,写写内容,只做首页关键词排名,或者少数几个关键词排名的可以回去等通知了

正确回答:从用户角度考虑搜索习惯,构建网站结构,内容策略,观察数据。然后能够针对一个点展开回答的,例如如何收集词库,如何规划页面,是否有运营内容的经验,是否会收集分析数据都是加分项。

2. 如何判断一个网站SEO做的好不好?

错误回答:说看PR,百度权重,收录,外链,域名年龄的全部回去等通知

正确回答:首先看看这个网站各个网页的质量好不好,再看抓取收录是否好,最后看看还有没有提升的空间机会。满足更多用户需求。

ps.网页质量好不好从哪些角度呢?

3. 对待外部链接的做法?

错误回答:友链工程师,博客外链工程师,论坛外链工程师,信息平台外链工程师请回家等通知

正确回答:人为刻意的外部链接是搜索引擎极力反对的东西,外部链接应该需要引导用户推荐你,而不是自己去做,并且大型网站都不需要关注外部链接。当然,对于一些特殊行业例外,需要短平快的效果。(完全看自己的对SEO行业的涉及面了)

4. 平时个人从哪些地方学习SEO知识呢?

错误回答:x5,xz,xwhy,x密码,x艺术,某大神的全部回去等通知(这个好难隐藏)

正确回答:官方博客指南;搜索引擎原理,信息检索,信息结构,自然语言处理等相关书籍博客;某些黑客blog(=.=|||),外国的那些SEO网站大都没什么神奇的,只不过是上错误回答中那些网站的文章翻译成英文而已,花钱买VIP的我更加为你的钱包默哀。

5. 对其他技术有所涉猎吗?

错误回答:不会,只会简单的html的请回去等通知(平时都在干吗?)。

正确回答:技术类:php,python,.net,shell,sql,hadoop 产品类:用户体验设计,Axure/OmniGraffle,会写PRD,javascript/css,PS。哪怕Excel和PowerPoint做的比较好,都是加分项。

6. 是否有比较成功的SEO经验,不论大小?

这个就没错误回答了。有就有,没就有。自己做过有10000+流量的站(再高应该可以考虑不用上班了) > 自己做过几百流量网站 > 排上过一些热门关键词 > 排上过一些低竞争关键词 > 没有 > 我什么词都排得上去(请回去等通知)。

7. 期望薪资/什么时候来上班

。。。自行谈吧

by:夜息