文章分类 - 网站运维
Linux 上生成硬件信息与配置报告: Sysreport
摘要:今天才注意到 Linux 上这个 Sysreport 工具。当需要 Linux 主机详细完整的描述给另一个人的时候,这个工具非常适合。用 root 用户之行,但要注意最好不要抓取 currently installed packages 信息,这一步非常慢。(用 -norpm 参数)存储厂商 EMC 也有个 EMCgrab 工具,工作原理类似,额外抓取了存储相关的信息而已。估计各家存储厂商都有,...
阅读全文
Unix/Linux 的 Load 初级解释
摘要:几乎每个接触类 Unix 操作系统的工程师都知道如何查看系统负载。但这东西的工作机理到底是怎样的,可能没有多少能说清楚。对比了一些相关信息,加上自己的理解,做一下笔记。什么是 Load ? 什么是 Load Average ? Load 就是对计算机干活多少的度量(WikiPedia: the system load is a measure of the amount of work that ...
阅读全文
Ratproxy -- Google 的 XSS 检测工具
摘要:跨站脚本攻击(XSS, Cross Site Scripting) 可能是目前所有网站都比较头疼的问题,Google 也不例外。这次 Google 又做了一次雷锋,把内部用来审计 XSS 的工具开源了:ratproxy。Ratproxy 工作流程:1) 运行脚本后,会在本地启动一个代理服务器,默认端口是 8080 ;2) 浏览器设置这个地址 (http://localhost:8080)为 代理地...
阅读全文
网站运维之道 关于可用性
摘要:什么是网站运维(Web operations) ?运维,绝不是某些人眼中安装系统、做几根网线那么简单? 除去应用开发和业务运营之外的保障网站能运转的事儿都可能是运维工作的职责范围。运维的工作包括(但不限于) 软硬件部署、网络管理、应用程序维护、安全、容量规划、故障修复等等。运维,有别于"运营"。在中文的语境中,运营更多和业务结合在一起的。而运维,则是偏向技术层面。任何一个成功的站点都离不开一只优秀...
阅读全文
网站运维之道 之容量规划
摘要:容量规划有效的监控能够避免绝大多数问题的扩大化,但是还是做不到防患于未然。监控告警机制完善后,就需要着手考虑容量规划(Capacity Planning)的问题。所谓的容量规划,也就是一个公司为了满足商业目标的需求而决定生产能力的过程。俗语说,"人无远虑,必有近忧",容量规划,需要的是"远虑"。对应到运维的工作上来,一方面是商业目标带来的容量需求,一方面是针对相关历史数据的分析带来的预测。这里的历...
阅读全文
网站运维之道 之流程规范
摘要:流程规范对于相对正规的网站维护工作,所有网站的所有变更必须能做到有记录,可回溯。如果是单枪匹马作战,那么要实现这个目标并不是很难,只需要把好习惯培养起来就成了,可如果要面对一个团队,那么就必须要依赖流程规范来进行约束。所谓"流程规范",在初期也可以拆开来对待:流程 + 规范(废话!)。关于流程(Process),直白的说就是"把大象放入冰箱需要几步?"的问题。比如上线一台服务器,那么可能要经过至少...
阅读全文
网站运维之道 之知识管理与积累
摘要:所谓"知识管理与知识积累",其实有点绕,我们不如就说说"运维技术文档"的事儿吧,这样可能还直白一点。因为每次说起类似的话题,总有兄弟用不屑的语气说,不就是写写文档的事儿么? 运维友好的文档不同的团队对文档要求可能都有不同的"风格"--更多的时候是运维主管要看着舒服。就运维来说,必须能够创建"运维人员友好"的文档。一般来说,运维文档应该具备如下特点:易读性 便于阅读,便于技术人员阅读。尤其是内容不应...
阅读全文
网站运维之道 监控与报警机制
摘要:监控机制定义了网站可用性指标,如何获取网站的可用值? 监控工具该粉墨登场了。多数网站都会倾向于利用开源软件自行搭建监控平台。笔者一向认为,即使网站有一台服务器,也应该搭建监控工具,这是保障网站能持续改进的基石。常见的开源监控工具有Nagios(www.nagios.org)、monit(www.tildeslash.com/monit)等。Nagios也可能是当前国内最被广泛采用的监控软件了,根据...
阅读全文
浙公网安备 33010602011771号