Kamus 在 论坛中说了一个问题:分析数据会影响Oracle使用RBO的判断?在讨论的最后,说到诊断事件 10053(cost-based optimizer tracing) 的 Trace 有的时候可能会忽略 Hint (?)
作者文章: Fenng
Nutch 初体验之二
前几天介绍了 Nutch 的基本信息 以及 如何使用 Nutch 进行 Intranet crawling。下面进行一下全网的爬行(Whole-web Crawling) 的操作测试。
Nutch 的数据包括两种类型:
- Web 数据库。包含所有Nutch可以辨别的页面,以及这些页面间的链接信息。
- 段(segment)集合. 每个 segment 是作为一个单元(unit)被获取并索引的页面集合。Segment 数据包括如下类型:
- fetchlist:指定待获取的一个页面集合的文件
- fetcher output:包含获取到的页面的文件集合
- index:fetcher 输出的 Lucene 格式的索引
注:如果发现有解释不清的地方,请参考这里,不过说实话,Nutch的文档远远不够完善,还存在很多语焉不详的地方。
Google PR 更新以及其他
不期然感冒了,睡得昏昏沉沉,起来又是中午了。发现 Google 工具条的 PR 更新了。我的首页和 BLOG 都变成了 4 。虽然没啥大用处,还是很高兴!查了一下,居然是 1 日更新的(这里)。看看常去的几个 BLOG, Mark Rittman 的 PR 变成了6 。最近大家都在回顾2004,Rittman的 Review Of 2004, Part One ,Review Of 2004, Part Two 这两篇 BLOG 非常值得一看。相比之下,《程序员》杂志1月份的回顾数据库的这一年那篇文章有些儿戏了,大部分内容都是关于 MySQL 的。