关于统计的问题

streetgrass 2003-05-06 11:40:35
我要对一个以数据仓库形式实现的库统计每个学生访问的网页以及访问次数,用OLAP完成,可是要怎么进行统计呢?书上的例子一般都是对销售额什么的进行SUM运算的统计,而我要做的这个是要count,假设事实表为(学号,上网时间,访问页面),我要做的是按学号+访问页面+上网时间分组,统计点击和。由于上网时间有属性日,周,学期,学年,我该怎样进行上卷操作呢?
刚接触数据仓库,懂得很少,请各位指点一二。谢谢
...全文
52 7 打赏 收藏 转发到动态 举报
写回复
用AI写文章
7 条回复
切换为时间正序
请发表友善的回复…
发表回复
streetgrass 2003-05-14
  • 打赏
  • 举报
回复
维表:学生,页面,时间
事实表:学生id,页面id,时间id,点击次数

另外还有一个表是关于知识点的,包括知识点编码、页面id,节,章,课程

这种情况下OLAP做关于知识点的上卷操作,该如做呢?如何把页面和知识点对应起来?
streetgrass 2003-05-06
  • 打赏
  • 举报
回复
若当初在构建数据仓库时事实表中无点击次数一项,是否有其他方法解决?
whitechief 2003-05-06
  • 打赏
  • 举报
回复
1,整理数据
维表:学生,页面,时间
事实表:学生id,页面id,时间id,点击次数
2,上卷
whitechief 2003-05-06
  • 打赏
  • 举报
回复
另外,最好在设计时就把原始数据库(数据源),整理后的数据库和数据仓库3部分区分开,对以后的开发有好处!
whitechief 2003-05-06
  • 打赏
  • 举报
回复
可以这样理解。
streetgrass 2003-05-06
  • 打赏
  • 举报
回复
是不是说,在原始数据库上构建数据仓库时,就用select count(*),,from table来计算事实表中的点击次数一项?
whitechief 2003-05-06
  • 打赏
  • 举报
回复
本来,整理数据的目的就是从杂乱的数据源中抽取出规则的数据。
因此,需要做的是:
1,根据需求确定时间的最小粒度(例如:小时),构造并填充时间维表
2,用 select count(*),,from table 填充事实表

不知道我说清楚了没有?
一句话,就是用 count聚集函数。

7,394

社区成员

发帖
与我相关
我的任务
社区描述
其他数据库开发 数据仓库
社区管理员
  • 数据仓库
加入社区
  • 近7日
  • 近30日
  • 至今
社区公告
暂无公告

试试用AI创作助手写篇文章吧