100分求助,一个项目的数据存储方案,求经验大神指导

please_call_me_J 2013-04-22 10:20:32
有个老版本的采集数据软件,采集数据并存储数据到access数据库,采集程序为vb开发,现在我要将其移植到c#(发到java板块是因为我以前做java,觉得java区域高人多啊),并且数据库改为oracle。

原access数据存储是每个站点(站点就是采集数据的来源,每个站点位于不同的地区)都会创建一个表,并且表里的字段正好对应该站点锁需要保存的信息(也就是说每个表的字段都可能不一致)。

现在我的问题是:我到底是应该给每个站点都动态创建表、创建字段来存储数据,还是创建1个站点表保存所有站点信息,另外创建一个数据表(包含了全部采集字段,每个站点不关心的字段都保持默认值)保存所有站点的数据,用外键区分数据所属站点。

请大神指导,按以前的做法每个站点创建1个表和统一的数据表来存储所有数据,哪个好?优劣各是什么,这个采集数据大致是每个站点每3分钟存一次数据库。如果采用1张表来存储,那么oracle能否抗住每个站点每3分钟存一次数据的性能要求?
...全文
314 13 打赏 收藏 转发到动态 举报
写回复
用AI写文章
13 条回复
切换为时间正序
请发表友善的回复…
发表回复
please_call_me_J 2013-04-25
  • 打赏
  • 举报
回复
引用 12 楼 preferme 的回复:
当然是分开做表咯。 数据采集的根本目的,不是为了存储数据,而是为了处理数据。 你把所有站点的数据,都采集到一张表里面,那么,这个表的长度会变得非常大。 由于每个站点的数据格式都不相同(涉及的字段不同),所以,这些数据的处理流程也不相同。 也就意味着,同一张表,你会采用多种不同的方式,去里面统计(提取)数据。 这张表的负载就会很大。 比如,有个查询操作很费时,它正在进行时你又对这张表做另……
是在是感谢您~~~~给我这么详细的解答
冰思雨 2013-04-23
  • 打赏
  • 举报
回复
当然是分开做表咯。 数据采集的根本目的,不是为了存储数据,而是为了处理数据。 你把所有站点的数据,都采集到一张表里面,那么,这个表的长度会变得非常大。 由于每个站点的数据格式都不相同(涉及的字段不同),所以,这些数据的处理流程也不相同。 也就意味着,同一张表,你会采用多种不同的方式,去里面统计(提取)数据。 这张表的负载就会很大。 比如,有个查询操作很费时,它正在进行时你又对这张表做另一个查询操作,就造成两个操作都会很慢。 分开做,有几个优点: 1. 由于每个站点,数据结构不同(表结构不同),数据的处理,思路会更加清晰。 不同站点,采用不同的处理流程即可,不存在什么容易混淆的字段,产生bug。 2. 风险隔离。如果有个误操作,把一个站点的数据搞乱了,不影响其他站点的原始数据。 比如:delete语句,忘了加where条件,或者少加了几个where条件之类的事情。 3. 负载均衡。这个只是相对的均衡,因为,每个站点的操作,要找对应的表去操作。 数据库会针对每个表的查询操作,进行优化,这个效率一定比多个查询一张表要高。 4. 升级、添加站点的代价较低。只需要添加对应的数据表,添加对应的处理流程即可。 当然,缺点也有一些: 1. 数据处理,缺少统一处理的过程。每个站点都要有对应的不同的处理过程,这个过程难于统一管理。 当然,这个问题,类似Java里面的多态,我们只要转变思路,还是能够较好的解决这个问题的。 2. 数据过于分散,难于维护。每个站点一张表,站点过多,涉及的表就会很多。 可能会产生,数据复杂、难于管理的感觉。这个方面,可以通过提取共有部分,抽象处理方法等,尝试优化。 其他缺点,我还没有想太多,应该还有不少缺点。 但是,分开表的优点,我很欣赏,所以,推荐楼主采用。 下面说说关于性能的问题: 楼主问,动态SQL会不会费性能? 首先,动态生成SQL语句不会耗费什么时间,费时间的是执行语句; 其次,我们可以针对每个站点表,编写不同SQL语句,这些语句就不用动态生成了,它们都是常量字符串; (当然,有人不太喜欢用常量SQL配合数据参数进行数据的插入,我也没有办法, 就如同PreparedStatement,很多人都不太喜欢调用setParameter方法设置参数, 而把参数写到SQL里面,引起SQL注入这种隐含漏洞。我也是没办法的事情。) Oracle能否扛得住3分钟一次的数据录入? 这个要看具体的场景: 多少个并发录入、每个录入的数据量、每个录入的要求的最大录入时间。 这些参数都确定的情况下,再来考虑问题的瓶颈。 问题瓶颈往往都在数据传输、数据解压上面。 楼主说的数据库由于录入压力过大,产生过载的现象,一般不会发生。 如果楼主能够确切掌握上面说的几个数据,可以通过调整Oracle缓存的方式,优化他们。 应该没有什么大问题的。
skywoodsky 2013-04-22
  • 打赏
  • 举报
回复
原先可以用access放,说明数据量不大 所以,无论单表还是多表都没什么问题 但是考虑扩展性,还是多表比较好 比方将来又多个站点,又一些特殊字段,单表的话,你怎么办,去改表结构么? 而且既然移植到oracle就是有可能会有数据量的增加,那更是多表性能更佳
please_call_me_J 2013-04-22
  • 打赏
  • 举报
回复
求帮助!~~~~
please_call_me_J 2013-04-22
  • 打赏
  • 举报
回复
引用 2 楼 zxhcloth 的回复:
1、单从频率来看,没有你所说的性能压力问题 2、就从你给的方案里选,我建议你分开,一直都不提倡大表制 3、如果你做的这个存储只是做备份,还可以考虑写到文件里去;如果你做的这个存储是用来统计分析用的,也可以用数据仓库的思想去做它
请教一下,可否给个“数据仓库的思想去做它”的方向?
zxhcloth 2013-04-22
  • 打赏
  • 举报
回复
1、单从频率来看,没有你所说的性能压力问题 2、就从你给的方案里选,我建议你分开,一直都不提倡大表制 3、如果你做的这个存储只是做备份,还可以考虑写到文件里去;如果你做的这个存储是用来统计分析用的,也可以用数据仓库的思想去做它
钢筋裤衩蛋 2013-04-22
  • 打赏
  • 举报
回复
帮顶 求大神
please_call_me_J 2013-04-22
  • 打赏
  • 举报
回复
再顶起来~~~~
tianma630 2013-04-22
  • 打赏
  • 举报
回复
引用 9 楼 juyangjia 的回复:
引用 7 楼 tianma630 的回复:数据挖掘的角度 当然是分开好了 数据挖掘是根据业务对数据进行分析和抽取 分开以后不是更容易进行分析嘛 突然想到一个问题,如果说我用了“分开”,我另外的程序在统计的时候,那就只能是动态sql,这效率会不会低了点?
编译个sql占得了多少时间?
please_call_me_J 2013-04-22
  • 打赏
  • 举报
回复
引用 7 楼 tianma630 的回复:
数据挖掘的角度 当然是分开好了 数据挖掘是根据业务对数据进行分析和抽取 分开以后不是更容易进行分析嘛
突然想到一个问题,如果说我用了“分开”,我另外的程序在统计的时候,那就只能是动态sql,这效率会不会低了点?
七神之光 2013-04-22
  • 打赏
  • 举报
回复
分布式数据库 感觉你这个和百叶箱有点像
tianma630 2013-04-22
  • 打赏
  • 举报
回复
数据挖掘的角度 当然是分开好了 数据挖掘是根据业务对数据进行分析和抽取 分开以后不是更容易进行分析嘛
please_call_me_J 2013-04-22
  • 打赏
  • 举报
回复
求帮助~~~~~~~
源码链接: https://pan.quark.cn/s/0f7c75cb3aad ### MIPI Video Mode 与 Command Mode 的差异 #### 一、引言 MIPI (Mobile Industry Processor Interface) 是一种用于连接移动设备中处理器及其外围设备的标准化接口。MIPI 接口支持多种协议,其中包含 DSI (Display Serial Interface) 和 DCS (Display Control Interface) 等协议。在 MIPI 接口的应用中,主要涉及两种工作模式:Video Mode(视频模式)和 Command Mode(命令模式)。本文旨在系统性地阐述这两种模式的工作机制、特性以及实际应用环境。 #### 二、LCD RAM 概念说明 在进一步探讨 MIPI 的两种模式之前,有必要对文中提及的“LCD RAM”概念进行明确。实际上,“LCD RAM”并非一个通用术语,而是本文作者用来描述 LCD 控制器中用于存储显示数据的内存区域。LCD(Liquid Crystal Display,液晶显示屏)通常配备一个控制 IC(Integrated Circuit,集成电路),该控制 IC 可能内置 RAM 以缓存显示数据。 #### 三、MIPI Video Mode(视频模式) **定义:** - 视频模式是一种类似于传统 RGB 接口的工作模式,它要主机持续不断地向显示器传输刷新数据。 - 在这种模式下,数据和控制信号以报文的形式通过 MIPI 总线进行传输。 - 显示器本身无需配备帧缓冲器,因为主机会周期性地刷新屏幕。 **特点:** 1. **实时性高:** 主机需要不...
源码下载地址: https://pan.quark.cn/s/a4b39357ea24 在电磁模拟技术中,CST(Computer Simulation Technology)是一种被广泛采纳的软件工具,它主要用于电磁场、微波、天线以及射频系统的设计工作。本资料将详细析CST软件中离散端口的具体配置方法,这些方法对于提升仿真结果的精确度和专业水准具有决定性作用。离散端口在CST软件中扮演着模拟信号输入或输出的重要角色,它们构成了仿真模型不可或缺的部。在配置离散端口时,一个核心的原则是保证端口的方向与网格线保持一致,这是因为这样做能够有效降低计算过程中产生的误差,并确保仿真数据的有效性。如果未能遵循这一指导原则,可能会引发未知的计算问题,进而导致仿真结果失去可靠性。 在CST软件中配置离散端口,通常需要借助“Pick Points”这一功能。通过选择“Pick Edge Center”选项,端口将被设定在模型边缘的中心位置上。然而,这种做法并不总是能够确保端口与网格线保持平行。在某些特定情形下,模型的几何构造可能不允许直接选取一个与网格线平行的边作为端口的安装位置。 为了克服这一挑战,可以采用多种不同的策略。如果模型本身已经包含一条与馈电口平行的边,那么可以直接利用这条边来建立端口,此时CST软件会自动调整端口使其与网格线对齐。另一种可选的方法是,当模型不具备现成的平行边时,用户可以手动构建一个几何结构,比如一个立方体,并使其边缘与馈电口平行。通过这种方式,新建立的几何结构的边缘就可以作为端口的位置,从而确保端口与网格线的平行关系。 在实施上述操作时,必须关注端口尺寸的合理性和物理意义的一致性。端口的尺寸应当依据实际天线馈电部的尺寸进行适当调整,过大的端口或...
代码下载链接: https://pan.quark.cn/s/a4b39357ea24 【使用TensorFlow进行图像识别】 图像识别作为计算机视觉领域的关键任务之一,其核心在于通过算法解析和理解图像所包含的信息。在此资源中,我们将集中探讨如何借助功能强大的深度学习框架TensorFlow来执行手写数字识别。手写数字识别构成了众多实际应用的基础,例如自动支票处理、光学字符识别(OCR)等场景。 TensorFlow是由Google创建的一个开源库,它主要用于数值运算和机器学习,尤其在深度学习方面表现卓越。其核心优势在于可以构建并训练复杂的神经网络架构,并且在多种硬件环境中实现高效执行,涵盖CPU和GPU平台。 在此实践项目中,我们将运用TensorFlow来构建一个卷积神经网络(CNN)模型,这种架构是处理图像数据的理想选择。CNNs通过模仿人脑视觉皮层的运作机制,能够自主地提取图像中的关键特征,进而达成识别目标。在手写数字识别的特定情境下,这些特征可能涉及笔画的几何形态、走向以及相互间的连接模式。 对于CNN的基础结构,我们需要具备相应的认知,其通常由卷积层、池化层、全连接层以及激活函数等部组成。卷积层借助滤波器(亦称卷积核)对图像进行扫描,以捕捉局部特征;池化层则用于降低数据维度,同时保留核心信息;全连接层将特征向量映射至各类别的概率布;而激活函数如ReLU则通过引入非线性元素,使模型能够学习更为复杂的模式。 在此案例中,建议采用MNIST数据集,这是一个广泛用于手写数字识别的标准测试集。该数据集包含60,000个训练样本和10,000个测试样本,每个样本均为28x28像素的灰度图像,代表0到9这十个数字中的某一个。为了训练模型,必须首先加载数据,并...

67,535

社区成员

发帖
与我相关
我的任务
社区描述
J2EE只是Java企业应用。我们需要一个跨J2SE/WEB/EJB的微容器,保护我们的业务核心组件(中间件),以延续它的生命力,而不是依赖J2SE/J2EE版本。
社区管理员
  • Java EE
加入社区
  • 近7日
  • 近30日
  • 至今
社区公告
暂无公告

试试用AI创作助手写篇文章吧