三个世界理论 (信息学)
在資訊学(尤其在计算机科学、数据库理论)中的“三个世界”理论中,“三个世界”指现实世界、資訊世界和机器世界(即电脑世界),概括了将现实世界中客观存在的事物(一些事实与事件)转化成为数据库存储中的数学模型的三个过程。独立存在于人们头脑外、客观存在的事物归属现实世界;当人们把这些客观事物收入头脑后,予以整理,对其简化、抽象化后,选出事物、事件较具代表性质的属性,这便成为信息世界的实体;最后通过各种媒体(特别指电子计算机存储器),将这些属性整…
共 74 篇文章
在資訊学(尤其在计算机科学、数据库理论)中的“三个世界”理论中,“三个世界”指现实世界、資訊世界和机器世界(即电脑世界),概括了将现实世界中客观存在的事物(一些事实与事件)转化成为数据库存储中的数学模型的三个过程。独立存在于人们头脑外、客观存在的事物归属现实世界;当人们把这些客观事物收入头脑后,予以整理,对其简化、抽象化后,选出事物、事件较具代表性质的属性,这便成为信息世界的实体;最后通过各种媒体(特别指电子计算机存储器),将这些属性整…
YouControl是乌克兰在线,可实现商业分析、获取竞争情报和对交易对手进行检视。而乌克兰同名IT公司则基于开放数据开发和开发了这一系统和对应的服务。 截至2022年底,公司专家已为6000余名乌克兰中央执行机构和政府的地方代表进行了培训。公司拥有约600家社会合作伙伴(媒体、公共组织)。借助此系统,已有7000多次新闻调查得以完成。60所乌克兰高等教育机构与YouControl合作。网站储存了乌克兰所有企业和FOP的注册和历史数据(…
TiDB是一个开源的NewSQL数据库,支持混合事务和分析处理(HTAP)工作负载。它与MySQL兼容,并且可以提供水平可扩展性、强一致性和高可用性。它主要由PingCAP公司开发和支持,并在Apache 2.0下授权。TiDB从Google的Spanner和F1论文中汲取了最初的设计灵感。 TiDB被InfoWorld 2018 Bossie Award评选为最佳数据存储和分析开源软件之一。 历史 PingCAP Inc.是一家软件公…
ImageNet项目是一个大型嗅觉数据库,用于视觉目标识别软件研究。该项目已手动注释了1400多万张图像,以指出图片中的对象,并在至少100万张图像中提供了边框。ImageNet包含2万多个典型类别。尽管实际图像不归ImageNet所有,但可以直接从ImageNet免费获得标注的第三方图像URL。2010年以来,ImageNet项目每年举办一次软件竞赛,即ImageNet大规模视觉识别挑战赛(ILSVRC)。挑战赛使用1000个“整理”…
综合数据库也称为动态库或工作存储器,是反映当前问题求解状态的集合。 存放内容 系统运行过程中所产生的所有信息 原始数据: 用户输入的信息 推理的中间结果 ** 推理过程的纪录 作用 动态库中由各种事实、命题和关系组成的状态,既是推理机选用知识的依据,也是解释机制获得推理路径的来源。 参考资料
Observation.org是一个由自然科学家、公民科学家和生物学家组成的全球性平台,致力于收集、验证和分享生物多样性观测数据。平台可通过Observation.org网站或移动应用程序,如ObsIdentify来访问。平台上的数据库包含2.33亿条自然观测数据和7900万张照片。 该平台由非营利基金会国际观察(Observation International)运营,根据荷兰和欧洲法律,在该国出版和托管。 开放数据 获批准的观测数据…
数据集市(),是数据仓库(Data Warehouse)的一种特殊形式。正如数据仓库,数据集市也包含对操作数据的快照,便于用户基于历史趋势与经验进行战略决策。两者的決定性差異在于数据集市在有具体的、预先定义好了的对被选数据分组并配置的需求基础之上建立。配置数据集市强调对相关信息的易连接性。 参考文献
在关系数据库,数据库表,又稱表格(),是一系列二维数组的集合,用来代表和储存数据对象之间的关系。表是构成表空间的基本结构,由区间构成。它由纵向的列;}-和横向的行;}-组成,例如一个有关作者信息的名为authors的表格中,每个-{zh-hant:行;zh-hans:列;}-包含的是所有作者的某个特定类型的信息,比如“姓氏”,而每-{zh-hant:列;zh-hans:行;}-则包含了某个特定作者的所有信息:姓、名、住址等等。 对于特定…
ADOdb是Active Data Objects database的简称,它是一种PHP存取数据库的函式组件。它允许程序员以一致的方式来存取数据库,从而忽略后台数据库的种类的差异。它的优势是能让程序员在转移数据库平台时,可以不用花费大量时间重新书写代码。它支持以下数据库: MySQL、PostgreSQL、Interbase、Firebird、Informix、Oracle、MS SQL、Foxpro、Access、ADO、Sybas…
一个数据元由以下两部分组成: 数据元概念:数据元概念是能以一个数据元的形式表示的概念,其描述与任何特定表示法无关。 表示:表示由值域、数据类型、计量单位(如果需要)、表示类(可选)组成。 基于数据建模的视角,一个数据元概念由两部分组成。 对象类:可以对其界限和含义进行明确的表示,且特性和行为遵循相同规则的观念、抽象概念或现实世界中事物的集合。 特性:一个对象类所有成员所共有的特性。 在元数据理论中,数据元素是具有精确含义或精确语义的数据…
逻辑删除(),又被称软删除、假删除,是一种数据库操作,使用标记将数据标为不可用,而不从数据库删除数据本身。使用适当的方法可恢复被删除的文件。 相关网页 [https://en.wiktionary.org/wiki/soft_deletion soft deletion on wiktionary] [https://stackoverflow.com/questions/378331/physical-vs-logical-soft-…
快照隔离(snapshot isolation,SI)是数据库事务处理中的一个隔离级别,保证事务的读操作将看到一个一致的数据库的版本快照(实际上读取比该事务早的最后一次提交值)。该事务的写操作成功提交,仅当基于该快照的任何并发修改与该事务的修改没有冲突(即写-写冲突)。 很多重要的数据库管理系统已经采用了快照隔离,如InterBase, Firebird, Oracle, MySQL, PostgreSQL, , MongoDB 与 M…
封闭世界假定是当前不是已知的事物都为假的假定。这个名字也称呼Ray Reiter对这个假定的逻辑形式化。与封闭世界假定相对立的使用开放世界假定,宣称知识的缺乏不蕴涵虚假。 否定为失败与封闭世界假定有关,因为它总体上相信不能被证明为真的所有命题都是假的。 封闭世界假定经常暗含在数据库中,因为所有没有明确的包换在表中记录都暗含的假定表示这是假(而不是未知)这个事实。例如,如果数据库包含下列表,报告写作给定文章的人的,关于没有编辑形式逻辑的文…
參數化查詢(parameterized query 或 parameterized statement)是指透過程式設計與資料庫進行查詢資料的時候,如果要查詢的特定欄位數值有變化,應該透過參數(parameter)的方式賦值,這個方法目前已被視為可有效預防SQL注入攻擊手法的防禦方式之一,另外除了安全因素外參數化查詢往往也較有資源、效能優勢。 安全原理 在使用參數化查詢的情況下,資料庫伺服器不會將參數的內容視為SQL指令的一部份來處理,…
在数据库管理系统(DBMS)中,预处理语句(Prepared Statement,又称参数化语句)是一种将SQL代码预先编译并存储,从而实现代码与数据分离的特性。其主要优势包括: 效率:由于无需重复编译,可以多次重复使用。 安全:通过减少或消除SQL注入攻击来提高安全性。 预处理语句采取预编译模板的形式,在每次执行时替换其中的常量值。它通常用于INSERT、SELECT或 UPDATE等DML语句。 预处理语句常见工作流: 准备 (Pr…
用户自定义函数(User-Defined Function,UDF)是由程序或环境的用户所提供的函数。通常在这种语境下,系统默认函数是程序或环境原生内置的。UDF通常是根据创建者的特定需求而编写的。 数据库 在关系数据库管理系统中,用户自定义函数(UDF)提供了一种扩展数据库服务器机制的方式。通过添加函数,用户可以在标准查询语言(通常是SQL)语句中对其进行调用。SQL标准将函数分为标量函数(Scalar Functions)和表函数(…
線上交易處理(OLTP, Online transaction processing)是指透過資訊系統、電腦網路及資料庫,以線上交易的方式處理一般即時性的作業資料,和更早期傳統資料庫系統大量批次的作業方式並不相同。OLTP通常被運用於自動化的資料處理工作,如訂單輸入、金融業務…等反覆性的日常性交易活動。 和其相對的是屬於決策分析層次的線上分析處理(OLAP)。
InfluxDB是一个由[https://www.influxdata.com/ InfluxData] 开发的开源时序型数据库。它最早由Go写成,后来切换成用Rust编写,着力于高性能地查询与存储时序型数据。InfluxDB被广泛应用于存储系统的监控数据,IoT行业的实时数据等场景。 历史 Errplane公司在2013年下半年开始以开源项目的形式开始了InfluxDB的开发。其目的是为了提供一个高性能的监控以及告警的解决方案。在20…
-{zh-cn:列式数据库; zh-tw:直欄式儲存}-()是以-{zh-cn:列; zh-tw:欄}-相关存储架构进行数据存储的数据库,主要适合于批量数据处理和即时查询。相对应的是-{zh-cn:行式数据库; zh-tw:列式儲存}-,数据以-{zh-cn:行; zh-tw:列}-相关的存储体系架构进行空间分配,主要适合于小批量的数据处理,常用于联机事务型数据处理。 描述 数据库以-{zh-cn:行; zh-tw:列}-、-{zh-c…
数据集成是将不同来源与格式的数据逻辑上或物理上进行集成的过程。传统上,数据集成可以分为两大类方法,即数据仓库和。数据库仓库技术在物理上将分布在多个数据源的数据统一集中到一个中央数据库中;而联邦数据库则仅通过将用户查询翻译为数据源查询来进行逻辑上的数据集成。