大数据_站长网

logminer挖掘不同数据库的归档日志，使用redo log数据字典

所属栏目：[大数据] 日期：2021-03-06 热度：76

挖掘要求: 使用测试库挖掘生产库的归档日志，生产库未设置utl_file_dir参数，生产库不能重启，无法抽取出生产库的数据字典挖掘方法：将生产区数据库的数据字典抽取到redo log 中，将有数据字典的redo log一块加载入logminer，使用redo log中的数据字典进行[详细]
大数定律和中心极限定理的中文叙述

所属栏目：[大数据] 日期：2021-03-06 热度：194

大数定律和中心极限定理的中文叙述一、大数定律 1.切比雪夫大数定律叙述：{Xn}随机变量序列，满足①相互独立；②方差D(X)存在并且一致有上界；那么{Xn}服从大数定律——随机变量的平均值依概率收敛到随机变量的期望，当n很大时；体现了均值的稳定性。 2.[详细]
Micro-targeting：大数据分析在政治领域的应用

所属栏目：[大数据] 日期：2021-03-05 热度：95

（图片来源网络，侵删）美国总统大选已经进入了白热化阶段，各竞选团队为了给候选人拉票可谓绞尽脑汁，使出浑身解数。今天为大家介绍的这个“micro-targeting”，是数据分析在政治选举中的一个投影，政治家们通过各种途径构建自己的数据库，利用数据分析设[详细]
文本特征选择

所属栏目：[大数据] 日期：2021-03-05 热度：124

转载：http://www.cnblogs.com/fengfenggirl/p/text_feature_selection.html 在做文本挖掘，特别是有监督的学习时，常常需要从文本中提取特征，提取出对学习有价值的分类，而不是把所有的词都用上，因此一些词对分类的作用不大，比如“的、是、在、了”等停[详细]
我在海外学BI学到了什么? ——从国内外教育差异谈BI与数据分析理

所属栏目：[大数据] 日期：2021-03-05 热度：64

在海外学习BI与数据分析是怎样的体验？有学到放之四海而皆准的理论知识和国际合作经验吗？海归分析师回国创业在工作中会有什么过人之处？又有什么不同之处？本次小编邀请永洪科技CRM副总裁，BI与数据分析专家谢玲女士，与大家一起谈谈国内外BI教育的差异，[详细]
构建数据处理“小窗口”、实现渠道掌控“大作为”| 记渠道监控中

所属栏目：[大数据] 日期：2021-03-01 热度：187

点击上方蓝色字体关注我们作者吴逊 ? ? ?浙江移动业务架构师肖亮 ? ? ?浙江移动实体渠道运营管理建设背景 ? 在当下移动互联网高速发展的时代，企业以前的金字塔组织结构，已经不能快速响应市场需求，移动互联网时代，商业流的加速，使得用户需求瞬息万[详细]
『Data Science』R语言学习笔记，基础语法

所属栏目：[大数据] 日期：2021-03-01 热度：191

Data Types Data Object Vector x - c(0.5,0.6) ## numericx - c(TRUE,FALSE) ## logicalx - c(T,F) ## logicalx - c("a","b","c") ## characterx - 9:29 ## integerx - c(1+0i,2+4i) ## complexx - vector("numeric",length = 10) ## create a numeric vect[详细]
图解机顶盒数据处理流程

所属栏目：[大数据] 日期：2021-03-01 热度：83

1. 前端数据的打包、调制与广播前端系统负责将电视节目的音视频数据，数字电视业务信息的各种表按照数字电视业务信息规范，打包成 ts 流，然后进行调制，再通过cable线，卫星，地面直播信号塔这些物理信道进行广播。两层复用：多个电视节目通过? 时分[详细]
深度解析 Twitter Heron 大数据实时分析系统

所属栏目：[大数据] 日期：2021-03-01 热度：64

2015年6月1号， Twitter 对外宣讲了他们的Heron系统，从ppt和论文中，看起来完爆storm。昨天，抽空把论文，仔细读了一遍，把个人笔记和心得分享一下：摘要： Heron更适合超大规模的机器，超过1000台机器以上的集群。在稳定性上有更优异的表现，在性能[详细]
81个开源大数据处理工具汇总（下），包括日志收集系统/集群管理/

所属栏目：[大数据] 日期：2021-03-01 热度：151

上一部分：http://my.oschina.net/u/2391658/blog/711016 第二部分主要收集整理的内容主要有日志收集系统、消息系统、分布式服务、集群管理、RPC、基础设施、搜索引擎、Iaas和监控管理等大数据开源工具。 ? 日志收集系统一、Facebook?Scribe 贡献者：Faceb[详细]
81个开源大数据处理工具汇总（上），包括查询引擎/流式计算/存储

所属栏目：[大数据] 日期：2021-03-01 热度：140

本文一共分为上下两部分。我们将针对大数据开源工具不同的用处来进行分类，并且附上了官网和部分下载链接，希望能给做大数据的朋友做个参考。下面是第一部分。查询引擎一、Phoenix 贡献者：：Salesforce 简介：这是一个Java中间层，可以让开发者在Apache H[详细]
文本挖掘的基本流程

所属栏目：[大数据] 日期：2021-03-01 热度：88

一、获取文本 ??我们获取网络文本，主要是获取网页HTML的形式。我们要把网络中的文本获取文本数据库(数据集)。编写爬虫（Spider）程序,抓取到网络中的信息。可以用广度优先和深度优先；根据用户的需求，爬虫可以有垂直爬虫和通用爬虫之分，垂直爬取主要是在[详细]
Mondrian 4 测试的简单demo（Saiku简单测试Schema文件）

所属栏目：[大数据] 日期：2021-03-01 热度：184

##?整理此文章方便大家做测试（手写Mondrian?Schema自测），不必每次都向saiku上传文件了 ##?关键文件 *?foodmart4.xml??测试对应的schema文件 *?foodmart-sql.zip????测试对应的数据库脚本 maven项目： pom文件 project?xmlns=" http://maven.apache.org/PO[详细]
EMC存储上的大数据 – 大数据分析实施路线

所属栏目：[大数据] 日期：2021-03-01 热度：81

? ? ?企业一直在处理快速增长的数据量（也称为大数据）的存储和管理问题。本文为系列的第十篇，介绍了发现适当的大数据业务机会并制定利用该机会的全面路线图。 ? ???? 大数据时代，各公司都在努力挖掘有关他们业务的令人信服的见解，以赢得竞争优势。他们在[详细]
O2O产品质量保障体系（四）| 基于学习的线下商户质量挖掘

所属栏目：[大数据] 日期：2021-03-01 热度：88

一、线下商户问题迫在眉睫糯米不仅仅是团购，它是O2O的生活服务平台，糯米的产品质量可以定义为线上和线下，线上主要是在线商品的售卖情况，所对应的质量问题也就是商品类的badcase，这些会直接影响我们的流水。而线下主要是商家服务的接待质量，会直接影[详细]
倒计时24小时开课｜StuQ大数据分析平台小班课（仅剩10个名额）

所属栏目：[大数据] 日期：2021-02-28 热度：136

StuQ?联合三位大数据资深专家桑文锋、曹犟、付力力共同推出《从0到1构建大数据分析平台》精品小班教学，仅有 60 席位，精品小班课区别于大众在线视频教学，课程设置具有如下特色：采用在线视频直播授课以实战为主在线解答疑问课后作业review 精品小班课[详细]
简化版大数乘法

所属栏目：[大数据] 日期：2021-02-28 热度：161

Description Dear Uncle Jack is willing to give away some of his collectable CDs to his nephews. Among the titles you can find very rare albums of Hard Rock,Classical Music,Reggae and much more; each title is considered to be unique. Last w[详细]
【ZJOI2013amp;amp;BZOJ3110】K大数查询

所属栏目：[大数据] 日期：2021-02-28 热度：90

Description 有n 个位置和m 个操作。操作有两种，每次操作如果是1 a b c 的形式，表示往第a 个位置到第b 个位置每个位置加入一个数c。如果操作形如2 a b c 的形式，表示询问从第a 个位置到第b 个位置，第c 大的数是多少。 Solution 树套树的模板题找矩阵中[详细]
大数据处理平滑算法：Good-Turing估计

所属栏目：[大数据] 日期：2021-02-28 热度：62

大数据处理中，不管数据如何大，由于不能穷举一切，总是有限的。那么在有限的数据规模下，参数平滑算法就十分重要。参数平滑算法是在训练数据不足时，采用某种方式对统计结果和概率估计进行必要的调整和修补，以降低由于数据稀疏现象带来的统计误差。比如[详细]
SCU2016-05 I题 trie图 + 大数dp

所属栏目：[大数据] 日期：2021-02-28 热度：67

File Name : 这很trie图建立转移规则，然后dp。大数模板 Code : /**********************jibancanyang************************** *Author* :jibancanyang *Created Time* : 一 5/ 9 11:49:40 2016 ***********************1599664856@qq.com**************[详细]
飞利浦陈祁侑：需要设计的不是硬件，而是信息挖掘与应用的方式

所属栏目：[大数据] 日期：2021-02-28 热度：92

本文节选自飞利浦资深设计策略顾问陈祁侑在2016国际体验设计大会「智慧生活峰会」上的演讲。你也可以通过底部 “阅读原文” ，上 Meia 直接观看完整视频及更多IXDC 2016大会峰会精彩演讲。两年前第一次来参加IXDC的时候，说的是如何透过共创、快速迭代共创[详细]
【杭电oj】1865 - 1sting（大数递推）

所属栏目：[大数据] 日期：2021-02-28 热度：52

点击打开题目 1sting Time Limit: 5000/1000 MS (Java/Others)????Memory Limit: 32768/32768 K (Java/Others) Total Submission(s): 4973????Accepted Submission(s): 1842 Problem Description You will be given a string which only contains ‘1’; You[详细]
hdu 5718 大数模拟

所属栏目：[大数据] 日期：2021-02-28 热度：193

点击打开链接 #include iostream#include algorithm#include cstdio#include vector#include cstring#include queue using namespace std;const int M = 10010000;int num[10],f[M],index; // num[i] 数字i出现的个数 char data[M]; void Add(int x){int t=0[详细]
大数据为我们带来了什么？

所属栏目：[大数据] 日期：2021-02-28 热度：162

洞悉行业动态，把握行业趋势，从数据中挖掘洞察，将洞察转变为价值，同时带您了解更多大数据在零售、交通、制造、银行等行业中的应用。 ???? 最早提出大数据时代到来的是麦肯锡：“数据，已经渗透到当今每一个行业和业务职能领域，成为重要的生产因素。人们[详细]
【杭电-oj】-1002-A + B Problem II（大数相加）

所属栏目：[大数据] 日期：2021-02-28 热度：113

A + B Problem II Time Limit: 2000/1000 MS (Java/Others)????Memory Limit: 65536/32768 K (Java/Others) Total Submission(s): 314006????Accepted Submission(s): 60840 Problem Description I have a very simple problem for you. Given two integers[详细]

10917

374