Oracle histograms -- interpreting frequency histogram

本文深入探讨了Oracle数据库中数字型字段Frequency Histogram的概念、如何生成及解释其数据,包括如何通过视图查看Histogram信息,并解析了为何数据可能失真的原因。此外,还提供了针对日期型字段Frequency Histogram的分析代码,展示了如何将内部存储的数字类型解析为可读的日期类型。
http://jonathanlewis.wordpress.com/2010/09/20/frequency-histograms-2/
原文请自备梯子。

Frequency histogram的概念请看官方文档:
http://docs.oracle.com/cd/E11882_01/server.112/e41573/stats.htm#i41591

Jonathan在这篇文章里介绍了怎么去解读数字型字段的Frequency Histogram。下面给出源代码:
create table t1(n1 number not null);
--insert 100 rows, 10 values (10,20...100)
insert into t1
select 10* round(dbms_random.value(1,10)) from dual connect by level <= 100;
commit;
select n1, count(*) from t1 group by n1 order by n1;
        N1   COUNT(*)
---------- ----------
        10          9 
        20         12 
        30         16 
        40         11 
        50         11 
        60          8 
        70          7 
        80         12 
        90          8 
       100          6 
--Gathering statistics, size 254 guarantees the creation of frequency histogram 
exec dbms_stats.gather_table_stats(user, 'T1', method_opt=>'FOR COLUMNS N1 SIZE 254',cascade=>true);  
--Viewing histogram info
select *
from user_tab_histograms
where table_name='T1' and column_name='N1'
order by endpoint_number;
--Getting the occurancy of each value.
select
    endpoint_value              column_value,
    endpoint_number - nvl(prev_endpoint,0)  frequency
from (
    select
        endpoint_number,
        lag(endpoint_number,1) over(order by endpoint_number)  prev_endpoint,
        endpoint_value
    from user_tab_histograms
    where table_name  = 'T1' and column_name = 'N1'
    )
order by endpoint_number;
COLUMN_VALUE  FREQUENCY
------------ ----------
          10          9 
          20         12 
          30         16 
          40         11 
          50         11 
          60          8 
          70          7 
          80         12 
          90          8 
         100          6 

提示:
endpoint value - 字段的值
endpoint number - 累加型值重复次数。oracle保证顺序性。

为何Frequency Histogram的数据会失真?
http://jonathanlewis.wordpress.com/2010/09/24/frequency-histogram-3/
这篇文章中,Jonathan介绍了一个原因。收集统计数据时取样大小。

Date型字段的Frequency Histogram的分析代码:
create table t2(d1 date not null);
insert into t2
select sysdate - round(dbms_random.value(1,10)) from dual connect by level <= 10;
commit;
exec dbms_stats.gather_table_stats(user, 'T2', method_opt=>'FOR COLUMNS D1 SIZE 254',cascade=>true);
select d1, count(*) from t2
group by d1
order by d1;
D1          COUNT(*)
--------- ----------
17-DEC-13          2 
19-DEC-13          1 
20-DEC-13          2 
21-DEC-13          1 
22-DEC-13          3 
23-DEC-13          1 
select ep_value column_value, endpoint_number - nvl(prev_endpoint,0) frequency
from (
    select endpoint_number,
        lag(endpoint_number,1) over(order by endpoint_number)  prev_endpoint,
        to_date(to_char(endpoint_value,'FM99999999') || '.' || to_char(86400 * mod(endpoint_value,1),'FM99999'),'J.sssss') ep_value
    from user_tab_histograms
    where table_name  = 'T2' and column_name = 'D1'
    )
order by endpoint_number;
COLUMN_VALUE  FREQUENCY
------------ ----------
17-DEC-13             2 
19-DEC-13             1 
20-DEC-13             2 
21-DEC-13             1 
22-DEC-13             3 
23-DEC-13             1 
DATE类型在内部存储为数字类型,小数点后是小时分秒部分。故而需要将其解析成可读的类型。

内容概要:本文围绕基于分布鲁棒优化的风电不确定性机组组合问题展开研究,提出了一种能够有效应对风电出力不确定性的数学模型与求解方法。通过构建分布鲁棒优化模型,充分考虑风电预测误差的概率分布特征及其不确定性集合的数学表达,在保障电力系统安全运行的前提下,优化发电机组的启停计划与出力分配,从而提升调度方案的经济性与鲁棒性。文中系统阐述了模型的理论基础、不确定性集合的构造方式、目标函数与约束条件的设计,并结合Matlab代码实现了算法仿真与案例验证,展示了该方法在不同场景下的适应能力与性能优势。; 适合人群:具备电力系统分析、优化理论基础及Matlab编程能力,从事新能源并网调度、电力系统运行优化、能源系统建模等方向的研究人员、高校研究生以及相关领域的工程技术开发者。; 使用场景及目标:①应用于高比例可再生能源接入背景下的电力系统机组组合决策,增强调度方案对风电波动的抵御能力;②为电力市场环境中的发电计划编制与日前调度提供科学依据和技术支持;③作为分布鲁棒优化理论在能源系统不确定性建模中应用的教学与科研案例,推动相关算法的推广与改进。; 阅读建议:建议读者结合Matlab代码深入理解模型构建与求解流程,重点关注不确定性集的设定逻辑、鲁棒性参数的选择以及算法实现细节,可进一步拓展至多能源耦合系统或多时间尺度调度场景的研究。
内容概要:本文提出了一种结合蒙特卡洛模拟与拉格朗日松弛法的分散式优化方法,用于解决电动汽车充电站在分时电价机制下的有序充电调度问题。通过蒙特卡洛方法模拟电动汽车充电行为的随机性,生成多场景充电负荷数据,并构建以降低电网负荷波动和用户充电成本为目标的优化模型。采用拉格朗日松弛法对问题进行解耦,实现各电动汽车在保护用户隐私的前提下自主参与调度决策,有效提升了计算效率与实际应用可行性。仿真实验验证了该方法在削峰填谷、减少用户电费支出以及增强电网运行稳定方面的优越性能; 适合人群:具备电力系统优化、智能交通系统、运筹学或能源管理等相关背景的研究生、科研人员及工程技术人员; 使用场景及目标:①应用于城市规模化充电站集群的分散式调度系统设计与优化;②研究分时电价政策下用户充电行为与电网负荷之间的互动响应关系;③为高比例电动汽车接入场景下的电网协同控制提供算法支持与仿真验证平台; 阅读建议:读者应结合提供的Matlab代码,深入理解蒙特卡洛场景生成与拉格朗日松弛算法的实现逻辑,建议在复现过程中调整电价策略、用户数量等关键参数,观察其对调度效果的影响,并可进一步拓展至多目标优化框架或引入可再生能源出力不确定性进行联合建模研究。
内容概要:本文针对高渗透率分布式光伏与储能变流器接入配电网所带来的运行挑战,深入研究了传统跟网型(GFL)逆变器在电网故障、弱电网及孤岛工况下易失稳脱网,以及构网型(GFM)虚拟同步发电机(VSG)逆变器在并网状态下缺乏同步调节能力的技术瓶颈,提出了一种可实现GFL与GFM双向平滑切换的先进控制策略。研究首先构建了GFL与GFM共用的硬件平台与内环控制基础,继而系统性地设计了基于关键电气量实时监测的切换判据、精确的双向切换时序逻辑,并创新性地引入了过渡过程的平滑抑制策略,以有效抑制切换瞬间的有功功率冲击、电压闪变与频率突变。全文在Matlab/Simulink环境中搭建了完整的仿真模型,通过对并网转孤岛、孤岛转并网等多种工况的动态仿真,全面验证了所提策略的有效性,结果表明该方法能确保系统在模式切换过程中电压、电流与频率的平稳过渡,显著提升了微电网在复杂运行条件下的韧性、稳定性与供电可靠性。; 适合人群:从事电力电子、新能源并网、微电网控制、智能配电网等领域的高校研究生、科研院所研究人员及电力系统相关企业的工程技术人员。; 使用场景及目标:① 解决高比例可再生能源接入引发的电网稳定性与电能质量问题;② 实现微电网在并网与孤岛两种运行模式间的无缝、可靠切换,保障重要负荷的不间断供电;③ 为构网型与跟网型逆变器的协同运行、新型电力系统构建提供先进的控制理论依据与可落地的技术解决方案。; 阅读建议:建议结合文中提供的Simulink仿真模型进行深入学习,重点剖析切换逻辑模块的设计原理与参数整定方法,通过反复观察和分析不同工况下的仿真波形,深刻理解平滑切换过程中的动态响应机理与控制思想。
内容概要:本文系统对比了GEO优化与传统SEO在律所获客中的底层机制与实际效果差异,指出两者并非替代关系,而是基于不同信任传导机制的获客模式。GEO依托大模型的“AI预筛选”和“权威背书转移”机制,虽流量规模较小,但用户意向浓度高,转化率可达4.8%-8.7%,显著优于传统SEO的1.2%-3.5%。文章提出“信任-转化”双轴模型(TCDA),强调提升信任前置程度比缩短转化路径更能有效提升转化效率,并通过27家律所6个月的实测数据验证GEO在签约数、签约周期、客户满意度等方面的综合优势。同时提供GEO+SEO组合落地的五步法及七大常见陷阱规避策略。; 适合人群:中小型律所管理者、法律行业市场营销人员、数字化转型负责人,以及对AI时代获客策略感兴趣的专业服务机构从业者;尤其适用于希望突破传统SEO瓶颈、寻求高质量线索转化的团队。; 使用场景及目标:①理解GEO与传统SEO在转化逻辑上的本质区别;②制定律所获客渠道组合策略,实现“SEO打底量、GEO提质量”的协同效应;③指导GEO优化的具体实施步骤,避免常见执行误区;④构建以信任前置为核心的长期品牌影响力。; 阅读建议:此资源以实证数据与理论框架结合,深入剖析AI搜索时代的获客变革,建议读者结合自身律所发展阶段与业务特点,从小范围试点入手,重点关注信息一致性、第三方引用建设与高采信内容生产,持续监测AI推荐频次等过程指标,而非仅关注短期咨询量变化。
内容概要:本文研究了一种可实现构网型与跟网型运行模式双向平滑切换的逆变器控制策略,并通过Simulink进行仿真实现。文章首先深入分析了构网型(Grid-Forming)与跟网型(Grid-Following)逆变器的基本工作原理及其适用场景:构网型逆变器具备自主建立电压和频率的能力,适用于弱电网或孤岛运行等缺乏坚强电网支撑的场景;而跟网型逆变器则依赖外部电网提供的电压相位进行同步并网,适用于强电网环境下的稳定并网运行。针对两种模式切换过程中易引发的电流冲击、功率振荡、频率失稳甚至系统失步等关键问题,提出了一种基于模式切换判据与过渡控制策略相结合的解决方案。该方案通过设计合理的切换逻辑、控制架构的动态重构机制以及瞬态补偿环节,有效抑制了模式转换过程中的暂态扰动,实现了两种运行模式之间的无缝、平滑过渡。Simulink仿真结果充分验证了该控制策略在不同电网强度和工况下的有效性与鲁棒性,显著提升了逆变器在复杂多变电网环境下的适应能力、运行灵活性与系统整体可靠性。; 适合人群:具备电力电子、自动控制理论及新能源发电系统相关专业知识,从事逆变器控制算法开发、微电网系统集成、新型电力系统稳定性研究的技术研发人员、高校研究生及工程实践人员。; 使用场景及目标:①应用于需要在并网与离网(孤岛)模式间灵活切换的微电网、光储一体系统及应急电源系统;②提升新能源发电系统在电网故障、弱网条件下的运行韧性与自治能力;③为构网型逆变器技术的工程化应用提供可靠的模式切换控制方案与完整的仿真验证平台。; 阅读建议:建议结合提供的Simulink仿真模型进行同步学习与调试,重点理解模式切换的触发条件判断、控制环路的重构逻辑以及瞬态补偿器的设计原理,可进一步拓展至多逆变器并联运行下的协同切换策略研究。
内容概要:本文系统研究了基于线性决策规则(LDR)的分布鲁棒机组组合模型,旨在应对高比例风电接入背景下电力系统调度中的不确定性挑战。通过构建两阶段分布鲁棒优化框架,采用模糊集刻画风电出力的不确定分布,并引入线性决策规则对实时调整变量进行仿射表示,有效缓解了传统鲁棒优化保守性强和随机规划场景依赖性高的问题。文中详细阐述了模糊集构造方法,并利用对偶理论将原始复杂的min-max-min形式问题转化为可被标准求解器处理的混合整数线性规划(MILP)模型,显著提升了计算可行性与求解效率。研究进一步通过算例对比分析了不同建模方法在经济性、安全性与计算性能方面的表现,验证了所提方法在兼顾系统鲁棒性与运行经济性方面的优越性。; 适合人群:具备电力系统优化、运筹学理论基础,熟悉Matlab编程及YALMIP建模工具,从事新能源并网调度、电力系统经济运行、鲁棒优化算法开发等相关领域的研究生、科研人员及工程技术从业者。; 使用场景及目标:①解决高维不确定性下机组组合问题建模难、求解复杂度高的瓶颈;②为科研人员提供一套完整的分布鲁棒优化与线性决策规则相结合的技术实现路径;③支撑电力系统日前调度决策,提升电网对风电波动的适应能力与安全裕度。; 阅读建议:建议结合文末提供的Matlab代码深入学习,重点掌握模糊集构建、两阶段模型结构设计、对偶化推导过程等关键环节,推荐配合YALMIP与高性能求解器(如CPLEX或Gurobi)开展仿真实验,以全面理解分布鲁棒优化机制及其工程应用价值。
内容概要:本文研究了基于Q-Learning自适应强化学习的PID控制器在自主水下航行器(AUV)中的应用,旨在通过强化学习算法优化传统PID控制参数,提升水下机器人在复杂海洋环境中的运动控制精度与自适应能力。研究首先建立了AUV的六自由度非线性动力学模型,进而设计了一种将Q-Learning算法与PID控制器深度融合的智能控制框架,利用强化学习的奖励机制实现对PID三个参数的在线自适应调整。通过Matlab/Simulink平台进行的大量仿真实验表明,该方法在轨迹跟踪和抗外部干扰方面均表现出优异性能,相较于传统固定参数PID控制器,具有更快的响应速度、更小的超调量和更强的鲁棒性,有效解决了AUV在时变、强耦合、非线性环境中精确控制的难题。; 适合人群:具备自动控制理论、强化学习基础以及Matlab/Simulink仿真技能,从事水下机器人、智能控制算法、非线性系统控制等方向研究的研究生、科研人员及工程技术人员。; 使用场景及目标:①应用于AUV、无人机等复杂非线性系统的高精度运动控制问题;②目标是实现PID控制器的智能化、自适应化,克服传统方法在不确定环境下的参数整定困难;③为强化学习算法在实际工程控制系统的落地应用提供一个完整的、可复现的技术范例。; 阅读建议:建议读者结合提供的Matlab代码进行仿真实践,重点剖析Q-Learning与PID的耦合机制、状态空间与动作空间的定义、奖励函数的设计原则,并通过调整算法参数观察其对控制性能的影响,从而深入理解基于强化学习的控制优化内在逻辑。
内容概要:本文系统研究了基于AIC与BIC信息准则的三变量Copula联合分布概率测算方法,重点阐述了如何通过AIC与BIC准则优选单变量边缘分布函数,并进一步确定最优的三变量Copula函数类型,从而构建能够准确刻画变量间复杂依赖结构与尾部相关性的联合概率模型。研究完整呈现了从数据预处理、边缘分布拟合、参数估计到Copula函数选型及联合概率计算的全流程建模过程,并依托Matlab语言实现了全部算法,为处理金融、水文、电力等领域中的多变量极端风险联合分析问题提供了严谨的技术路径。; 适合人群:具备概率统计、数理金融或数据分析基础知识,熟悉Matlab编程,从事风险管理、金融工程、水文气象、能源系统分析等领域的高校研究生、科研人员及行业工程师。; 使用场景及目标:① 构建具有非线性相关性和尾部依赖特征的多变量随机系统联合分布模型;② 应用信息准则科学比较并选择最优的概率模型,提升风险评估与极端事件预测的准确性;③ 掌握利用Matlab实现Copula建模的完整技术链条,服务于如系统可靠性分析、灾害联合预警、资产组合风险度量等实际应用场景。; 阅读建议:建议读者在学习过程中结合Matlab代码逐项验证各建模步骤,深入理解AIC/BIC准则在模型选择中的作用机制,重点关注不同Copula函数(如高斯、t、阿基米德族)在捕捉上尾、下尾依赖性方面的差异,以充分掌握多变量联合概率建模的核心思想与实践技巧。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值