中企动力 > 商学院 > 云计算平台管理系统
  • ?

    敏捷时代下的云管理平台架构

    Vejle

    展开

    在互联网的时代,企业面临业务的不确定性和可能的爆发性IT需求。而当您考虑部署云平台时,很可能您的企业已经有传统技术为主的IT环境,云平台只是作为一个独立的环境来使用和支撑部分新业务,甚至我们所知的部分企业基于使用的云操作系统产品不同,分别部署了不同的云环境,来支持不同的业务。这样就形成了企业内以产品技术为区别的不同的资源环境和孤岛。

    我们建议基于业务系统的特性,如:敏态,稳态,来采用不同的核心技术来进行支撑,并采用统一的云管理平台来进行不同资源池,IT环境的统一调度和管理,来简化管理,提升IT的敏捷性,如下图所示:

    主流的云管理平台可以采用无侵入技术来管理物理机为主的传统IT环境和异构虚拟化,公有云环境,并提供统一的可视化的控制界面,面对不同角色的用户提供不同的敏捷管理和服务,如下图所示:架构师可以跨资源池,进行服务的编排和设计,把编排好的资源组合变成服务目录,发布给用户。IT用户可以通过自服务门户查看IT服务目录,进行自服务。IT管理员可以通过管理控制台进行可视化、自动化、智能化的运维管理和计量、计费。

    此外,自服务门户可以定制服务目录,资源配额和审批工作流,便于DevOps团队快速获取个性化的自助服务。利用云管理平台的RET API,IT可以与ITIL服务管理系统进行集成,并赋能快速的DevOps和服务编排。

    在云管理平台上,所有这些对于不同IT环境的服务管理需进行自动化和优化。包括:

    内置的工作流自动化为资源生命周期管理提供基于策略的控制基于应用的关键特性,如:用户,合规,性能压力来智能化、自动化部署。传统环境和云环境租户资源使用的计量和计费资源和成本优化,提供云之间进行成本对比的能力。

    云管理平台使企业避免被单一技术和产品锁定,允许企业采用最优的云技术组合来构建同时支持稳态和敏态的IT环境。主流的云管理平台,如RightCLoud支持物理机,IBM Power,Vwmare,Openstack和阿里云,腾讯云,华为云,AWS等主流的云技术,企业可以把现有的IT环境与多源云环境进行融合。

    云管理平台的集成模块,可与企业现有的ITIL服务流程系统,配置管工具等进行无缝集成。

    在当今世界的DevOps自动化,追求敏捷的企业需要的不仅仅是虚拟机部署。企业IT需要为提供更具价值的应用程序和PaaS服务。主流的云管理平台,具有服务目录的设计编排能力和业务流程引擎,如RIghtCloud可以提供完整的应用程序和多层次的PaaS服务。

  • ?

    SkyForm CMP(云管理平台)

    弗里达

    展开

    企业IT面临的挑战

    企业IT系统日益庞大和复杂化

    规模成倍增加

    费用成本增加快于规模增加

    资源利用率低下

    负载难以预测

    资源协调调度困难

    业务上线周期长

    系统建设周期长

    难以快速满足业务部门的IT服务需求

    运营运维管理日趋复杂

    占用了企业大量的时间和精力

    花费大量的人力资源成本

    SkyForm CMP(云管理平台) ——让企业IT更简单,更高效

    SkyForm CMP是一个开放、中立的企业级云管理平台,向下对接企业传统 IT 资源和云资源池,向上为系统管理员提供all-in-one的IT资源管理能力,实现面向最终用户的云服务交付。

    应用场景

    SkyFormCMP已大规模成功应用于运营商公有云,服务于运营商政企客户;运营商私有云,针对运营商B域、O域、M域的IT资源进行云化改造。同时,SkyFrom CMP已成功应用于电子政务云、教育云、航空制造云、金融云、园区云、动漫渲染云等。

    价值体现

    大规模资源管理能力

    在实际案例中,已实现一套云管理平台对10+个数据中心多种异构资源池,总计50000+个物理节点的统一管理。

    大幅提高资源利用率

    在实际案例中,通过系统内置的智能资源调度引擎并结合业务的自动弹性伸缩功能,使资源使用率较之前提高20%~40%,为用户节省了数千万元的投资。

    提高运维工作效率

    将云计算资源同物理资源、物理位置、业务应用、企业部门建立关联,从运维的角度提高故障排查效率20%,将故障对业务的影响降到最低。

    保证业务连续性

    在因断电或其他原因造成的宕机、服务不可用情况发生时,基于调度与自动恢复技术,可将对业务连续性的影响降至最低,实现99%的业务可用性。

    增强业务系统可靠性

    基于大数据实时分析,对系统资源与系统运行状态进行分析与监控,并快速进行的风险初判,结合最新的人工智能技术,可依据存储于大数据平台的历史数据对系统未来可能出现的问题进行精准预测,为运维工作提供必要的技术支撑,保证系统可靠、稳定的运行。

    产品亮点

    异构资源管理

    支持对不同厂家的服务器、小型机、存储设备、云存储软件、网络设备、SDN、安全设备、虚拟化软件的集中统一管理;既可以管理VMware、OpenStack,CloudStack资源池,也可以对物理服务器集群进行管理。

    多数据中心管理

    支持对多个位于不同地理位置的数据中心的多个异构资源池进行统一管理。

    混合云管理

    既支持对企业内部IT资源的管理,还可通过公有云服务商提供的API,实现对运行在外部公有云上的资源的管理。

    多种虚拟化管理

    支持多种主流的虚拟化技术,无论是商业软件vSphere、PowerVM、Hyper-V,还是开源的KVM , XenServer,都可以通过一套云管理平台实现对各种异构虚拟化资源进行统一管控。

    智能的资源调度引擎

    产品内置的智能资源调度引擎,可实现资源的智能化调度,从而提高资源利用率、保障不同等级业务SLA。支持基于填满、分散、负载平衡以及随机等多种资源分配策略,也支持基于SLA的资源调度策略,通过对业务定义高、中、低等不同优先级实现资源按业务保障级别区别使用。

    基于3D可视化的运维管理

    基于3D可视化对数据中心以及数据中心中的机架、设备进行监控管理,直观高效,大大简化了数据中心的IT运维管理。

    业务的弹性伸缩

    当业务系统处于业务访问的高峰期或低谷期等场景时,业务系统可根据预先定义好的伸缩策略自动的对业务系统的资源进行扩缩容,伸缩的策略包括基于性能告警与基于定时共两种策略。除支持按照伸缩策略自动执行弹性伸缩外,还支持以手动方式执行业务的弹性伸缩。

    基于大数据与机器学习技术的问题预测

    基于云计算技术对资源池中的各种资源进行实时数据采集,将采集到的数据经大数据平台进行实时风险分析,并快速提供系统风险初步判断,结合最新的机器学习技术对大数据平台存储的系统运行历史数据进行学习,对未来系统可能出现的问题进行精准预测,有效提高系统运行可靠性,降低系统出现风险几率。

    良好的扩展性

    产品具有良好的扩展性,对外提供RESTful API,允许用户在现有产品的功能上进行二次开发,并可与用户已有的系统进行无缝集成。

    功能概览

    仪表盘:整个企业IT系统运行KPI一目了然

    仪表盘是向用户展示度量信息和关键业务指标现状的一种数据虚拟化工具。通过仪表盘,管理员能够快速的了解整个系统的资源使用情况和性能状况。

    统一资源管理与调度:企业IT资源大范围共享,大幅提升IT资源利用率

    资源监控:提供对已添加至系统中的资源的监控功能,可以在系统仪表盘、数据中心仪表盘或资源池仪表盘粒度下查看资源的使用情况。

    资源配置:提供对物理资源、网络资源、软件资源、资产、资源池的管理功能。

    统一运营:以标准IT服务的方式为企业业务部门提供IT资源,服务流程化、标准化

    实例管理:“实例”包括虚拟机、虚拟硬盘、虚拟硬盘备份、VPC、子网、浮动IP、路由器、安全组和自动伸缩组,实现对具体实例的管理。

    申请虚拟机:用户可通过自服务门户申请虚拟机资源,申请在审批通过之后,虚拟机将自动创建并开通。在申请虚拟机的时候,可以选择虚拟机所属的用户,所属资源池、资源域,虚拟机的类型(VMware、KVM、XenServer)、虚拟机操作系统的模板、虚拟机的基本配置信息(CPU、内存、磁盘容量、虚拟机名称、所属业务)、网络、IP地址等信息。

    请求管理:对申请虚拟机、申请虚拟硬盘、修改配置、修改网络速率、创建模板、备份虚拟硬盘、申请VPC、申请配额等行为提供流程化审批管理能力。

    统一运维:统一运维企业所有IT资源,大幅提升运维效率和有效性,统一运维包括配置、拓扑、告警、日志、性能、故障、统计分析等。

    数据分析:基于NoSQL与大数据平台进行数据存储与分析,以图形化的方式展示一个时间段内的资源池或集群的资源使用情况,并从多个维度预测某个设备在不同时间周期内的性能趋势,为扩容或调整配置提供参考依据。

    业务管理:以业务或应用为视角统筹管理IT资源

    提供业务配置和业务监控功能,通过为业务配置不同的网络,可以将实例按照业务分布来统计,便于企业以业务的视角了解资源的分配情况。

    系统管理

    不仅为管理员提供部门、用户、角色、租户的统一构建和管理功能,还提供系统调度和系统参数的配置。

    成功案例

    SkyForm CMP已规模服务于100余家大中型企业客户,管理的物理机器规模累计已超过20000台。

    政府及公共事业某国家动漫产业基地园区云某市电子政务云上海某软件园园区云北京市某区教委云管理平台某省公安厅云管理平台某市医院云管理平台某市工商局云管理平台

    电信行业

    中国联通“沃云”一级公众服务云中国联通2省网管云中国移动某省IDC公有云中国移动某省VDC云管理平台中国移动某省泛DC云管理平台中国移动7省私有云中国移动某省网管云中国移动某省桌面云中国移动某省PaaS平台

    广电行业

    某省网络广播电视台私有云

    金融行业

    某地方商业银行云管理平台

    教育行业

    贵州某大学云管理平台浙江某大学云管理平台辽宁某大学云管理平台广东某大学云管理平台

    制造行业

    中航工业某单位航空制造云

    大型IT企业

    亚信集团

  • ?

    多云和混合云成为主流 云计算管理平台崛起

    毒蘑菇

    展开

    2017年是中国云计算的转折之年,中国企业争相上云的热度空前高涨,中央政府也一度通过《云计算发展三年行动计划》将发展云计算提高到国家战略层次,提出到2019年我国云计算产业规模达到4300亿元的发展目标,中国云计算进入史无前例的增长快车道。仅以中国公有云领域巨头阿里云为例,其公布的2018财年第一季度财报显示,云计算付费用户数量突破100万,单季度营收高达24.31亿元,并维持连续多个季度增长率超过100%。如今2018年也已经过半,中国云计算行业和中国企业上云盛况又有什么新的变化呢?

    记者通过对多个上云企业进行实际调查并结合权威IDC机构的研究报告发现, 当前的中国企业不仅积极上云,而且为了满足更多样化的需求,表现出新的特征,有越来越多上云企业从单一的采购公有云转变为采用公有云加私有云的混合云架构,或者从多个云厂商采购异构资源的多云架构。这一结果也与行业发展现状不谋而合,那就是企业的云架构正在逐步向混合云、多云等更为复杂的系统转变,公有云、私有云、混合云、多云并存的大格局初现端倪。

    新的大环境下,企业无法再像以前那样轻松上云,而是要花费更多代价去对越来越复杂的云系统进行优化和管理。为了应对市场需求的变化,云计算管理平台随之出现和发展壮大,这是中国云计算市场新的重要特点之一。云计算管理平台可以通过一个控制台集中管控企业的多云资源和混合云资源,解决企业在面临越来越复杂的云环境下的运维管理难题。它的出现和发展具有明显的市场规律性,企业上云的程度越深,对云计算管理平台的需求也会越迫切。云计算管理平台也因此成为当下云计算衍生产业中最活跃的的一个领域,相关产品的市场竞争相当激烈。

    宇宙世代混合云

    记者通过查证得知,目前仅国内推出的云计算管理平台就已经有数十个之多,其中包含阿里云、腾讯云等传统云厂商自建的平台,也包括行云管家、云星数据、安畅网络等创业公司推出的新型云计算管理平台,另外也有部分国外厂商进入国内市场,如来自韩国的Bespin Global .而其中又以国内创业型公司推出的产品发展势头最为良好,如2016年7月面市的行云管家在推出一年后宣布企业用户数达到25000家,这一数据在2018年5月达到40000家,增长速度非常迅猛并将在未来一定周期内享受云计算发展的市场红利,维持高速扩张态势。

    时至今日,云计算作为一种基于规模经济和共享分配机制的计算资源,已经真正成为一种像水和电一样的基础设施,企业可以按需购买即买即用,不仅成本低而且支持弹性扩容,创业企业再也不用花大笔前期投入自建机房,只要通过云计算就能快速组建自己的IT系统,云计算的众多优势是云产业脱颖而出赢得迅猛发展的直接动力。但市场总是在不断的变化之中,上云企业的实际需求也在不断变化,从公有云、私有云的快速崛起,到公有云、私有云、混合云、多云的四分天下,中国云计算产业进入了新的发展周期。云计算管理平台的出现和完善正是为了迎合与应对这种市场转变,具有鲜明的市场规律性,它将伴随着中国云计算产业的持续拓展而深入更多上云企业群体,成为新的发展周期的重要代表性产品及领域之一。

  • ?

    VMware云管平台运维管理

    仲诗槐

    展开

    内容来源:2018年1月30日,VMware大中华区高级技术讲师姚泉在“VMware官方在线直播”进行《VMware云管平台运维管理》演讲分享。IT 大咖说(ID:itdakashuo)作为独家视频合作方,经主办方和讲者审阅授权发布。

    阅读字数:4068 | 6分钟阅读

    获取嘉宾演讲视频回放及PPT,请复制链接:http://t/EPS6oe0,粘贴至浏览器即可。

    摘要

    跨 SDDC 和多云环境从应用到基础架构的智能 IT 运维管理。与 vRealize Log Insight 和 vRealize Business for Cloud 集成的 VMware vRealize Operations 通过统一监控、自动执行的性能管理、云计算规划和容量优化,可帮助规划、管理和扩展 SDDC 和多云环境。

    VMware云管平台

    所有的云管平台底层都是要基于软件定义的数据中心。VMware专门提到了软件定义数据中心,就是用软件的方式对底层的基础架构进行虚拟化,包括服务器虚拟化、存储虚拟化和网络虚拟化,分别由不同的产品去实现。

    有了这些基础架构之后,对整个数据中心都做了软件定义。那么在上层如何做高效的管理呢?VMware就推出了一个云管平台,叫做vRealize。在这个套件中有很多核心组件,来共同实现平台的自动化管理。其中有三大块内容,一个是自动化部署的vRA,一个是做智能运维的vR Ops,以及做成本分析的vRB,这三块共同支撑起了云管平台。

    这期我们重点来介绍vR Ops。

    当我们面对一个云计算平台的时候会发现,在云平台中最大的特点就是用户群非常大,尤其是公有云,成千上万甚至有可能会过亿的用户都有可能会请求一些虚拟机去使用。用户在请求这些资源的时候如果要后台的管理员按照传统虚拟机的部署去做批量部署的话,时间会很长,效率也很低。

    有了云管平台之后,可以通过特定的组件让用户自助式地请求机器,而平台就会把流程自动化部署出来。这就是通过vRA做机器的自动化部署,使得性能更加高效。

    当环境规模很大的时候,机器非常多,如何进行性能的分析、监控,以及故障的管理呢?这就需要一个高智能的软件,这个软件就是vR Ops。

    通过vR Ops可以对大规模云平台里的机器进行智能的性能分析。但是作为租户来说,在使用这些云平台资源的时候,每个人用的资源和服务是不一样的,最终成本也有所不同。

    为了对用户使用的资源进行智能的成本分析,于是我们做了vRB,让用户知道自己的钱花在了什么地方。

    vRealize Operations——云运维智能化

    在整个平台中,vRealize Operations实现了性能的管理、容量管理、成本管理、配置管理以及合规性管理。

    vRealizeOperations可以对底层的不同平台进行连接,它可以管理虚拟平台、物理平台,甚至可以管理一些云平台。换句话说,整个云管平台其实是跨平台兼容的。

    vRealize Operations Manager控制台

    我们从6.6开始改版后的一个全新界面,我们引入了一个全新的基于HTML5的用户管理界面。

    登录之后如果选择任何一个对象,比如选择一个主机,就能看到这个主机相关的一些性能参数指标。这里有非常重要的三个指标,一个是健康,一个是风险,还有一个就是效率。

    登录首页

    如果是首次登录Operations Manager,可以看到首页与之前的首页略有不同。

    在页面顶部有五个选项卡,分别代表五块核心功能。左侧有一些简单的导航栏,中间则是一些具体的参数信息显示,尤其是当前需要采取的一些行动,这对用户来说是非常关键的。右上角是一些简单的菜单。在这样的界面中用户能得到一个全新的体验。

    预定义仪表盘

    打开第二个选项卡,就能看到一些核心的功能,也就是预定义仪表盘。在整个环境中,仪表盘非常重要。因为每一个仪表盘里面都会显示出不同的内容、指标和参数。

    页面左侧有一些系统自定义的仪表盘,同样可以对这些仪表盘进行管理,比如编辑、新建甚至设为默认页。

    警报

    在Operations Manager里面,警报是一个智能警报。智能警报不仅可以告诉用户出现了什么问题,还能告知出现问题的原因,甚至能给出解决问题的方案。通过智能警报能让用户直观地了解到系统出现的问题。

    环境

    在环境中,用户可以针对不同的对象去看到所有的核心指标。在页面右侧有三列绿色图标分别代表着健康、风险和效率,它们的图标形状各不一样。

    在Operations Manager中,图标的颜色有四种,绿色、黄色、橘黄色和红色。绿色就表示当前状态一切正常,红色则代表着出现了严重的问题。用户可以通过颜色判断当前环境哪一个业务需要及时进行调整。

    查看相关对象

    用户可以通过某些特定的对象查看到相关联的对象。在界面中,通过一个对象的点击,就可以看到该对象的其它相关联对象。

    查看对象细节

    比如点击一个主机,就可以看到该主机关联的虚拟机、存储、网络等等,非常方便地让用户对这些对象有一个初步的了解和认识。点击任何对象,页面右侧就会显示出该虚拟机的参数信息,用户可以通过这些参数信息获取到自己所需的信息。

    查看对象关联关系

    也可以通过拓补图查看到对象彼此间的关联关系,都是非常智能的。而且很多图表都可以根据用户自身的需求去进行选择。

    管理页面

    在用户管理的时候可以选择一些具体的参数,管理员能够做到一些集中化的管理。

    数据流结构

    vRealizeOperations实例包含若干个组件用来收集和传输数据。

    vRealize Operations数据库

    vRealizeOperations 包含以下数据库:文件系统数据库、集中式vPostgres、警报/症状vPostgres、HIS vPostgres和Cassandra。

    安装和配置

    第一步要部署一个OVF,因为Operations Manager本身就是一个封装好的OVF模版,把虚拟机下载好直接部署到环境里就可以了。

    部署完OVF之后,可以进行一些初始的配置。在配置的时候需要打开相应界面做一些初始化的工作。如果规模比较大,可能会涉及到需要创建数据节点、数据的远程收集节点等等。因为规模大或者要进行跨栈点数据采集的话,只用一个节点不能满足我们的需求,这样就需要一个主节点和备节点,也可能需要一个远程的数据采集节点。

    只要部署一个Operations Manager的节点,其实从理论上来说就已经足够了。之后就会进入产品的用户界面去做一些初次的尝试和使用。整个部署过程相对来说并不复杂。

    集群规模

    在部署的时候可能会涉及到一些集群规模。比如Operations Manager的一个主栈点根据它所管理的对象数量不同,CPU内存的配置也不一样。用户可以根据自身的需求进行选择。

    vRealize Operations 6.6 的新特性

    更易于使用同时加速产生价值

    更简单更易用。新的HTML5的用户界面提供了一个更简单的和一致的体验。

    更快捷的导航。全新“入门”仪表盘让你快速定位到需要的地方。

    加速诊断恢复,人性化的仪表盘可在一个地方集中提供答案。仪表板被分成类别,如操作、容量和利用率,性能测试、负载平衡、配置和合规。

    加速产生价值。开箱即用的集成,例如存储(vSAN), 日志(vRLI), 业务(vRBC) 和自动化(vRA)。

    内嵌vSAN管理

    完成的vSAN管理。允许集中管理在延伸集群,完整的存储管理能力,包括管理绩效、能力、日志、配置和健康。

    从单个控制台确认vSAN准备就绪,完整可视性让vSAN部署更有信心。通过性能和容量监控运维vSAN环境。

    SDDC健康概览仪表盘

    单一控制台监控整个SDDC的状态。

    扩展支持。SDDC-应用-运维-视图及针对每个产品的健康分类;SDDC-应用-组件关联到底层基础设施的健康状态(部署实例及虚机健康一致性);增强的开箱即用;健康和合规,报警与改进建议。

    热图

    在Operations Manager中有一个非常重要的功能叫做热图。热图可以实时对比所选虚拟机指标的性能,它一般包含一个或两个指标,一个指标定义图中方块大小,另一个指标定义图中方块颜色。

    Project

    Project在之前的版本中叫做“what if”。“what if”可以翻译为“假设”,假设将来添加或删除了若干对象,那么资源还能够用多久。

    容量模型预测

    通过project 功能, 可以快速预测未来资源变化带来的影响。

    原始告警-- >智能告警

    在原始告警中,只是根据系统的运行状态做一个简单的监控,然后做一些静态的警报触发,这里有一个参数叫做静态阀值。静态阀值指的就是设定一个固定的参数,当监控系统发现这个指标超过阀值的时候就会机械地发出警报。这时用户可能会收到不必要的警报。

    动态阀值会智能地分析过去一段时间的历史趋势,并告诉用户在什么时间段达到怎样的峰值状态是正常现象,在其它时间段达到怎样的峰值是不正常现象。这是一个智能的表现。

    静态阀值引会起过度告警,而动态阀值能够逐渐学习并识别高负载但健康的状态。阀值根据负载情况和时间段不同会有相应的波动。

    减少调查和解决问题的时间

    Alerts减少调查问题的平均时间,Recommendations减少解决问题的平均时间。

    动态阀值对发现故障有什么意义

    传统监控只能设置静态阀值,往往具有误导性。业务高峰期间,VM的资源使用率处于很高的水平是正常的。静态阀值会显得过于敏感,会生成不必要的告警。业务非高峰期间,即使VM资源使用只达到50%,也可能是异常情况,而静态阀值会忽略这类异常。

    静态阀值仅考虑上限,而不考虑下限也是不够的。当CPU或RAM的使用率突然降到5%以下,有可能是严重事故的前兆。例如存储延迟突然增大引起的应用响应速度急剧下降,或整个存储的IOPS突然全面下降可能意味着存储机头的严重问题。监控工具也不会做任何提示。

    智能工作负载放置

    智能工作负载放置功能可以借助DRS决定工作负载放置的最好位置。重平衡功能建议工作负载的迁移位置。

    DRS 管理–完成DRS 控制

    确保DRS配置。查看DRS设置,满足业务需求。通过参数设置是否激进以及是否完全自动化,可以从vROps中进行修改。

    查看vMotion趋势记录有多少是生成环境,以及是否符合预期。

    增强了自身负载均衡功能

    完全自动化的工作负载平衡。

    保证性能,横跨数据中心的全自动工作负载均衡能力。跨集群(Cluster)和数据存储(Datastore)来进行负载均衡;更方便地根据业务需要来控制负载均衡的程度;三种方法来激活负载均衡功能:手动、自动、定时;能强大的仪表盘:监控和调节关于负载均衡的状态和参数;

    确保DRS配置,查看和设置DRS设置以获得更好的平衡。

    避免争用。在资源争用发生前,产生可预见的DRS 动作。

    最佳初始部署。使用vRA,利用运维分析优化工作负载的初始部署位置。

    应用案例及常用使用场景

    云平台特点

    负载动态变迁,运行环境不固定,状态难以跟踪。

    配置变化更快,资产生命周期短,统计分析难。

    资源动态分配,虚拟机之间既共享又竞争,资源边界弹性化。

    新技术,新特性,安全管理新要求。

    系统高度融合,组件之间依赖性更高,影响分析难。

    用户痛点

    1.由于Cloud环境的资源共享和动态配置特性,云环境下的资源管理变得更加复杂难控,资源的惊人浪费和局部资源的紧张情况同时存在存在。

    2.安全管理上基本无针对虚拟化环境的管理规范,手段及工具,安全短板问题较明显。

    3.资产配置信息缺乏深入及时准确的统计分析,基本靠手工,信息与实际环境偏差较大。

    4.缺乏相关分析报表和面板视图,对于云环境较大规模的环境缺乏全局管理能力。

    5.虚拟化环境缺乏有效的监控措施,管理被动,问题无法及时发现,出现无法有效分析。

    6.缺乏自动化工具,对大规模高度动态环境缺乏足够的响应和控制管理能力。

    容量优化

    优化资源配置,提高现有资源利用率。发现并回收低效、未使用的容量,发现容量不足和超额配置情况,以便合理调整虚拟机大小、回收闲置资源,在不影响性能的情况下优化整合率和虚拟机密度。

    容量规划

    vROps借助VMware对vSphere和云计算环境的深入理解,提供了智能的容量分析和规划能力,包括对vSphere虚拟化环境的CPU, 内存, 存储以及网络等资源的现有容量使用情况统计, 容量使用趋势, 进而帮助运维管理人员合理规划虚拟化环境的资源, 避免资源耗尽及资源浪费, 提高虚拟化效率。

    配置管理

    提供详尽而持续的配置数据收集、配置评估和更改审核,提供统一配置数据报告,帮助用户及时掌握虚拟化环境资产信息。

    运行分析

    专家报表:提供多种类型的针对虚拟化环境的分析报表。

    专家面板:1.从健康,风险,效率等角度综合展示虚拟化环境的整体运行态势;2.提供多指标对比分析热图;3.提供综合虚拟机,网络,存储的拓扑面板展示。

    故障管理

    全面的指标覆盖:vSphere,NSX,vSAN,结构化数据及非结构化数据,综合指标。

    故障分析:动态阈值,综合分析,专家知识。

    故障解决:自动化故障处理。

    对于Operations Manager,我们还提供了多达100+种扩展管理包,涵盖网络、存储、数据库、中间件和企业应用等多种类型组件。

    相关练习资源

    vROPsHOL资源访问:http:...

  • ?

    4张图让你了解:云管理平台系统如何进行资源管理的?

    钱思天

    展开

    资源管理-纳管对象

    1、物理机资源管理

    物理服务器可被手动发现或根据预定义策略自动发现并成为可被管理和调度的计算资源

    2、存储资源管理

    NAS、SAN等共享存储纳入管理,使其成为可用的存储资源

    3、网络资源管理

    接入交换机、防火墙、负载均衡器以及虚拟交换机(含分布式虚拟交换机)等网络资源纳入管理,并可根据网络规划实现平台端到端网络的部署。

    4、虚拟资源管理

    虚拟资源作为服务,实现生命周期管理以及资源动态、弹性、按需的流程化、自动化调度

    5、集群管理

    实现资源池的集群化管理,集群划分原则灵活可配,并通过区域划分的理念实现不同级别平台的部署。

    6、业务容器管理

    实现以平台为单元进行管理,基于单一平台对象实现平台内部的IT基础资源的运维配置

    资源管理-清单与拓扑

    资源管理-集群管理

    集群管理支持对集群的创建、修改、保存、查询、删除等操作

    集群配置包括集群名称、集群类型、资源分区、集群策略以及集群安全等

    资源管理-平台资源管理

    视图管理:为业务平台提供统一、完整的网络拓扑结构和状态信息,使用户能够在拓扑图上直观的掌握整个业务平台的拓扑结构、各个节点的运行情况以及各节点占用资源情况

    配置管理:信息配置、属性配置、资源配置、对象配置、日志管理等

  • ?

    云管理平台(CMP)的典型应用场景

    代云

    展开

    云星数据是国内领先的云管理平台提供商,也是全球混合云领导者RightScale在国内的唯一合作伙伴,云星数据的云管理平台团队整理过去几年在金融、制造、互联网等行业实施的多个项目经验,总结出以下云管理平台使用的典型场景。

    1.双模IT下,构建混合云体系

    Gartner预测“双模IT”将成未来企业IT建设主流,稳态系统:稳态系统是传统和保持连续性的业务,其中包含海量数据和/或事务,旨在维持高度的可靠性与稳定性。由于这些应用不需要经常变更,只需每年交付一、两个大型新版本,即可满足业务的需求。敏态系统:敏态系统是探索和非线性创新业务,这类应用必须易于使用、性能卓越并支持快速调整,以应对不断变化的客户与市场需求。敏态需要密切关注用户体验、交付速度与敏捷性。

    云管理平台使企业能够统一编排多厂商的异构云服务和技术产品,构建涵盖覆盖IaaS、PaaS、DaaS的云服务治理体系,如下图所示:

    图:双模IT下的混合云架构

    2.构建基于云计算的IT运营管理系统

    包括:

    企业IT进行运营管理的转型,构建异构云平台,改变应用+应用的建设模式到应用+平台的运营管理模式,并对IT资源的使用进行审批、计量、计费。

    集团型企业,对集团内云资源进行统一纳管,并通过统一的运营管理和计费计量,改变传统的IT软硬件资产购买方式到云服务的按量付费模式。

    传统集成或云服务提供商,利用多云管理平台,整合云服务目录,构成云服务集市,为其客户提供更灵活,快捷的多云服务。

    对云服务体系进行治理和控制,有些企业CIO对其云资源的使用没有太多的治理和控制,因此需要云管理平台在通过自服务提高效率同时,增加治理和管控措施。

    图:RightCloud云管理平台在企业总体云体系中的运营管理能力

    3.自动化与智能化,提高运维管理效率

    企业IT的管理需要面对各种日常重复性,批量性工作:如补丁分发,巡检,应用部署,系统配置管理等,需要耗费运维管理人员大量的精力,而且还要面对人工操作失误的风险。在这种情况下,云管理平台的自动化功能可以:a)模块化、可视化编排自动化部署模板,让部署工作具有可植性,支持在任何云上快速自动化部署相同应用环境,让开发、质量保证和生产阶段之间保持环境一致性;b)自动化:配置检查、巡检、应用部署等重复性工作;c)根据智能策略进行应用环境动态弹性伸缩,全面满足业务性能需求。D)对云环境下云服务、虚拟机、容器以及物理机的统一监控接入与智能告警。

    图:RightCloud云管理平台全栈自动化管理能力

    4.构建支持DevOps体系的开发测试云

    在技术和环境快速变化的情况下,企业需要更加敏捷和快速的应用开发、测试和部署体系来支持业务的创新。这种情况下, 敏捷开发和DevOps在开发测试中的应用变得非常重要。 云管理平台可以帮助开发、测试以及运维人员实现应用全生命周期的自动化管理,包括创建环境、软件安装、代码部署、自动配置、监控告警和自动伸缩等,打通从代码到服务的转化通道,实现云应用的持续交付。

    图:RightCloud与DevOps

    5.管理和优化云环境,降低云费用

    根据RightCloud云成本分析的历史数据,RightCloud发现,以下方面可以通过云成本分析和优化,来降低约30%的云资源使用成本:

    发现和清理僵尸主机;

    优化配置:提供云资源实例在不同资源池的配置优化建议和自动化管理;

    利用率管理:跟踪哪些虚拟机未充分利用,并利用弹性伸缩组来启动自动资源弹性收缩的流程。

    自动关闭和开启系统:利用实例的定时计划启动和结束,完成后自动关闭。

    工作负载的弹性扩展:根据需求来上下调整工作负载,而不是一开始就将配置提升到最高使用范围。

    存储策略:实现自动化查找和删除旧存储并终止未使用的卷。

    RightCloud云管理平台:统一管理控制私有云和公有云环境,实现:降低成本,提高管理效率,确保IT服务质量

    您可以在专有环境内部署RigthCloud去管理控制您私有云和公有云的资源和使用,或者通过以下链接直接使用SaaS在线版本。 rightcloud

  • ?

    支撑云计算的五大关键技术

    冷玉

    展开

    云计算系统运用了许多技术,其中以编程模型、数据管理技术、数据存储技术、虚拟化技术、云计算平台管理技术最为关键。

    (1)编程模型

    MapReduce是Google开发的java、Python、C++编程模型,它是一种简化的分布式编程模型和高效的任务调度模型,用于大规模数据集(大于1TB)的并行运算。严格的编程模型使云计算环境下的编程十分简单。MapReduce模式的思想是将要执行的问题分解成Map(映射)和Reduce(化简)的方式,先通过Map程序将数据切割成不相关的区块,分配(调度)给大量计算机处理,达到分布式运算的效果,再通过Reduce程序将结果汇整输出。

    (2)海量数据分布存储技术

    云计算系统由大量服务器组成,同时为大量用户服务,因此云计算系统采用分布式存储的方式存储数据,用冗余存储的方式保证数据的可靠性。云计算系统中广泛使用的数据存储系统是Google的GFS和Hadoop团队开发的GFS的开源实现HDFS。

    GFS即Google文件系统(GoogleFile

    System),是一个可扩展的分布式文件系统,用于大型的、分布式的、对大量数据进行访问的应用。GFS的设计思想不同于传统的文件系统,是针对大规模数据处理和Google应用特性而设计的。它运行于廉价的普通硬件上,但可以提供容错功能。它可以给大量的用户提供总体性能较高的服务。

    一个GFS集群由一个主服务器(master)和大量的块服务器(chunkserver)构成,并被许多客户(Client)访问。主服务器存储文件系统所以的元数据,包括名字空间、访问控制信息、从文件到块的映射以及块的当前位置。它也控制系统范围的活动,如块租约(lease)管理,孤儿块的垃圾收集,块服务器间的块迁移。主服务器定期通过HeartBeat消息与每一个块服务器通信,给块服务器传递指令并收集它的状态。GFS中的文件被切分为64MB的块并以冗余存储,每份数据在系统中保存3个以上备份。

    客户与主服务器的交换只限于对元数据的操作,所有数据方面的通信都直接和块服务器联系,这大大提高了系统的效率,防止主服务器负载过重。

    (3)海量数据管理技术

    云计算需要对分布的、海量的数据进行处理、分析,因此,数据管理技术必需能够高效的管理大量的数据。云计算系统中的数据管理技术主要是Google的BT(BigTable)数据管理技术和Hadoop团队开发的开源数据管理模块HBase。

    BT是建立在GFS,Scheduler,Lock

    Service和MapReduce之上的一个大型的分布式数据库,与传统的关系数据库不同,它把所有数据都作为对象来处理,形成一个巨大的表格,用来分布存储大规模结构化数据。

    Google的很多项目使用BT来存储数据,包括网页查询,Google

    earth和Google金融。这些应用程序对BT的要求各不相同:数据大小(从URL到网页到卫星图象)不同,反应速度不同(从后端的大批处理到实时数据服务)。对于不同的要求,BT都成功的提供了灵活高效的服务。

    (4)虚拟化技术

    通过虚拟化技术可实现软件应用与底层硬件相隔离,它包括将单个资源划分成多个虚拟资源的裂分模式,也包括将多个资源整合成一个虚拟资源的聚合模式。虚拟化技术根据对象可分成存储虚拟化、计算虚拟化、网络虚拟化等,计算虚拟化又分为系统级虚拟化、应用级虚拟化和桌面虚拟化。

    (5)云计算平台管理技术

    云计算资源规模庞大,服务器数量众多并分布在不同的地点,同时运行着数百种应用,如何有效的管理这些服务器,保证整个系统提供不间断的服务是巨大的挑战。

    云计算系统的平台管理技术能够使大量的服务器协同工作,方便的进行业务部署和开通,快速发现和恢复系统故障,通过自动化、智能化的手段实现大规模系统的可靠运营。

  • ?

    2017全球十大云计算平台市场占有率排行榜

    代荷

    展开

      从Google首席执行官埃里克·施密特(Eric Schmidt)首次提出“ 云计算 ”(cloud computing)的概念到现在,云计算已经走过了炒作期和实践期,已经处于成熟期。同时,行业集中度也越来越高并呈逐渐加强的趋势,目前业内大公司已经占据了整个市场的半壁江山。

      Synergy Research Group根据2017年市场占有率的多少和市场增长率的快慢对全球几大云计算平台进行了调查和排名,亚马逊AWS依然名列榜首。以下是全球十大云计算平台市场占有率排行榜。

      1.亚马逊AWS

      亚马逊AWS于2006年推出,是全球最早推出的云计算服务平台,面向全世界的客户提供云解决方案,包括弹性计算、存储、数据库、应用程序在内的一整套云计算服务,降低企业IT投入成本和维护成本。

      “先下手为强”,亚马逊AWS投入早、运行时间长,目前仍是云计算领域的老大哥。在AWS计算领域中Amazon Elastic Compute Cloud (Amazon EC2)是代表性产品,它是一种 Web 服务,可根据计算要求提供大小可调的计算容量。在存储服务中,Amazon S3 提供了一个简单的 Web 服务界面,用户可通过它随时在 Web 上存储和检索任意数量的数据。在数据库服务中,Amazon Relational Database Service (Amazon RDS) 是一种可让用户在云中轻松设置、运维和扩展关系数据库的 Web 服务。此外在网络和内容分发、移动服务、开发人员工具、应用程序服务等领域亚马逊AWS都有出色的产品。

      在2017 AWS Re:Invent会上,Amazon 又宣布推出5项机器学习新服务,包括Amazon SageMaker、Amazon Transcribe、Amazon Translate、Amazon Comprehend、Amazon Rekognition Video以及一款面向开发者的深度学习型无线摄像机AWS DeepLens。

      此外,亚马逊AWS也加快扩展中国市场的步伐。今年12月12日,亚马逊AWS在中国的第二个运营区域——中国(宁夏)区域正式开放,将会实行一轮降价措施,或给当前国内云计算市场带来强有力的价格冲击。

      2. 微软Azure

      微软 Azure是微软基于云计算的操作系统,最初名称是Windows Azure,主要目标是为开发者提供一个平台,帮助开发可运行在 云服务 器、数据中心、Web和PC上的应用程序。Azure是一种灵活和支持互操作的平台,它可以被用来创建云中运行的应用或者通过基于云的特性来加强现有应用。该平台目前具备以下功能:网站、虚拟机、云服务、移动应用服务、大数据支持以及媒体功能的支持。

      在此次Synergy Research Group的调查统计中微软Azure排第二,虽然没有亚马逊AWS的功能全面,微软Azure也形成了独特的优势。它支持大量开源应用程序、框架和语言,并且数量仍在增加;融合本地 IT 设施和 公有云 ,是最适合混合 IT 环境的公有 云平台 ;数据中心有多家主流运营商接入,网络访问性能有保证;数据和服务的安全性也是其一大优势。

      11月1日,在北京举行的2017微软技术暨生态大会上,微软宣布在中国运营的Microsoft Azure的云计算规模将在未来6个月完成三倍扩容。11月27日,微软与知名企业软件公司 SAP宣布将合作进军云服务市场,以提高微软的云端业绩,尤其是IaaS 服务。

      3. IBM

      IBM一直专注于云计算、网络安全和数据分析,今年11月1日IBM宣布推出全新IBM Cloud Private平台,可以帮助企业利用类似公有云的能力,构建本地部署的私有云环境,是一个集IaaS、PaaS及开发者服务所需的创建、运行和管理 云应用 于一身的集成平台。

      全新的IBM Cloud Private平台安装极其简便,一键即可实现安装、添加、删除节点,还能够根据相关指标定时弹性伸缩。同时,IBM Cloud private支持异构平台,不仅可以安装于VMWare、OpenStack、物理机上,还支持X86和POWER Linux,由客户自己管理,不需要再连线IBM,投产就可用。集成了Istio、服务目录、VMWare NSX-T等,支持Ceph、Gluster 、GPFS 存储、MicroService Builder中间件镜像的开箱即用。

      早在9月份,IBM 还推出了一款“拉杆箱”——Cloud Mass Data Migration,里面是一套容量 120TB 的存储系统,可以让用户快速的将本地数据上传到 IBM 的 云存储 中。

      4.谷歌 云平台

      谷歌公司不是传统的IT厂商,而是新型的网络公司。基础架构和平台是谷歌 云服务 的两大竞争优势。谷歌云平台服务分为四大类:

      1.计算:谷歌计算引擎作为基础架构即服务(IaaS);平台即服务有谷歌App Engine;以及谷歌容器引擎,一套使用 Kubernetes来达到集群管理和自动化的Docker容器镜像 。

      2.存储:谷歌 云存储

      3.网络:谷歌云DNS和Interconnect

      4.数据库:Google Cloud SQL,Google Cloud Datastore和Google Cloud BigTable

      今年9月份谷歌云宣布收购了Bitium,Bitium专注于为基于云的应用程序提供企业级身份管理和访问工具。这次收购能够帮助Google可以更好地管理企业云客户,包括为跨Cloud和G Suite产品的应用程序设置安全级别和访问策略。

      5. Salesforce

      Salesforce是一家客户关系管理(CRM)软件服务提供商,提供随需应用的客户关系管理。作为全球CRM行业的领导者,Salesforce 在客户关系管理领域的专业度是毋庸置疑的。该公司勾勒出的云战略中包括SaaS和PaaS。该公司的 云计算 产品包括Force(定制软件开发)、Heroku(Ruby平台服务)、Database、Salesforce Data、Salesforce Chatter、Salesforce Sales Cloud和Salesforce Service Cloud。

      今年Salesforce已经将AI整合进许多产品中,与IBM合作将Einstein与Watson合并,以便用户扩充数据。Salesforce还利用AI来让用户更轻松地获取他们所需的信息,它提供的一款名为Optimus Prime的内部工具用以组织和清理数据。通过分析用户在Salesforce上已有的数据来添加服务对Salesforce来说是一个很大的机遇。

      6. 阿里云

      阿里云创立于2009年,是目前国内云计算领域的龙头,由阿里云自主研发、服务全球的超大规模通用计算操作系统飞天,目前为全球200多个国家和地区的创新创业企业、政府、机构等提供服务。基于阿里云飞天操作系统强大的计算能力,阿里的人工智能ET拥有全球领先的人工智能技术,目前已具备智能语音交互、图像或视频识别、交通预测、情感分析等技能。

      今年9月21日,阿里云发布全新一代云数据库产品POLARDB,采用第三代分布式共享存储架构,实现计算节点和存储节点分离,使计算引擎和存储引擎均拥有快速扩展能力;在2017杭州?云栖大会期间阿里云又发布了一系列突破性成就,“达摩院”支持研发的量子技术领域迎来了首个重量级发布—— “量子计算云平台”上线、BigBench数据规模首次扩展到100T、流计算2.0每秒峰值达千万QPS整体链路延时亚秒级、E-MapReduce对比同类产品平均性能提升3倍。

      阿里云在中国遥遥领先的同时开始扩展海外市场,10月30日,阿里云宣布其马来西亚大区(Region)正式面向全球开放服务,阿里云将为该区域市场提供计算、存储、网络等互联网基础设施服务,同时为当地企业数字化转型提供互联网中间件、人工智能产品和服务。此外,阿里云也将在欧洲建立数据中心。

      7.Oracle

      Oracle云是一款功能强大、统一的云解决方案。 它提供了全面、集成的云服务,可帮助业务用户和开发人员在云端或内部部署环境中无缝、经济高效地构建、部署和管理负载,是少有的几家能完整覆盖IaaS、PaaS、SaaS及DaaS层面云服务的公司。

      Oracle的成功主要来自于数据库业务,许多公司使用他们的数据库来运行其关键业务,数据库业务仍然是Oracle最大的收入来源。2017财年甲骨文云业务总收入超过46亿美金,年增长超过60%,是全球发展最快的云公司之一。

      在刚过去的2017甲骨文全球云大会上,甲骨文发布了多项产品和技术创新:最新发布的Oracle数据库18c,凭借机器学习实现自治驱动、自治修复数据库和联机事物处理,有效提升了云端数据库运行的安全性和可靠性;Oracle人工智能平台云服务(Oracle AI Platform Cloud Service)、Oracle区块链云服务、Oracle移动云、Oracle分析云以及Oracle安全和管理云等解决方案全面展现了甲骨文的技术创新。

      据外媒最新消息,Oracle已经同意斥资16亿美元收购基于云计算的建筑软件供应商Aconex,增强其云计算业务。

      8.Rackspace

      Rackspace是全球三大 云计算 中心之一,是一家全球领先的托管服务提供商,在全球拥有10个以上数据中心,管理超过64000台服务器。Rackspace的托管服务产品包括专用服务器,电子邮件,SharePoint, 云服务 器, 云存储 ,云网站等。在服务架构上提供专用托管, 公有云 ,私有云及混合云。同时Rackspace是,AWS与微软Azure技术支持伙伴。

      业内调查表明,企业正在纷纷从企业数据中心转向多云模式,这对云计算市场来说又是一巨大的机遇。今年9月Rackspace公司签署了收购Datapipe公司的协议,其中包括由29个数据中心组成的基础架构。此次收购是Rackspace公司迄今为止最大的收购交易,主要为了满足客户要求更多的多云功能。

      11月,Rackspace又表示,将于HPE合作构建一套根据使用情况向客户收费的私有云服务。Rackspace认为,对于企业来说,付费即用模式的托管私有云是一个有吸引力的选择,这是私有云市场翻开的一个新篇章。

      9. virtustream

      Virtustream成立于2009年,为政府和企业客户提供云端服务,主要负责解决SAP、Oracle等关键应用在云上运行的问题,Virtustream的xStream管理平台及基础设施即服务(IaaS)满足复杂的私有云、公共云或混合云生产应用的安全、合规、性能、效率及基于消费量的计费要求。

      Virtustream是深受全球组织信任的企业级云提供商,其客户包括可口可乐、SAP、多米诺糖业、海因茨以及一系列来自全球各地的服务供应商。VirtuStream在整个云计算市场属于细分市场的挑战者,是托管私有云市场的领导者。2015年被存储巨头EMC公司收购,随后EMC与戴尔合并,VirtuStream成为戴尔旗下事业部。

      VirtuStream借助戴尔的服务提供商生态系统,加速推进其扩张步伐。今年3月28日,Virtustream宣布,该公司面向任务关键型应用的企业 云平台 和服务即日起在澳大利亚和日本等亚太地区供应,此次供应范围包括Virtustream的创新 云技术 和独特的消费量计费模型。

      10. Fujitsu

      2010年7月9日,日本富士通公司正与美国微软公司合作推出云计算业务,富士通和微软在全球范围内共享数据中心,微软把其软件与富士通的客户服务结合起来;富士通开始在群马县馆林市数据中心运行微软云服务,此后将陆续在美国、英国和新加坡等国家的数据中心运行。

      富士通云基础架构解决方案是根据云计算平台架构的需求,以富士通刀片服务器及存储系统为基础,在业界标准的虚拟化技术之上,采用富士通云计算资源的核心组件ROR(Server View Resource Orchestrator)组建的一个预先定义、预先测试验证、标准配置的云计算平台。

      近年来为了增强在云计算领域的竞争力,富士通除了与微软合作,与云计算领域巨头纷纷展开合作。2015年12月,富士通集团与全球云基础架构和移动商务领导厂商VMware宣布双方将开展全新合作,为客户提供灵活、安全的云技术。2016年7月,Oracle和富士通宣布结成合作伙伴关系,以推动企业云计算解决方案的发展。

  • ?

    技术干货 | 云平台的管理与运营——龙腾云BOSS系统

    zxsesame

    展开

    通常意义上理解,云计算是IT技术的升级发展,那么云服务是否就等同于IT服务? 云平台的管理与运营又与传统IT管理有什么区别?企业该如何制定未来的云发展计划?

    IT服务与云计算

    IT服务根据ITIL V3/ISO20000的定义,从技术组成方面,IT服务是一种按照协商一致的质量要求交付给客户的支持信息系统, 是一个或多个支持某项业务流程的IT系统。

    云计算根据NIST(美国国家技术和标准学会)的定义,可以理解为:云计算是种模型,它支持多租户便捷按需地通过网络访问可配置的IT基础设施共享资源池,可以尽可能不需要系统管理员参与的情况下快速提供和发布这些可配置的IT资源。

    IT服务由此从在静态的IT基础设施基础上,经由长时间人工达成协商一致的状态从而保证承诺的质量规范,逐步转变成需要适应云计算提供的这种动态的IT基础设施基础上的多租户自服务实时状态下的保证承诺的更可度量的质量规范。

    无论是公有云还是私有云,云计算aaS也是一种服务,但这种服务是按需的, “按需”意味着这种服务是电信运营商视角的 整合相关IT资源,以时间为尺度,以费用为计量单位的一种端到端的电信运营服务。 因此,规模企业私有云必须要引进电信运营的相关理念才能够顺利的成功实施和运行。

    IT服务管理(ITSM)与电信视角的运营——标准与融合

    标准在IT服务管理/云服务管理运营的实现过程中发挥着关键的作用。

    信息技术基础设施库(ITIL V3)提供了IT服务管理的最佳实施指南框架。考虑到云服务的动态以及多租户自服务等特性, 需要借鉴电信运营商的电信运营视角为这套框架增强资源管理、技术协调以及电信视角的运营能力与标准。

    eTOM(增强的电信运营图)是非盈利全球性电信协会TMF(电信管理论坛)针对于服务供应商的企业流程框架,目的在于为管理企业而制定和实现一套业务驱动的通用流程, 其中包括将与服务交付和长效支持相关的企业支持系统集成起来。

    eTOM规范中eTOM-ITIL联合小组以GB921V和TR143两份文档规范了ITIL流程与eTOM流程的集成、协同以及进一步融合的策略。 eTOM业务流程已成为ITU-T(国际电信联盟电信标准分局)认定的国际标准。

    ITIL V3

    ITIL 第三版认为IT服务具有生命周期,并对应定义了IT服务生命周期相关的五个流程

    eTOM Level1视图(业务流程框架)

    1级eTOM框架显示了支持客户和管理业务所需要的7个端到端的垂直流程组合。其中 eTOM的重点是支持客户运营流程,ITIL流程则在设置OSR后勤运营流程中起到重要的作用。

    eTOM视图提供了从战略、基础设施、产品、运营支撑、开通、保障、收费的服务开发/管理/运营的端到端的流程规范。

    同时,纵向视图中,描述了开通、保障和收费三个纵向端到端的流程群组。这些流程被称为客户运营流程或客户优先流程,直接于客户/租户交互并提供支持,是云运营服务优先关注的部分。

    龙腾云平台基于eTOM/ITIL搭建的BOSS系统,采用服务生命周期编排(LSO Lifecycle Service Orchestration)理论架构,以用户服务为基本单元进行服务架构的搭建。能够处理从客户订单到服务交付的控制,从数据采集到确保性能等级,从故障修复到提供使用报告,再到为客户提供各种分析报告等等的一切业务。在运营上,可以大大增强合作伙伴的运维服务能力。

    龙腾云平台架构——业务运营支撑系统BOSS

    龙腾云平台运营模型视图

    龙腾云业务运营支持系统——BOSS(Business & Operation Support System),面对客户是统一的;面对 BOSS系统业务运营商,它融合了业务支撑系统(BSS)与运营支撑系统(OSS),是一个综合的业务运营和管理支撑平台,同时也是真正融合业务的综合管理平台。

    龙腾云端到端的云平台逻辑架构模型

    为了应对复杂性,端到端云管理以逻辑分层的架构方式显示所有功能模块,对于云管理来说,混合使用eTOM和ITIL V3的方法,可以将所有必须的管理功能组合成一个友好的用户体验,这个用户体验包含用户体验功能、服务和资源管理功能分组(eTOM)、服务生命周期(ITIL V3)。

    用户体验层

    用户门户:用户在这里自助根据服务目录的可用服务选择有服务等级的服务,也可以根据价格选择计算、存储、网络的IT资源。KPI仪表盘/报表:关键性能指标(KPI)提供关于可用性、能力管理、服务水平管理方面的KPI。

    服务管理层

    服务管理与提供给客户的服务有关,与同一层内及其他层的功能进行交互,完成服务管理的任务。

    实现:服务实现负责向客户交付产品和服务,包括:订单处理、服务配置、服务激活、资源供给。保障:服务保障包括主动性和响应性维护活动、服务监控(SLA或QoS)、资源状态和性能监控以及故障排除。包含通过持续的资源状态和性能监控,以便预先检测可能的故障,收集并分析性能数据,以识别和解决潜在的问题。收费和分摊:收集使用情况数据记录,对企业的业务单位提供分摊/反馈。服务编排资源层管理:管理计算、存储、网络、应用程序并负责基础设施的技术性能,控制可用的基础设施功能和容量,提供合适的服务访问性和服务质量。

    服务生命周期

    生命周期服务层确保整个业务服务以及底层的组件紧密配合,确保向业务客户交付需要的功能和服务等级(在指定的时间范围内交付,得到正确的保护并且在客户期望的时候可用。)

    采集层

    负责发现设备、收集数据、对数据做后期处理,并在用户体验层呈现。

    CMDB

    配置管理数据库(CMDB)是传统企业IT运维运营的关键部分,包含了企业业务的所有IT服务,提供将ITIL V3流程和服务绑定的有机关联。CMDB包含的物理的、逻辑的、业务相关概念的数据。

    龙腾云平台的收费与分摊架构

    分摊为IT的使用提供了可见性和价值证明与管理

    企业要怎样高效上云呢?

    云成熟度模型

    如果现状是“基本”、“集中”、“抽象”前三个成熟度级别,建议采用ITSM(IT服务管理)供应商提供的开箱即用的解决方案。同时制定向自动化阶段努力的过渡计划,选择供应商侧重于调整业务流程和组织结构,通过试点或者概念证明的方式以便理解方案对流程或组织的真实影响。

    如果现状是“自动”,或者有一整套完整的ITSM生态系统,可以选择供应商或者开源的云就绪解决方案,同时,进一步完善ITSM体系,结合eTOM的FAB运营流程,进一步适应云的动态按需多租户使用的场景,随着组织和流程的进一步成熟和优化,达到先进的云成熟度阶段。

    龙腾云致力于利用创新技术助力企业数字化、云化的转型,成就敏捷、高效、智能的企业之梦。

  • ?

    简单聊聊最流行的开源云计算平台OpenStack架构

    流星雨74

    展开

    我们知道云计算主要有三种服务模式,IaaS、PaaS和SaaS,其中最底层最基础的就是IaaS。企业级私有云领域,目前IaaS领域的老大就是VMWare公司;在开源领域,最流行的IaaS框架则是OpenStack框架。

    正是因为开源,才让我们可以更深入地了解云计算IaaS的运作机制。通过对OpenStack的架构的介绍,说明OpenStack是如何实现IaaS服务的。

    OpenStack的起源

    在云计算领域,目前Amazon占据了绝对领先的市场地位。Amazon的CEO贝佐斯靠着强硬的行政命令要求开发人员按照SOA理念来进行开发,要求所有程序模块必须要用服务接口把数据和功能开放出来。所有程序模块间的通信,必须通过这些接口进行。

    可以说SOA的设计思想,构成了今天AWS云平台的技术实现基础,同样这种设计思想也被OpenStack所效仿。AWS虽好,但毕竟是商用的,随着云计算的发展,开源云平台解决方案的需求越来越强烈。

    2010年7月,RackSpace和美国国家航空航天局合作合作,分别贡献出RackSpace云文件平台代码和NASANebula平台代码,OpenStack由此诞生。

    AWS分层架构

    OpenStack的架构

    作为Amazon的追随者,OpenStack在技术架构上也与AWS有很多相似之处。OpenStack也是由几个独立的核心功能组件所构成。

    分别是计算(Compute)、对象存储(ObjectStorage)、认证(Identity)、用户界面(Dashboard)、块存储(BlockStorage)、网络(Network)和镜像服务(ImageService):

    Nova:计算管理,云计算IaaS的核心,类似于Amazon的EC2(ElasticComputeCloud)。为用户提供虚拟机的管理,比如创建虚拟机或对虚拟机做热迁移。Swift:对象存储,负责对文件进行存储和检索,也包括镜像文件。Keystone:为用户提供身份验证以及OpenStack服务的授权。Horizon:为用户提供一个模块化的控制面板,基于django框架实现。Cinder:块存储服务,为虚拟机提供虚拟卷。Neutron:为虚拟机提供网络连接,允许用户创建自己的虚拟网络并连接各种网络设备。Glance:负责镜像管理,为虚拟机提供镜像。

    关于每个组件的具体职责,可以参见前文《云计算IaaS管理平台的基本功能有哪些?》

    OpenStack的应用

    国际公有云方面,AWS、AZure都采用了自己的技术来搭建云计算平台。在国内公有云市场中,阿里云、腾讯云也都是用自有技术来搭建各自的云计算平台,没有直接利用OpenStack。

    虽然在公有云市场,应用OpenStack的商业案例还不算多,但在私有云市场,基于OpenStack的项目非常多,远远多于其他的开源云计算框架,如CloudStack、Eucalyptus和OpenNebula等。

    与互联网公司不同,华为倒是非常积极地推进OpenStack技术,和中国三大电信运营商们一并都是OpenStack基金会的黄金会员(GoldenMember),而且为国内外多家电信运营商都部署了基于OpenStack的公有云系统。

    目前OpenStack的黄金会员主要包括传统IT企业,如Intel、NEC、Dell、VMWare等,也包括通信设备商,如华为、Ericsson、Cisco、JuniperNetworks等,也包括最新加入的国内三大运营商。相信虽然OpenStack的参与者越来越多,生态越来越完善,应用项目也会越来越多。

云计算平台管理系统

所有视频需要登录后,才能观看

请先登录您的帐号,即可完整播放,如果您尚未注册帐号,请先点击注册。

img

在线咨询

建站在线咨询

img

微信咨询

扫一扫添加
动力姐姐微信

img
img

TOP