SAS FORMATS基础和概述

2023-10-08 07:40
文章标签 基础 概述 sas formats

本文主要是介绍SAS FORMATS基础和概述,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!



1、  什么是SAS FORMATS?

SAS 的数据类型虽然只有数字( numeric )和字符( character )两种,但是这并不妨碍 SAS 展示其 在数据的读取、转换和展示上的高效、强大和灵活。我想原因之一,就是因为有了 SAS FORMATS 。什么是 SAS FORMATS ?简言而之,就是 SAS 在读取或展示数据时的一些指令。更直白的说,就是 SAS 用来读取和展示数据的一些规则。

话说到此,我们也许会有疑问,平时读取和展示数据时,好像也没用到
SAS FORMATS?

例如数据集test1,在读取时并没有指定什么格式,也没碰到什么麻烦,但How about数据集test2呢?


data  test1;

  input pid $  price;

datalines;

p001 2239.5

p002 456

p003 231.4567

;

run;

 

data test2;

  input pid $ price;

datalines;

 

d1 p001  $2,239.5

d1 p002  $456

d1 p003  $231.4567 

;

run;


其实SAS 在读取或展示数据时,都要按照一定的FORMATS来进行。只是不过如果是标准的数字型(如不带货币符号,千分位号等)和标准的字符型(如字符中间不嵌空格等),SAS 可以按默认的FORMATS来读取,而不必具体指定。如若不是,则需具体指定。如数据集test2,数字、字符均非“标准”的,故需另外指定读入格式。

data test2;

  input pid $ & price dollar9.2;

datalines;

d1 p001  $2,239.5

d1 p002  $456

d1 p003  $231.4567 

;

run;

proc print;

run;

 

2、  SAS FORMATS的分类

SAS FORMATS 最常见的有两类:输入格式( informat )和输出格式( format )。顾名思义,输入格式即 SAS 读入数据的时的规则,输出格式即 SAS 输出数据时的规则。

以上面的
test2 为例,在读入数据集时,由于 pid 变量中间有空格,所以要加“ & ”格式修饰符; price 有货币符号和千分位符号,所以用 dollar 格式读入,在读取时以移除他们。不过 print 的结果并没有显示货币符号和千分位符号,在 explorer 窗口打开数据集,也不见货币符号和千分位符号的踪影。怎么回事?如何才能在结果中看到他们?这就需用到输出格式。

SAS <wbr>FORMATS基础和概述SAS <wbr>FORMATS基础和概述
data test2;

  input pid $ & price dollar9.2;

datalines;

d1 p001  $2,239.5

d1 p002  $456

d1 p003  $231.4567 

;

run;

proc print;

  format price dollar9.2;

run;

 

行文至此,我们或许会问?有必要这样折腾吗?读入的时候去掉货币符号和千分位符号,展示的时候又再加上?直接将 price 变量原样存入不就行了?

硬要说,是可以的,只是要原样存入的话,就只能存入字符型数据,这样做至少有两个缺限:
一是数字变成字符型,再进行相关的加减乘除运算和后继统计分析都会很不方便。
二是增加了存储数据的空间。


其实,个人理解,简单地说,SAS 输入输出格式的作用有点像“脱外套”和“加外套”的关系。读入数据时存储时,要直击其本质,去掉花哨复杂的“外衣”,剥洋葱似的直取其“精华”部分;展示数据时,就像女孩要出门了,得打扮一番,加些漂亮的装饰,变得“好看”了再展现在世人面前。

 

当然 SAS FORMATS 从另一个角度上来说,又分字符型格式和数字型格式,这与 SAS 的数据类型相关。一般来说,字符型格式用于字符型数据,数字型格式用于数据型数据,格式和数据类型应该匹配,否则会出错。

SAS <wbr>FORMATS基础和概述

 

此外, SAS FORMATS 也可以分为 SAS 系统自带的格式和用户自定义格式。上面提到和用的都是 SAS 系统自带的格式 。而用户自定义的格式是指用户用 proc format 定义的格式。例:

proc format;

  value genderfmt 1=''

                  2='';

run;

 

data test3;

  input sid $ gender;

datalines;

s001 1

s002 2

s003 1

s004 2

;

run;

proc print;

 format gender genderfmt.;

run;

结果如下图:

 


 SAS <wbr>FORMATS基础和概述 

 

3、  SAS FORMATS的样貌

SAS 输入输出格式,有着统一的样貌。

<$> name <w> . <d>

 简要说明:

$ :字符型格式必需用的前缀

Name:格式的名称,必需符合SAS 命名规则

W :指定读入或输出的宽度,注意,包括小数点,货币符号、千分位号、负号等

. :无论哪种格式都必需的,不能省略,因为靠他区别格式名和变量名

D :小数位数,只用于数字型格式。

 

偷个懒,截张图,可以看看以下例子。 

 SAS <wbr>FORMATS基础和概述

4、  SAS FORMAST的使用

总结起来,使用的 SAS FORMATS 的方法有以下几种:

²        Iput/put 语句

²        Format 语句

²        Atrrib 语句

²        Iput /put 函数


Input 语句 用于读入数据时指定输入格式, put 语句用于(在 LOG 里)输出时指定格式; format ,attrib 语句可以在 DATA 步或 PROC 步中指定格式。不同的是在 DATA 步中变量和格式是永久关联的,在 PROC 步是暂时关联的。当然在 PUT 语句里也是暂时关联的。

举例说明:

data test4;

  input x dollar 6.2 f1 mmddyy7. f2 date7. t1 mmddyy9. t2 date10.;

  put x=

      /x=dollar8.2

        /f1= f2=

        /t1= t2=; 

  format  f1 date9.;

  attrib  f2 format=mmddyy10.;

 

datalines;

$23.32 110611 06nov11 11/06/11 06nov2011

;

run;

 

proc print;

  format  t1 mmddyy10.;

  attrib  t2 format=mmddyy10.;

run;  

output 结果: 

o

 SAS <wbr>FORMATS基础和概述

log结果:

 
SAS <wbr>FORMATS基础和概述

 

 

简单解释:x dollar格式是暂时关联的,所以在output仍然显示数字格式。

f1,f2 的格式是永久联系的,所以在logoutput f1都是按date9.格式显示,f2 都是按mmddyy10.格式显示。t1,t2 的格式暂时联系的,所以在LOG里还是显示的数字格式,而非mmddyy10.格式。

 

Input put 函数常用于数据类型的转换。如

 

data test5;

 a="21121.67";

 b=21121.67;

 a_n=input(a,dollar9.2);

 b_c=put(a,$8.);

run;

 

SAS <wbr>FORMATS基础和概述



来源:

http://blog.sina.com.cn/s/blog_41889b900100wjz5.html

这篇关于SAS FORMATS基础和概述的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/163742

相关文章

水位雨量在线监测系统概述及应用介绍

在当今社会,随着科技的飞速发展,各种智能监测系统已成为保障公共安全、促进资源管理和环境保护的重要工具。其中,水位雨量在线监测系统作为自然灾害预警、水资源管理及水利工程运行的关键技术,其重要性不言而喻。 一、水位雨量在线监测系统的基本原理 水位雨量在线监测系统主要由数据采集单元、数据传输网络、数据处理中心及用户终端四大部分构成,形成了一个完整的闭环系统。 数据采集单元:这是系统的“眼睛”,

零基础学习Redis(10) -- zset类型命令使用

zset是有序集合,内部除了存储元素外,还会存储一个score,存储在zset中的元素会按照score的大小升序排列,不同元素的score可以重复,score相同的元素会按照元素的字典序排列。 1. zset常用命令 1.1 zadd  zadd key [NX | XX] [GT | LT]   [CH] [INCR] score member [score member ...]

Java 创建图形用户界面(GUI)入门指南(Swing库 JFrame 类)概述

概述 基本概念 Java Swing 的架构 Java Swing 是一个为 Java 设计的 GUI 工具包,是 JAVA 基础类的一部分,基于 Java AWT 构建,提供了一系列轻量级、可定制的图形用户界面(GUI)组件。 与 AWT 相比,Swing 提供了许多比 AWT 更好的屏幕显示元素,更加灵活和可定制,具有更好的跨平台性能。 组件和容器 Java Swing 提供了许多

【Linux 从基础到进阶】Ansible自动化运维工具使用

Ansible自动化运维工具使用 Ansible 是一款开源的自动化运维工具,采用无代理架构(agentless),基于 SSH 连接进行管理,具有简单易用、灵活强大、可扩展性高等特点。它广泛用于服务器管理、应用部署、配置管理等任务。本文将介绍 Ansible 的安装、基本使用方法及一些实际运维场景中的应用,旨在帮助运维人员快速上手并熟练运用 Ansible。 1. Ansible的核心概念

AI基础 L9 Local Search II 局部搜索

Local Beam search 对于当前的所有k个状态,生成它们的所有可能后继状态。 检查生成的后继状态中是否有任何状态是解决方案。 如果所有后继状态都不是解决方案,则从所有后继状态中选择k个最佳状态。 当达到预设的迭代次数或满足某个终止条件时,算法停止。 — Choose k successors randomly, biased towards good ones — Close

【编程底层思考】垃圾收集机制,GC算法,垃圾收集器类型概述

Java的垃圾收集(Garbage Collection,GC)机制是Java语言的一大特色,它负责自动管理内存的回收,释放不再使用的对象所占用的内存。以下是对Java垃圾收集机制的详细介绍: 一、垃圾收集机制概述: 对象存活判断:垃圾收集器定期检查堆内存中的对象,判断哪些对象是“垃圾”,即不再被任何引用链直接或间接引用的对象。内存回收:将判断为垃圾的对象占用的内存进行回收,以便重新使用。

音视频入门基础:WAV专题(10)——FFmpeg源码中计算WAV音频文件每个packet的pts、dts的实现

一、引言 从文章《音视频入门基础:WAV专题(6)——通过FFprobe显示WAV音频文件每个数据包的信息》中我们可以知道,通过FFprobe命令可以打印WAV音频文件每个packet(也称为数据包或多媒体包)的信息,这些信息包含该packet的pts、dts: 打印出来的“pts”实际是AVPacket结构体中的成员变量pts,是以AVStream->time_base为单位的显

C 语言基础之数组

文章目录 什么是数组数组变量的声明多维数组 什么是数组 数组,顾名思义,就是一组数。 假如班上有 30 个同学,让你编程统计每个人的分数,求最高分、最低分、平均分等。如果不知道数组,你只能这样写代码: int ZhangSan_score = 95;int LiSi_score = 90;......int LiuDong_score = 100;int Zhou

Java 多线程概述

多线程技术概述   1.线程与进程 进程:内存中运行的应用程序,每个进程都拥有一个独立的内存空间。线程:是进程中的一个执行路径,共享一个内存空间,线程之间可以自由切换、并发执行,一个进程最少有一个线程,线程实际数是在进程基础之上的进一步划分,一个进程启动之后,进程之中的若干执行路径又可以划分成若干个线程 2.线程的调度 分时调度:所有线程轮流使用CPU的使用权,平均分配时间抢占式调度

c++基础版

c++基础版 Windows环境搭建第一个C++程序c++程序运行原理注释常亮字面常亮符号常亮 变量数据类型整型实型常量类型确定char类型字符串布尔类型 控制台输入随机数产生枚举定义数组数组便利 指针基础野指针空指针指针运算动态内存分配 结构体结构体默认值结构体数组结构体指针结构体指针数组函数无返回值函数和void类型地址传递函数传递数组 引用函数引用传参返回指针的正确写法函数返回数组