Язык sas что это
SAS разрабатывался в Государственном университете Северной Каролины с 1966 по 1976 год, когда был включен институт SAS. SAS получила дальнейшее развитие в 1980-х и 1990-х годах с добавлением новых статистических процедур, дополнительных компонентов и введения JMP . Интерфейс "укажи и щелкни" был добавлен в версию 9 в 2004 году. Продукт для анализа социальных сетей был добавлен в 2010 году.
СОДЕРЖАНИЕ
Технический обзор и терминология
SAS - это программный пакет, который может добывать, изменять, управлять и извлекать данные из различных источников, а также выполнять их статистический анализ. SAS предоставляет графический пользовательский интерфейс «укажи и щелкни» для нетехнических пользователей и многое другое на языке SAS .
В программах SAS есть шаги DATA, которые извлекают и обрабатывают данные, и шаги PROC, которые анализируют данные. Каждый шаг состоит из серии утверждений.
Шаг DATA содержит исполняемые операторы, которые приводят к тому, что программное обеспечение выполняет действие, и декларативные операторы, которые предоставляют инструкции для чтения набора данных или изменения внешнего вида данных. Шаг DATA состоит из двух этапов: компиляции и выполнения. На этапе компиляции обрабатываются декларативные операторы и выявляются синтаксические ошибки. После этого на этапе выполнения последовательно обрабатывается каждый исполняемый оператор. Наборы данных организованы в таблицы со строками, называемыми «наблюдениями», и столбцами, называемыми «переменными». Кроме того, у каждой части данных есть дескриптор и значение.
Шаг PROC состоит из операторов PROC, которые вызывают именованные процедуры. Процедуры выполняют анализ и составление отчетов по наборам данных для создания статистики, анализа и графиков. Существует более 300 названных процедур, каждая из которых содержит значительный объем программной и статистической работы. Операторы PROC также могут отображать результаты, сортировать данные или выполнять другие операции.
Макросы SAS - это фрагменты кода или переменных, которые кодируются один раз и используются для выполнения повторяющихся задач.
Данные SAS можно публиковать в HTML, PDF, Excel, RTF и других форматах с помощью системы доставки вывода, которая была впервые представлена в 2007 году. SAS Enterprise Guide - это интерфейс SAS, основанный на принципах «укажи и щелкни». Он генерирует код для управления данными или автоматического выполнения анализа и не требует опыта программирования SAS.
Программный пакет SAS состоит из более чем 200 компонентов. Некоторые из компонентов SAS включают:
- Базовый SAS - Основные процедуры и управление данными
- SAS / STAT - Статистический анализ
- SAS / GRAPH - Графика и презентация
- SAS / OR - Операционные исследования
- SAS / ETS - Эконометрика и анализ временных рядов
- SAS / IML - язык интерактивных матриц
- SAS / AF - Средство приложений
- SAS / QC - Контроль качества
- SAS / INSIGHT - интеллектуальный анализ данных
- SAS / PH - Анализ клинических испытаний
- Enterprise Miner - интеллектуальный анализ данных
- Руководство для предприятий - редактор кода на основе графического интерфейса и менеджер проектов
- SAS EBI - набор приложений бизнес-аналитики
- SAS Grid Manager - менеджер вычислительной среды SAS grid.
История
Происхождение
Разработка SAS началась в 1966 году после того, как Университет штата Северная Каролина повторно нанял Энтони Барра для программирования своего программного обеспечения для анализа дисперсии и регрессии, чтобы оно могло работать на компьютерах IBM System / 360 . Проект финансировался Национальным институтом здоровья . и изначально предназначалась для анализа сельскохозяйственных данных с целью повышения урожайности сельскохозяйственных культур. К Барру присоединился студент Джеймс Гуднайт , который разработал статистические процедуры программного обеспечения, и они стали руководителями проекта. В 1968 году Барр и Гуднайт интегрировали новые процедуры множественной регрессии и дисперсионного анализа . В 1972 году, после выпуска первой версии SAS, проект лишился финансирования. По словам Goodnight, это произошло потому, что NIH хотел финансировать только проекты с медицинскими приложениями. Гуднайт продолжал преподавать в университете за зарплату в 1 доллар и доступ к мэйнфреймам для использования в проекте, пока в следующем году он не был профинансирован университетскими статистиками Южных экспериментальных станций . Джон Салл присоединился к проекту в 1973 году и внес свой вклад в эконометрику программного обеспечения, временные ряды и матричную алгебру. Еще одна ранняя участница, Кэролл Г. Перкинс, внесла свой вклад в раннее программирование SAS. Джолейн В. Сервис и Джейн Т. Хелвиг создали первую документацию SAS.
Первые версии SAS были названы в честь года их выпуска. В 1971 году SAS 71 был выпущен ограниченным выпуском. Он использовался только на мэйнфреймах IBM и имел основные элементы программирования SAS, такие как этап DATA и наиболее распространенные процедуры на этапе PROC. В следующем году была выпущена полная версия SAS 72, в которой был представлен оператор MERGE и добавлены функции для обработки недостающих данных или объединения наборов данных. В 1976 году Барр, Гуднайт, Салл и Хельвиг вывели проект из штата Северная Каролина и включили его в состав SAS Institute, Inc.
Разработка
SAS был переработан в SAS 76 с открытой архитектурой , допускающей компиляторы и процедуры. Операторы INPUT и INFILE были улучшены, чтобы они могли читать большинство форматов данных, используемых мэйнфреймами IBM. Также добавлено создание отчетов с помощью операторов PUT и FILE. Также была добавлена возможность анализа общих линейных моделей и процедура FORMAT, которая позволяла разработчикам настраивать внешний вид данных. В 1979 году в SAS 79 была добавлена поддержка операционной системы CMS и введена процедура DATASETS. Три года спустя SAS 82 представил ранний макроязык и процедуру APPEND.
SAS версии 4 имел ограниченные возможности, но сделал SAS более доступным. Версия 5 представила полный макроязык, индексы массивов и полноэкранный интерактивный пользовательский интерфейс под названием Display Manager. В 1985 году SAS был переписан на языке программирования Си . Это позволило реализовать архитектуру SAS Multivendor, которая позволяет программному обеспечению работать в UNIX , MS-DOS и Windows . Ранее он был написан на PL / I , Fortran и ассемблере .
В 1980-х и 1990-х годах SAS выпустила ряд компонентов в дополнение к Base SAS. SAS / GRAPH, который производит графику, был выпущен в 1980 году, как и компонент SAS / ETS, который поддерживает эконометрический анализ и анализ временных рядов. Компонент SAS / PH-Clinical, предназначенный для фармацевтических пользователей, был выпущен в 1990-х годах. В 2002 году Управление по санитарному надзору за качеством пищевых продуктов и медикаментов стандартизировало SAS / PH-Clinical для применения новых лекарственных средств. Также были представлены вертикальные продукты, такие как SAS Financial Management и SAS Human Capital Management (тогда они назывались CFO Vision и HR Vision соответственно). JMP был разработан соучредителем SAS Джоном Саллом и группой разработчиков, чтобы воспользоваться преимуществами графического пользовательского интерфейса, представленного в Apple Macintosh 1984 года и впервые выпущенного в 1989 году. Обновленные версии JMP выпускались непрерывно после 2002 г. последний выпуск - 2016 г.
SAS версии 6 использовался на протяжении 1990-х годов и был доступен в более широком диапазоне операционных систем, включая Macintosh , OS / 2 , Silicon Graphics и PRIMOS . SAS представила новые функции через точечные релизы. С 6.06 по 6.09 был представлен пользовательский интерфейс, основанный на парадигме Windows, и добавлена поддержка SQL. Версия 7 представила систему доставки вывода (ODS) и улучшенный текстовый редактор. В последующих выпусках ODS были улучшены. Например, в версии 8 было добавлено больше параметров вывода. Количество поддерживаемых операционных систем было уменьшено до UNIX , Windows и z / OS , а также добавлен Linux . SAS версии 8 и SAS Enterprise Miner были выпущены в 1999 году.
Недавняя история
В 2002 году была представлена программа Text Miner. Text Miner анализирует текстовые данные, такие как электронные письма, на предмет шаблонов в приложениях Business Intelligence. В 2004 году была выпущена версия SAS 9.0, получившая название «Project Mercury» и призванная сделать SAS доступным для более широкого круга бизнес-пользователей. Версия 9.0 добавила настраиваемые пользовательские интерфейсы на основе роли пользователя и установила пользовательский интерфейс «укажи и щелкни» SAS Enterprise Guide в качестве основного графического пользовательского интерфейса (GUI) программного обеспечения. Функции управления взаимоотношениями с клиентами (CRM) были улучшены в 2004 году с помощью SAS Interaction Management. В 2008 году SAS анонсировала Project Unity, предназначенный для интеграции качества данных, интеграции данных и управления основными данными.
SAS Institute Inc против World Programming Ltd - это судебный процесс с разработчиками конкурирующей реализации World Programming System , в которых утверждалось, что они частично нарушили авторские права SAS, реализовав ту же функциональность. Это дело было передано из Высокого суда Соединенного Королевства в Европейский суд 11 августа 2010 года. В мае 2012 года Европейский суд вынес решение в пользу World Programming, установив, что «функциональность компьютерной программы и язык программирования не может быть защищен авторским правом ".
Бесплатная версия была представлена для студентов в 2010 году. В том же году был выпущен SAS Social Media Analytics, инструмент для мониторинга социальных сетей, анализа вовлеченности и настроений . В том же году был представлен SAS Rapid Predictive Modeler (RPM), который создает базовые аналитические модели с помощью Microsoft Excel . В JMP 9 в 2010 году был добавлен новый интерфейс для использования языка программирования R из JMP и надстройка для Excel. В следующем году в рамках партнерства с Teradata и EMC Greenplum стало доступно высокопроизводительное вычислительное устройство . В 2011 году компания выпустила Enterprise Miner 7.1. С октября 2013 года по октябрь 2014 года компания представила 27 продуктов для управления данными и обновила еще 160 продуктов. На глобальном форуме SAS 2015 года компания анонсировала несколько новых продуктов, предназначенных для различных отраслей, а также новое программное обеспечение для обучения.
Дата выхода
С 1972 года у SAS было много выпусков. Начиная с выпуска 9.3, SAS / STAT имеет собственную нумерацию выпусков.
Выпускать | Дата | Комментарий |
---|---|---|
72 | Январь 1972 г. | |
76 | Июль 1976 г. | |
79,5 | Апрель 1981 г. | |
82,4 | Январь 1983 г. | |
4.06 | Март 1984 г. | |
5,03 | Июль 1986 г. | |
6.01 | Январь 1985 г. | ПК DOS |
6,03 | Март 1988 г. | |
6.06 | Март 1990 г. | |
6,07 | Апрель 1991 г. | |
6,08 | Март 1993 г. | |
6.09 | Октябрь 1993 г. | |
6.10 | Октябрь 1994 | |
6,11 | Октябрь 1995 г. | |
6,12 | Ноябрь 1996 | |
7.0 | Октябрь 1998 | |
8.0 | Ноябрь 1999 г. | |
8.1 | Июль 2000 г. | |
8,2 | Март 2001 г. | |
9.0 | Октябрь 2002 г. | |
9.1 | Декабрь 2003 г. | |
9.1.3 | Август 2004 г. | |
9.2 | Март 2008 г. | СТАТИСТИКА 9.2 |
9,2 м2 | Апрель 2010 г. | СТАТИСТИКА 9.22 |
9,3 | Июль 2011 г. | СТАТИСТИКА 9.3 |
9,3 м2 | Август 2012 г. | СТАТ 12.1 |
9,4 | Июль 2013 | СТАТУС 12.3 |
9,4M1 | Декабрь 2013 | СТАТ 13.1 |
9,4 м2 | Август 2014 г. | СТАТУС 13.2 |
9,4 м3 | Июль 2015 г. | STAT 14.1 |
9,4М4 | Ноябрь 2016 | СТАТИСТИКА 14.2 |
9,4М5 | Сентябрь 2017 г. | СТАТУС 14.3 |
9,4М6 | Ноябрь 2018 г. | STAT 15.1 |
9,4М7 | Август 2020 г. | СТАТ 15.2 |
Программные продукты
По состоянию на 2011 год самый большой набор продуктов SAS - это линия для сбора информации о клиентах . Многочисленные модули SAS для Интернета, социальных сетей и маркетинговой аналитики могут использоваться для профилирования клиентов и потенциальных клиентов, прогнозирования их поведения, управления и оптимизации коммуникаций. SAS также предоставляет SAS Fraud Framework. Основная функция платформы - отслеживать транзакции в различных приложениях, сетях и партнерах и использовать аналитику для выявления аномалий, указывающих на мошенничество. SAS Enterprise GRC (Governance, Risk and Compliance) обеспечивает моделирование рисков, анализ сценариев и другие функции для управления и визуализации рисков, соблюдения нормативных требований и корпоративных политик. Существует также набор продуктов SAS Enterprise Risk Management, предназначенный в первую очередь для банков и финансовых организаций.
Продукты SAS для мониторинга и управления операциями ИТ-систем вместе именуются SAS IT Management Solutions. SAS собирает данные о производительности и использовании различных ИТ-активов, а затем создает отчеты и анализирует их. Продукты SAS Performance Management объединяют и предоставляют графическое отображение ключевых показателей эффективности (KPI) на уровне сотрудников, отделов и организаций. Пакет продуктов SAS Supply Chain Intelligence предлагается для нужд цепочки поставок, таких как прогнозирование спроса на продукцию, управление распределением и запасами и оптимизация ценообразования. Существует также набор программного обеспечения «SAS for Sustainability Management» для прогнозирования экологических, социальных и экономических последствий и определения причинно-следственных связей между операциями и воздействием на окружающую среду или экосистему.
У SAS есть наборы продуктов для конкретных отраслей, таких как правительство, розничная торговля, телекоммуникации и аэрокосмическая промышленность, а также для оптимизации маркетинга или высокопроизводительных вычислений .
Бесплатное университетское издание
SAS также предлагает бесплатную университетскую версию, которую может загрузить любой желающий для некоммерческого использования. Первое объявление об этом бесплатном университетском издании, похоже, появилось в газетах 28 мая 2014 года.
Сравнение с другими продуктами
В статье 2005 года для Journal of Marriage and Family, в которой сравниваются статистические пакеты от SAS и его конкурентов Stata и SPSS , Алан К. Акок написал, что программы SAS обеспечивают «необычайный диапазон задач анализа данных и управления данными», но их трудно использовать и учиться. Между тем, SPSS и Stata были легче для изучения (с лучшей документацией), но обладали менее способными аналитическими возможностями, хотя их можно было расширить с помощью платных (в SPSS) или бесплатных (в Stata) надстроек. Акок пришел к выводу, что SAS лучше всего подходит для опытных пользователей , в то время как случайные пользователи больше всего выиграют от SPSS и Stata. Сравнение, проведенное Калифорнийским университетом в Лос-Анджелесе , дало аналогичные результаты.
Такие конкуренты, как Revolution Analytics и Alpine Data Labs, рекламируют свои продукты как значительно более дешевые, чем у SAS. В сравнении 2011 года Дуг Хеншен из InformationWeek обнаружил, что стартовые сборы для этих трех компаний одинаковы, хотя он признал, что стартовые сборы не обязательно были лучшей основой для сравнения. Бизнес-модель SAS не так сильно зависит от начальных сборов за свои программы, вместо этого она сосредоточена на доходах от ежегодной абонентской платы.
Принятие
По данным IDC, SAS является крупнейшим держателем доли рынка «продвинутой аналитики» с 35,4% рынка по состоянию на 2013 год. Она является пятым по величине держателем доли рынка программного обеспечения для бизнес-аналитики (BI) с долей 6,9% и крупнейший независимый поставщик. На рынке бизнес- аналитики он конкурирует с такими конгломератами, как SAP BusinessObjects , IBM Cognos , SPSS Modeler , Oracle Hyperion и Microsoft Power BI . Компания SAS была включена в Квадрант лидеров Gartner для инструментов интеграции данных, а также для бизнес-аналитики и аналитических платформ. Исследование, опубликованное в 2011 году в BMC Health Services Research, показало, что SAS использовался в 42,6% анализов данных в исследованиях в сфере здравоохранения на основе выборки из 1139 статей, взятых из трех журналов.
Привет! Я Анна Добрыченко, преподаватель учебного центра SAS в России: провожу тренинги по программированию на SAS Base, использованию SAS Enterprise Guide и SAS Visual Analytics, участвую в подготовке стажеров. Вся техническая документация и статьи продуктов и решений SAS изложены на английском языке, а локализованного материала в Рунете недостаточно.
Поэтому в нашем блоге на Хабрахабре я расскажу об основах программирования на SAS Base в цикле статей.
Язык SAS Base представляет собой основу большинства этих продуктов и решений SAS, именно ему и будут посвящены статьи. В них я познакомлю с терминологией, типами данных, с которыми работает SAS Base, со структурой кода, написанного на SAS Base, и покажу основные приемы, которые используются при написании программ SAS.
Вводная
Есть несколько вариантов изучить основы программирования на SAS Base.
- Прочитать документацию: все решения SAS хорошо задокументированы, чтобы пользоваться ими было легко даже новичку. Все справочники находятся на сайте поддержки. Из плюсов стоит отметить, что найти можно все, что интересует бесплатно, из минусов – долго, и вся информация на английском языке.
- Посмотреть бесплатный онлайн-курс в формате e-Learning. Плюсы – все подробно разъясняется с примерами и выполнением практических упражнений, минусы – долго (длительность 24 часа), курс на английском языке. Также можно посмотреть видео SAS на Youtube.
- Купить книгу, например, Little SAS Book. Книга знакомит начинающих пользователей с языком SAS Base, содержит практические примеры и упражнения. Но опять же, вся литература, выпускаемая SAS, на английском языке и имеет относительно высокую стоимость. Все книги представлены на официальном сайте SAS в разделе «Обучение», также можно воспользоваться ресурсом Amazon. Но если вы студент и участвуете, например, в нашей стажерской программе, то вам могло повезти и вы получили книгу в подарок, что не может не радовать.
- Прочитать наш курс статей, освящающий основы программирования на SAS Base. Эти статьи адресованы новым пользователям SAS, работающим в различных сферах бизнеса, по большому счету для всех, кто собирается проводить анализ данных с помощью решений SAS или писать свои программы на SAS Base.
Добываем инструменты
Научиться программировать на SAS Base можно на бесплатном интерфейсе под названием SAS University Edition или сокращенно SAS UE.
При запуске программы или задачи SAS Studio подключается к серверу SAS для обработки кода. Сервер SAS может быть размещен в облачной среде, локальной среде или же на локальном компьютере. После обработки кода результаты возвращаются в SAS Studio в вашем браузере.
SAS Studio поддерживает несколько веб-браузеров: Microsoft Internet Explorer, Apple Safari, Mozilla Firefox, and Google Chrome.
Разбираемся в интерфейсе
Немного о том, как выглядит интерфейс SAS UE.
Слева находится панель навигации, справа – рабочая область. Три основные вкладки рабочей области – «Код», «Журнал», «Результаты».
Справка по синтаксису появляется, как только вы уменьшаете список релевантных ключевых слов. Справка по синтаксису также появляется, если щелкнуть правой кнопкой мыши на ключевое слово в программе и выбрать Syntax Help (Справка по синтаксису).
Можно перейти на страницу документации по той или иной процедуре, кликнув на ссылку «Документация по продукту».
На вкладке «Выходные данные» вы можете увидеть созданные таблицы.
На вкладке «Результаты» вы можете просматривать вывод процедур, создающих отчеты.
Если какая-то часть программы используется часто, ее можно добавить во «Фрагменты кода».
Вы можете открыть справку (SAS Help) и документацию прямо из главной панели инструментов. SAS Studio Help (Справка SAS Studio) для перехода на страницу документации по SAS Studio. Эта веб-страница содержит справку по интерфейсу SAS Studio.
Если вы только начали изучать продукты SAS, то наверняка незнакомы с некоторыми особенностями терминологии, используемой в продуктах компании.
Sas7bdat и данные
Начнем с того, что SAS Base работает только с особым форматом данных, который называется SAS Data Set (набор данных SAS). Но помимо всего прочего SAS является очень гибким инструментом и может считывать практически любые данные, преобразовывая в SAS Data Set. Набор данных SAS представляет собой обычную плоскую таблицу, состоящую из строк и столбцов. Набор данных SAS хранится как файл с расширением .sas7bdat.
С точки зрения традиционной терминологии SAS наборы данных состоят из переменных (variables) и наблюдений (observations). Проведя аналогию с терминологией реляционных баз данных, переменные являются столбцами, а наблюдения – строками.
Рассмотрим на примере описанное выше.
Представленная программа создает таблицу people (сам синтаксис мы рассмотрим позже):
Исходные данные могут иметь различный вид, SAS упростил эту задачу. В SAS существует всего два типа данных числовой (numeric) и символьный (character). В наборе данных people переменные First_Name, Last_Name, Phone_Number имеют символьный тип, а переменная Id – числовой. Стоит отметить, что даты в SAS — это тоже числа.
Данная программа создает набор данных time, содержащий текущие дату, время и дату и время (datetime) в формате SAS:
Возможный вид набора данных представлен ниже:
Все три значения – это даты в формате SAS. Итак, дата в формате SAS – это количество дней, начиная с 01 января 1960 до текущей даты, время в формате SAS – это количество секунд, начиная с полуночи текущей даты, дата и время – это количество секунд, начиная с полуночи 1960 года. Именно в таком виде хранятся даты в формате SAS в наборах данных.
Иногда данные могут быть неполными, как в наборе данных people: в нем отсутствуют некоторые значения. В SAS существует понятие missing – пропущенное значение. По факту, пропущенное значение – это тип значения для переменной, которая не содержит данных для конкретной строки или столбца. По умолчанию SAS записывает недостающее числовое значение в виде точки и отсутствующее значение текстовой переменной в качестве пробела. При сравнении «миссинг» всегда равен «миссингу», при этом в операторах сравнения «миссинг» — самое минимальное значение.
Кроме фактических значений, набор данных SAS имеет такие данные, как тип переменной, длину, имя, ярлыки, форматы, называемые атрибутами набора данных.
Переменные и атрибуты
У переменных в SAS есть ряд атрибутов, давайте познакомимся с некоторыми из них.
Длина переменной — это количество байт, приходящихся на один символ.
Данный код демонстрирует вышеизложенное:
Имена переменных, как и наборов данных, задаются самостоятельно. Есть ряд правил именования переменных SAS:
- Имена не должны превышать 32 символов.
- Имена должны начинаться только с буквы или символа нижнего подчеркивания.
- Имена могут содержать только буквы, цифры или символы нижнего подчеркивания.
- В именах переменных нельзя использовать специальные символы, в том числе и пробел.
- Имена могут содержать как прописные, так и строчные буквы, так как SAS не чувствителен к регистру при именовании сущностей (переменные, наборы данных, библиотеки и так далее). Обращаться в коде к переменной вы можете в любом регистре. Но! Важно то, что SAS запоминает первое появление названия переменной в программе и при формировании отчета использует именно его.
В последующих статьях мы подробнее познакомимся с атрибутом формат.
Ярлык переменной используется в отчетах вместо имен переменных. Ярлык может содержать до 256 символов, включая специальные символы, в том числе и знак пробела. В последующих статьях мы рассмотрим, виды ярлыков и как они используются в программном коде, а также приемы, когда в имени переменной может быть использован, например, пробел.
Структура программы SAS Base
Ознакомимся со структурой программы на языке SAS Base.
Все программы SAS состоят всего из двух шагов: шаг PROC и шаг DATA. Шаг DATA предназначен для чтения, преобразования и создания наборов данных SAS, а процедурный шаг PROC в основном – для анализа данных, формирования и печати отчетов. Шаги состоят из операторов. Индикатор окончания шага – это ключевое слово RUN (или, например, QUIT для ряда процедур), также сигналом к завершению шага может быть наличие операторов STOP и ABORT. Шаги могут размещаться в произвольном порядке, компилятор считывает последовательно шаг за шагом. Стоит отметить, что и сами шаги считываются построчно и никак иначе. Разные части программы обмениваются друг с другом данными в виде наборов данных SAS.
Синтаксис SAS Base очень прост, так же как и написание кода.
Пример простейшей программы SAS представлен ниже:
Важным требованием синтаксиса является наличие точки с запятой в конце каждого оператора. Данная программа SAS считывает набор данных ads из библиотеки sasuser (с понятием «библиотека» мы познакомимся в следующей статье), создает новый набор данных new. На следующем шаге мы создаем отчет из нового набора данных.
Стоит отметить, что у SAS Base нет требований к форматированию кода. Вы можете написать код в одну строку и код будет работать. Чтобы отформатировать код в SAS U, нажмите на кнопку «формат кода»:
Хороший тон для программиста – это пояснения к исходному тексту программы. Комментарии не влияют на семантику программы.
В SAS Base есть два вида комментариев:
Как отмечалось ранее, Log необходимо детально изучать. Давайте рассмотрим несколько самых распространенных синтаксических ошибок:
В данном случае шаг отработает с предупреждением. В Log мы увидим следующую информацию:
В данном случае run на втором шаге программы будет расценен как параметр оператора proc print.
Ошибка будет выглядеть следующим образом:
- Непарные кавычки. В SAS Base можно использовать одинарные и двойные кавычки, которые должны быть парными.
Итак, это кратко об интерфейсе SAS UE, терминологии SAS Base и основных требованиях к синтаксису SAS Base. В следующей статье мы рассмотрим библиотеки SAS и их создание, создание детализированных отчетов, рассмотрим форматирование значений и задание постоянных атрибутов переменным.
Уверена, что работа с SAS окажется интересной и увлекательной. Grow with SAS!
Типы программного обеспечения SAS:
Существуют различные типы программного обеспечения SAS. В общем, есть 4 типа программного обеспечения SAS, которые приведены ниже.
- SAS для Windows
- SAS EG (Руководство для предприятий)
- SAS Enterprise Miner (EM)
- SAS Stat Software
Наиболее используемым программным обеспечением среди вышеуказанных типов является SAS для Windows. Он может быть легко развернут и позволяет модернизировать вашу среду SAS, включив сеточную обработку.
Рабочий процесс программирования SAS:
Прикладные программы SAS характеризуются управлением потоком, указанным на диаграмме ниже.
На первом этапе приведенной выше диаграммы программа SAS считывает данные, которые обычно хранятся в виде рабочих листов в рабочей книге Excel. На этом этапе выполняется подключение к книге, и данные импортируются в формате, подходящем для использования на следующих этапах.
Исследуйте данные:
На втором этапе мы проверяем на несоответствия или неправильные значения. Здесь также могут генерироваться отчеты о частоте и сводная статистика. Глядя на эти отчеты и резюме на первый взгляд, мы можем сразу обнаружить некоторые несоответствия. Например, все имена меток категориального атрибута, кроме одного, могут быть написаны заглавными буквами. Другим примером неправильного значения является отрицательное значение для минимального количества прогонов, набранных игроком с битой во время строки матчей. Первые 5 строк также показаны на этом этапе.
Подготовить данные:
На этом этапе проблемы, обнаруженные на более раннем этапе, устраняются. Здесь мы создаем новые столбцы с существующими значениями или объединяем их. На этом этапе также выполняется условная обработка. Некоторые таблицы также объединены для обеспечения более согласованного представления данных. Эти таблицы имеют чистые и проверенные значения.
Анализ и отчетность по данным и экспорт результатов:
Последние две фазы объединяются в одну в прикладных программах SAS. Здесь мы создаем карты на основе географических координат, сводной статистики и т. Д., Которые являются одними из выходных моделей, используемых для отображения результатов. Мы также можем сохранить выходные модели, созданные в книге Excel, и загрузить их для последующего автономного использования.
Это общая структура приложения SAS. Надеюсь, что эта статья поможет вам получить четкое представление о рабочем процессе программы SAS.
Система статистического анализа относится к набору программного обеспечения, созданного Институтом SAS, и обладает способностью предоставлять многомерную расширенную аналитику с возможностями управления данными и прогнозирования. SAS, как программное обеспечение, используется для извлечения, изменения, управления данными из различных источников и анализа данных. здесь мы обсудим SAS операторов.
SAS - это язык программирования четвертого поколения, широко используемый в статистическом и математическом анализе данных для предоставления решения на уровне предприятия для решения сложных бизнес-задач.
SAS был первоначально разработан в 1966 году для обслуживания отрасли наук о жизни, причем основное использование было в прогнозном анализе с использованием унаследованных дисперсионных и регрессионных данных, а SAS дополнительно развил свою способность путем включения JMP в сочетании с опцией графического интерфейса пользователя, предоставленной в ранних версиях MAC, С философией непрерывного развития и прогрессом в вычислительных возможностях научных систем и растущей загрузкой вездесущих данных SAS представила функции интеллектуального анализа данных в 2005 году.
Дальнейшее развитие пакета обеспечило различные функции, такие как импорт Excel, экспериментальное проектирование,
На сегодняшний день SAS широко используется в предоставлении решений для анализа клиентов, SAS также находит огромные приложения в банковской индустрии с возможностью выявления мошеннических транзакций, продукты SAS также используются в правительстве, розничной торговле, телекоммуникациях и авиакосмической промышленности, а также для оптимизации маркетинга или высокого уровня. производительность вычислений.
Структура кода SAS Программирование
Программа SAS построена на двух строительных блоках:
- ШАГ ДАННЫХ: используется при создании набора данных и назначении переменных
- PROC STEP: используется для обработки данных
Какие операторы в SAS?
Операторы SAS - это символы, используемые в программировании SAS для арифметических, логических или сравнительных операций.
Например,
Типы операторов в SAS
В языке программирования SAS есть две основные категории операторов, которые включают префиксные операторы и инфиксные операторы. Разделение между ними основано на образе действий операторов.
- Префиксные операторы : это общее выражение, используемое при определении операторов, которые применяются к операндам (являются константами или переменными, которые могут быть числовыми или символьными), которые следуют за выражением, действие, связанное с операторами, применяется непосредственно к переменной, выражению, константы. Давайте теперь попробуем разобраться в примерах префиксных операторов.
- -y
- -cos (х)
- + (Х * у)
Также следует отметить, что слово NOT и его эквивалентные символы также рассматриваются как префиксные операторы.
- Инфиксные операторы : они относятся к тем операторам, которые действуют на обе стороны операторов, эти операторы обычно участвуют в арифметических, а также логических операциях в программировании SAS. Подкатегории операторов Infix следующие
- Арифметические Операторы
- Логические Операторы
- Операторы сравнения
- Операторы конкатенации
- максимальная
- минимальный
Плюс / Минус Аномалия
Вопросы возникают с точки зрения определения знаков плюс и минус в программировании SAS. Здесь необходимо понять контекстный вывод символа, самый простой способ понять сценарий - при использовании в арифметических вычислениях знаки плюс / минус рассматриваются как инфиксные операторы. Аналогично, при использовании в определении символы классифицируются в префиксных операторах.,
Углубленный анализ операторов Infix
Различные операторы Infix использовали программирование SAS:
- Оператор AND: выражение возвращает 1, если обе величины, связанные операцией AND, истинны
- ИЛИ Оператор: выражение возвращает 1, если любой из величин, связанных с операцией ИЛИ верно.
- Оператор NOT: оператор NOT является логическим оператором, который переводит значение своего операнда в логическую противоположность
- Операторы сравнения : к ним относятся операторы, используемые для настройки операции сравнения или вычисления с двумя переменными, константами или выражениями. Если сравнение истинно, результат равен 1. Если сравнение ложно, результат равен 0.
Оператор IN в SAS используется при сравнении выражения слева со списком выражения справа, например, для
x IN ( 1, 2, 3, 4, 8, 9, 10 ) даст 1 для приведенного выше примера
Следует отметить, что выражение в конце значения должно быть постоянным.
Символьные операции могут выполняться в SAS. Символьные операнды сравниваются посимвольно слева направо. Двухсимвольные значения неравной длины сравниваются с предположениями о том, что пробелы прикрепляются к концу более короткой строки перед выполнением сравнения.
Длина полученной строки равна сумме длины строк, участвующих в операциях конкатенации,
Порядок оценки
Порядок вычисления в составном операторе зависит от типа выражения:
- Справа налево -> префиксные операторы, а также экспоненциальные и MIN / MAX операторы используют порядок оценки справа налево. Позвольте нам понять это на примере
Давайте рассмотрим операцию SAS x = 4 ** 5 ** 6, которая будет оценена как x = (4 ** (5 ** 6))
- Слева направо -> операторы, такие как сложение, вычитание, умножение и деление со сравнением и логическим И, логическим ИЛИ, оцениваются слева направо.
SAS также предоставляет несколько других операторов, которые используются только с определенными операторами SAS. В операторе WHERE используется специальная группа операторов SAS, действительная только при использовании с выражениями WHERE.
Рекомендуемые статьи
Это было руководство для операторов SAS. Здесь мы обсудили различные типы операторов SAS с примерами и порядком оценки. Вы также можете посмотреть следующую статью, чтобы узнать больше -
Читайте также: