Python
-
[데이터분석 인강/Python 독학] 데이터 입출력(IO)
I/O (Input / Output) 말 그대로 프로그램 입장에서 들어오는 모든 데이터를 Input, 나가는 걸 Output이라고 한다. 스토리지로부터 파일을 불러오는 것도 input이고, 프로그램 결과를 스토리지에 저장하는 것 역시 ouput이라고 한다. 이 작업을 file I/O라고 통칭한다. 그 외에 키보드로 입력받는 걸 stdin이라고 하며, 반대로 모니터로 출력하는 걸 stdout이라고 한다. STDIN / STDOUT (Standard IN, Standard OUT) 이미 자주 사용하고 있는 input()과 print()가 여기에 해당된다. input()이 stdin이고, print()가 stout이다. python에서 stdin은 무조건 문자열 타입으로 들어오기 때문에 type casting..
2022.06.26 12:14 -
[Python 독학] 예외처리, 내장함수, 라이브러리(외장함수)
예외처리 : 오류가 발생했을 때 어떻게 할지 정하는 것으로 파이썬은 오류를 무시하고 싶을 때 try, except를 사용하여 예외적으로 오류를 처리할 수 있도록 해준다. 흔한 오류의 종류 FileNotFoundError : 없는 파일을 열려고 할 때 ZeroDivisionError : 0으로 나누려할 때 IndexError : 리스트에서 얻을 없는 값(인덱스)을 부를 때 오류 예외 처리 기법 try, except문 기본 구조는 다음과 같다. try: … except [발생오류[as 오류 메세지 변수]]: … try 블록 수행 중 로류가 발생하면 except 블록이 수행되고, try 블록에서 오류가 발생하지 않는다면 except 블록은 수행되지 않는다. except [발생오류[as 오류 메세지 변수]]: ..
2021.11.25 10:53 -
[Python 독학] 모듈, 패키지
모듈 : 미리 만들어 놓은 .py파일 (함수, 변수, 클래스) 만들기 # mod1.py def add(a,b): return a + b 단순하다. 함수를 미리 만들어 놓는 것과 크게 다를 것이 없다. 불러오기 위 코드를 그대로 저장한 뒤, 다른 창에서 import를 활용해 저장해놓은 모듈을 불러올 수 있다. # hello.py import mod1 print(mod1.add(1,2)) 그럼 결과값이 3으로 나온다. 만약 mod1이란 모듈에 아래와 같이 함수가 무수히 많고, # mod1.py def add(a,b): return a + b def sub(a,b): return a - b def mid(a,b): return (a+b)/2 …(중략) 그 중 특정 부분만 불러오고 싶다면 from mod1 im..
2021.11.12 21:25 -
[Python 독학] 클래스 ②
생성자 (Constructor) : 인스턴스를 만들 때 호줓되는 매서드 객체에 초깃값을 설정해야 할 필요가 있을 때는 메서드를 호출하여 초깃값을 설정하기보다 생성자를 구현하는 것이 안전하다. 속성 추가 # Monster 클래스에 속성(체력, 공격력, 이동속도) 추가하기 class Monster: def __init__(self, health, attack, speed): self.health = health self.attack = attack self.speed = speed goblin = Monster(800, 120, 300) wolf = Monster(1500, 200, 350) __init__ : 인스턴스를 만들 때 반드시 호출되는 메서드로 가장 먼저 호출된다. 또한 self는 매게변수로 취급..
2021.07.07 15:33
DataScience
-
[데이터분석 인강] 코호트 분석과 푸쉬 노티피케이션
코호트 분석 데이터 분석 기법 중 하나로 코호트(동질 집단) 분석이 있다. 코호트란 특정 기간동안 공통된 특성이나 경험을 갖는 사용자 집단을 분석하는 것을 말하는데 대표적인 분석 예시가 사용자 이탈률/패턴, 재구매율같은 것들이 있다. # 구매 횟수 기준 우수 고객 확인 retail.groupby('CustomerID').count()['Quantity'].sort_values(ascending=False) # 지불 금액 기중 우수 고객 확인 retail.groupby('CustomerID').sum()['CheckoutPrice'].sort_values(ascending=False) # 사용자 기준으로 최초 구매한 월 연산하기 ## Month : 구매월, MonthStarted : 사용자가 최초 구매한 ..
2022.07.16 17:44 -
검색광고 데이터 분석 : 검색광고 데이터 키워드/광고그룹 분석
키워드 분석 : 저효율키워드 출력 노출수와 클릭수 상위 5%에 해당하는 키워드를 추출하는 작업을 통해 quantile함수를 활용한 95백분위수를 찾고 그 이상의 노출수를 추출, 상위 5%에 해당하는 키워드를 추출해보고자 한다. imp=df['노출수'] # quantile (default : 2사분위수(중앙값)) imp.quantile() # median - 중앙값 imp.median() # 최소값 imp.quantile(0) imp.min() # 최대값 imp.quantile(1) imp.max() quantile 함수는 분위수를 출력하는 함수로 default 값은 2사분위수이다. ※ 2사분위수 = 중앙값 물론 median이라는 중앙값만 호출할 수 있는 함수가 따로 있으나 수학 통계에서도 그렇듯 사분위수..
2022.07.10 14:01 -
[데이터분석 인강]검색광고 데이터 분석 : 데이터 탐색 시각화ver. (선그래프)
matplotlib을 이용한 Series 시각화를 통해 데이터 탐색을 해보고자 한다. import pandas as pd from pandas import DataFrame from pandas import Series import matplotlib.pyplot as plt # matplotlib 한글 폰트 출력코드 # 출처 : 데이터공방( https://kiddwannabe.blog.me) import matplotlib from matplotlib import font_manager, rc import platform try : if platform.system() == 'Windows': # 윈도우인 경우 font_name = font_manager.FontProperties(fname="c:/W..
2022.07.09 19:42 -
검색광고 데이터 분석 : 데이터 전처리&기본적인 데이터 탐색
데이터 전처리 import pandas as pd from pandas import DataFrame from pandas import Series import matplotlib.pyplot as plt 네이버 검색광고 데이터를 read_excel 함수를 사용하여 파이썬에 불러와 DataFrame의 열 단위 수치연산 및 데이터 타입 다루는 것을 목표로 한다. # window의 경우 경로인식에러 발생 df=pd.read_excel('C:\Users\user\OneDrive\Desktop\marketing\NAVER.xls') read함수를 이용하여 데이터를 불러올 때 탐색창에 있는 주소를 그대로 복붙해오면 Error를 발생하는데 그 이유가 윈도우 탐색창은 \를 사용하고, 파이썬은 /을 사용하기 때문인데 ..
2022.07.09 18:47