Pandas(판다스) 통계함수(mean, unique, value_counts)
데이터를 받으면 가장 먼저 하게 되는 작업이 값의 분포를 파악하는 것이다. Pandas는 평균을 구하는 mean(), 고유값을 뽑는 unique(), 값별 개수를 세는 value_counts() 같은 통계 함수를 기본으로 제공한다. 이 글에서는 예제…
데이터를 받으면 가장 먼저 하게 되는 작업이 값의 분포를 파악하는 것이다. Pandas는 평균을 구하는 mean(), 고유값을 뽑는 unique(), 값별 개수를 세는 value_counts() 같은 통계 함수를 기본으로 제공한다. 이 글에서는 예제…
표 형태의 데이터를 다룰 때 파이썬에서 가장 많이 쓰는 게 Pandas DataFrame이다. DataFrame은 크게 세 요소로 이뤄진다 — 행을 식별하는 index, 열을 식별하는 columns, 그리고 실제 값들인 data. 이 글에서는…
다른 언어를 다뤄본 사람이라도 Python(파이썬) 연산자에서 몇 군데는 헷갈릴 수 있다. 대표적으로 /와 //의 차이, ==와 is의 차이가 그렇다. 이 글에서는 파이썬의 연산자 종류를 실제 코드 실행 결과와 함께 정리한다.…
자료구조는 데이터를 저장하고 조직화하는 방식을 정의한다. Python(파이썬)은 리스트, 튜플, 집합, 사전 같은 내장 자료구조와, 이를 확장한 collections 모듈을 함께 제공해 대부분의 작업을 표준 라이브러리만으로 처리할 수 있다. 이 글에서는 각…
임베디드 리눅스 디바이스를 개발할 때, 시리얼 콘솔을 통해 커널 디버깅 또는 긴급 명령을 보내는 경우가 있다. 그중 하나가 Magic SysRq 키 조합을 시리얼 포트를 통해 보내는 기능이다. Magic SysRq는 리눅스…
리눅스 환경에서 프로세스 이름을 얻는 방법은 여러 가지가 있다. C 프로그래밍 언어에서 프로세스 이름을 얻는 방법과 터미널 명령어를 사용하여 프로세스 이름을 확인하는 방법에 대해 알아본다. C에서 프로세스 이름 얻기 C…
Python에서 range() 함수는 일정 범위의 연속된 숫자(정수)를 생성하는 데 사용된다. 이 함수는 주로 for 반복문에서 특정 횟수만큼 반복할 때 유용하게 활용된다. 이번 글에서는 range() 함수의 사용법에 대해 알아본다. range() 함수…
Linux 환경에서는 seq라는 명령어를 사용하여 숫자 시퀀스를 생성할 수 있다. 이를 통해 반복 작업을 수행하거나 특정 범위의 숫자를 생성할 수 있는데, 이를 활용하면 쉘을 수행하거나 쉘스크립트 작성에 도움이 된다. 이…
find 명령어는 리눅스/유닉스 계열 운영체제에서 파일 및 디렉토리를 검색하는데 사용되는 강력한 도구이다. 이 명령어는 다양한 옵션을 통해 다양한 케이스에서 유연한 검색을 가능하게 해준다. 이 글에서는 기본 사용법과 자주 사용되는 예제들을…
리눅스에서 여러 줄로 출력된 텍스트를 한 줄로 합치는 작업은 여러 상황에서 유용하다. 이 글에서는 다양한 방법으로 여러 줄 출력을 한 줄로 만드는 방법에 대해 소개한다. 1. awk 사용 awk 명령어를…