Skip to content
View heeboy007's full-sized avatar
🥊
THE ULTIMATE GRIND FEST
🥊
THE ULTIMATE GRIND FEST

Organizations

@ExP-2021-1-2-Team3 @BlazingDevs @development-sniff

Block or report heeboy007

Block user

Prevent this user from interacting with your repositories and sending you notifications. Learn more about blocking users.

You must be logged in to block users.

Content in all repositories owned by your account will be closed.
Maximum 250 characters. Please don’t include any personal information such as legal names or email addresses. Markdown is supported. This note will only be visible to you.
Report abuse

Contact GitHub support about this user’s behavior. Learn more about reporting abuse.

Report abuse
heeboy007/README.md

온체인 데이터 파이프라인 매니저

현재는 Tron 체인을 특화해서 분석하면서 역량을 기르고 있습니다.

  1. Full snapshot에서 데이터를 가져와서 파싱 (대략 4TB)
  2. timescaledb와 적절한 압축으로 데이터 마트를 형성 (대략 TB)
  3. 분석에 용이한 VRAM이 많은 머신에 duckdb에 적재 (대략 수십GB) 하는 파이프라인으로 적절한 필터링과 압축으로 공간 압축적인 OLAP환경을 구축해두고 있습니다.

제 분석의 포커스는 Anti-Money-Laundering (AML), 비지도 분석에 맞추어져 있습니다. 이유는

  1. 해당 분야가 라벨이 적습니다.
  2. 잘 알려져 있지 않은 체인이면 일수록 더욱 이러한 자금세탁요인에 취약합니다. 따라서 광범위한 체인에 적용이 가능한 솔루션이 필요하다고 생각하여, 클러스터링과 휴리스틱을 기반으로한 라벨 농축을 실험 중에 있습니다. 해당 분야에서 SCI논문을 작성중에 있는데, 완성되는대로 업데이트 할 예정입니다.

당국의 규제, 컴플라이언스 자체의 동향에도 관심이 있습니다. 그에 따라 당국의 법률, KYC, STR등의 키워드를 가지고 나름대로 공부를 하고 있습니다.

제 장점은요:

제약 안에서 어떻게 하면 좋을지를 생각합니다.

주어진 환경, 주어진 자원을 이용해서 몸비틀기를 하는 것도 즐기는 편에 속합니다. 4학년 졸업 프로젝트에서 최종적으로 앱을 운영할 때는 Free-tier AWS ec2에서 무리없이 inference를 할 수 있는 yolo8n계열의 vision model을 트레이닝 시키자고 생각했습니다. 여기서 라벨이 없어서 정석적으로 큰 모델을 이용해서 라벨을 생성하는 방법을 생각했고, Open Vocabularly Model인 OWL-ViT를 이용해서 생성한 라벨로 모델을 성공적으로 학습시켰습니다. 완전히 제 주력 ml분야는 아니지만, end-product를 생각하면서 model을 조정할 수 있다고 생각해주시면 감사하겠습니다.

글쓰기를 좋아하는 편에 속합니다.

블로그입니다. 기술적인 글말고도 다른 일반적인 글도 가끔씩 적고 있습니다.

폭넓게 IT를 공부했고, 이제는 특화할 분야를 정했습니다.

저는 태생적으로 호기심이 많은 편이라, 다양한 분야를 탐색해서 진로를 확정했습니다. 고등학교, 대햑교 시절에는 프런트엔드, 백엔드, 모바일, 임베디드, 3D 게임 엔진까지, 많은 분야를 조금씩 접해 보았습니다. 이러한 모든 분야를 제치고 제일 제 역량을 잘 끌어 낼수 있는 분야는 데이터를 다루며 직접 자신에게 질문을 던지고 검증하는게 가능한 machine learning이라고 결론 내렸습니다. 여기서 어떻게 하면 실전 데이터를 많이 확보할 수 있을까 고민했고, 블록체인을 거대한 데이터스토어로 보면 되겠다는 생각을 하였습니다. 그래서 현재는 블록체인 데이터를 분석하는 애널리스트이자, 파이프라인 설계자로 활동하고자 합니다.

리눅스 CLI도 비교적 친숙한 편입니다.

위의 경험에서 파생되는 장점으로, 다양하게 머신을 설계하면서 직접 컴퓨터를 가져와서 주로 debian계열, 가끔 fedora계열을 설치, 운용한 적이 많습니다. 커널 메시지(dmesg, journalctl), 리눅스 파일의 권한(chown, chmod), 상태진단(iostat, mpstat, ps, free)등을 적재적소에 쓸 수 있습니다.

3줄 요약이요?

  • Constraint Engineering:
  • Architecture & Docs: 설계도를 그리는 것과 문서를 작성하는 일을 좋아합니다. 명확한 설계가 좋은 프로그램을 만든다고 믿습니다.
  • System Affinity: Shell과 vi 에디터에 익숙하며, 데이터 파이프라인의 효율적인 운영을 선호합니다.
  • Security-First: 확실하지 않은 기술은 도입하지 않습니다. 보안과 안정성을 최우선으로 고려하는 견고한 시스템을 지향합니다.
  • Algorithmic Thinking: 꾸준한 PS(Competitive Programming) 활동을 통해 다져진 문제 해결 능력을 데이터 분석에 녹여냅니다.

과거에 했던 PS들...

P.S. AI로 일단 한번 써보라고 했는데 문체가 마음에 정말정말 안들어서 결국 뜯어 고쳤습니다.

Pinned Loading

  1. PS-MyAnswers PS-MyAnswers Public

    Beakjoon problem needs to be solved again, and again. If so, why not use github?(not sponsored by too many Problem Solving Sites)

    C++

  2. RubyCraft RubyCraft Public

    A Copy Of Minecraft... But not in c, c++, java, but in ruby! WARNING! DEPRECATED Libaray Usage, Download at your own risk.

    Ruby 1

  3. Dusty_Iot Dusty_Iot Public

    A project to get micro dust concentration information to your own phone!

    Java

  4. GTDList GTDList Public

    a.k.a FlowForge 간단한 생산성 TODO 리스트 앱

    JavaScript