토스 네뷸라 디바이스 팜, Appium을 버리고 자체 드라이버를 만든 이유
팀마다 각자 폰을 꽂고 테스트를 돌려야 했던 문제를 토스가 네뷸라라는 디바이스 팜으로 푼 과정을 읽고 정리한 기술 블로그 리뷰. Client/Server/Agent/기기 4계층 구조, Appium 대신 자체 드라이버를 만든 이유, Android/iOS 실시간 미러링을 자체 구현한 방식까지.
개발하면서 배우고, 삽질하고, 이해한 것들을 기록합니다.
팀마다 각자 폰을 꽂고 테스트를 돌려야 했던 문제를 토스가 네뷸라라는 디바이스 팜으로 푼 과정을 읽고 정리한 기술 블로그 리뷰. Client/Server/Agent/기기 4계층 구조, Appium 대신 자체 드라이버를 만든 이유, Android/iOS 실시간 미러링을 자체 구현한 방식까지.
전위/중위/후위 순회를 재귀로 구현하며 결과 배열을 함수 밖에 두는 대신 중첩 함수로 감싸는 방법부터, 이진 트리 구조 자체는 탐색 성능을 보장하지 않는다는 것, 균형이 무너지면 O(log n)이 O(n)이 되는 이유, 캐시 지역성 때문에 DB가 이진 트리 대신 B+트리를 쓰는 이유까지.
seglist의 크기 클래스에 물리적 제약을 더한 버디 시스템 — 반으로 쪼개고, XOR 한 번으로 O(1)에 짝을 찾아 병합하고, 그 대가로 최대 50%까지 내부 단편화를 감수하는 구조를 seglist와 비교하며 정리.
재귀가 같은 하위 문제를 계속 반복 계산할 때 memo로 기억해두는 하향식(탑다운) DP와, 밑바닥 값부터 채워 올라가는 상향식(바텀업) DP를 피보나치 수열과 계단 오르기 문제로 각각 구현.
인접 리스트로 무방향/방향 그래프를 만드는 것부터, Queue로 너비 우선 탐색하는 BFS와 재귀로 깊이 우선 탐색하는 DFS를 각각 구현하고 장단점을 비교. 시간 복잡도는 둘 다 O(V+E).
매번 가장 큰 동전을 고르는 거스름돈 문제와, 종료 시간이 가장 빠른 회의부터 고르는 회의실 배정 문제로 그리디 알고리즘이 '순간의 최선'을 반복하는 원리를 확인.
HDD는 기계적으로, SSD는 반도체로 동작한다는 차이에서 출발해서 Platter/Track/Sector 구조와 NAND Page/Block 구조, Wear Leveling까지 정리.
두 문자열을 각각 행과 열에 두고, 같으면 대각선 위에 1을 더하고 다르면 위/왼쪽 중 최댓값을 가져오는 방식으로 LCS 길이를 채워나가는 DP 테이블 구현.
동적 메모리 할당기가 가용 블록을 관리하는 세 가지 방식을 검색 범위가 좁아지는 순서로 정리 — 크기 필드로 유추하는 implicit부터, pred/succ 포인터로 연결하는 explicit, 크기 클래스별로 리스트를 쪼개는 seglist까지.
포인터 두 개가 같은 메모리를 가리킬 수 있다는 가능성 하나가 어떻게 레지스터 캐싱, 명령어 재배치, SIMD 벡터화까지 막는지, 그리고 지역 변수와 restrict가 그 가능성을 어떻게 없애는지 정리.
BST가 데이터 쏠림으로 O(n)까지 느려질 수 있다는 문제에서 출발해서, RB트리의 색 규칙과 Black Height, 그리고 Rotation·Recoloring으로 Double Red를 복구하는 과정을 정리.
위상 수학의 '위상'이 순서 관계와 일대일 대응한다는 것에서 출발해서, DAG의 모든 간선 (u,v)에서 u가 v보다 앞에 오도록 정렬하는 위상 정렬을 구현하고 장단점을 정리.
1의 보수는 0이 2개 생긴다는 한계에서 출발해서, 2의 보수가 왜 덧셈 회로 하나로 뺄셈까지 처리하는지, 그리고 carry를 버려도 되는 이유를 Modulo 연산 관점으로 정리.
AX 인재전쟁 예선에 제출한 Z3 기반 기획 검증 Codex 플러그인이 예비후보에 그친 이유를 되짚어본 회고.
AI 문서 편집·요약 서비스의 토큰 비용을 70% 줄이면서 응답 시간은 그대로 유지한 트러블슈팅 기록.
"입력은 자유로운데 처리는 고정되어 있던" 룰 베이스 챗봇을, 모델이 직접 도구를 선택해 사용하는 에이전트 구조로 바꾼 트러블슈팅 기록.
Spring AI 2.0.1에서 1년 된 스트리밍 NPE 이슈(#2765)를 목 서버로 직접 재현해본 기록. 원본 NPE는 사라졌지만 실패 자체는 남아있었다.
C에는 배열 경계 검사가 없다는 사실에서 출발해서, 스택과 힙에서 버퍼 오버플로우가 실제로 어떤 메모리를 덮어쓰는지 가상 메모리 구조로 정리.
타입 정보가 없는 C/C++ 환경에서 BDWGC가 스택과 힙을 워드 단위로 훑어 포인터로 의심되는 값을 마킹하는 방식과, 그로 인해 생기는 오탐 문제를 정리.
JPEG/PNG/GIF 세 포맷의 장단점을 정리하고, 손실은 부호화가 아니라 색상 양자화 단계에서 생긴다는 것부터 색 밴딩·디더링·하이라이트 클리핑까지.
Eden/S0/S1/Old로 나뉜 Java의 세대별 힙 구조와 Minor/Full GC의 동작, identity hash code로 객체 동일성을 보증하는 방식, TLAB 덕분에 new()가 malloc()보다 빠른 이유까지.
입학 시험부터 면접까지, 지원하며 겪은 것과 앞으로의 목표
정글에 입소하며 적어본 과거, 목표, 자세, 그리고 되고 싶은 모습에 대한 짧은 에세이.
2박 3일 팀 프로젝트에서 만든 것과, 구조를 잡으며 부딪힌 문제들
Mark & Sweep 알고리즘이 루트에서 시작해 도달 가능한 객체를 표시하고 나머지를 회수하는 원리와, 루트가 될 수 있는 세 부류를 정리.
재할당과 객체 수정(mutation)을 구분해서, 파이썬의 인자 전달 방식(Call by Object Reference)이 실제로 어떻게 동작하는지 정리.
참조 카운팅이 주력이고 추적 GC가 보조인 파이썬 GC 구조를, CSAPP의 가비지 컬렉터 정의부터 순환 참조와 세대별 수집까지 정리.
super()는 부모가 아니라 MRO상 다음 클래스를 가리킨다는 것부터, ABCMeta의 __subclasshook__과 register()로 상속 없이 서브클래스 판정이 이뤄지는 원리까지.
id가 없는 스트리밍 청크를 맵 키로 쓰면서 발생하는 Spring AI NPE 이슈를, mock 서버로 대조군/실험군을 나눠 재현해보는 계획을 기록한다.