이 블로그는 직접 개발하고 운영합니다 — 당신을 불쾌하게 만드는 광고가 없습니다.
자작 RAG vs Bedrock Knowledge Base — 직접 만들 때와 사서 쓸 때의 경계
계기: 날짜 검색이 자꾸 틀리던 자작 RAG를 고쳐놓고 나서, 같은 해법이 시험에 한 문장으로 적혀 있는 걸 봤습니다 관리형 vs 자작: 시험은 Bedrock Knowledge Base(완성품)를 답으로 주고 저는 LanceDB로 검색·청킹·병합을 직접 짰습니다 겹친 것: 청킹 전략과 하이브리드 검색입니다. 제가 두 번 갈아엎으며 잡은 걸 시험은 한 줄 개념으로 정리해뒀습니다 시험이 안 알려주는 것: “왜 이게…
서버 한 대짜리 자동 복구 설계 — watchdog·서킷브레이커·승인 게이트와 DOP-C02
밤사이 풍경: 예약해둔 작업들이 밤새 돌고 몇 개는 조용히 실패합니다. 봇이 죽으면 제가 자는 사이 watchdog가 되살려두고, 아침에 로그를 열면 대부분 성공에 몇 건 실패로 밤이 정리돼 있습니다 제가 한 것: 서버 한 대에 자동 복구를 접어 넣었습니다. 죽으면 되살리고(watchdog), 연달아 실패하면 끊고(서킷브레이커), 위험한 명령은 사람이 승인해야 통과합니다. 지금 여덟 개 작업에 이 차단기가 걸려…
Multi-AZ 고가용성 운영기 — 아키텍트 자격증이 묻는 리전 단위 재해 복구와의 거리
계기: AWS 아키텍트 자격증(SAP-C02)의 재해 복구 파트는 제가 몇 년간 운영한 고가용성 구조와 층위가 달랐습니다 시험이 묻는 범위: 다른 리전에 시스템을 통째로 하나 더 두는 멀티 리전 재해 복구 제가 한 것: 한 리전 안에서 두 가용영역(AZ)에 나눠 자동 페일오버까지. 멀티 리전은 안 해봤습니다 소득: 파일럿 라이트와 웜 스탠바이가 뭘 맞바꾸는 선택인지 정리됐습니다. 이전엔 이름만 알았습니다 한계: 리…

AWS 프로페셔널 자격증 3개 두 달 취득기 — 기출 복기 공부법과 한계
딴 것: 프로페셔널 3개(아키텍트·데브옵스·생성형 AI 개발자) + 기초 1개(AI Practitioner), 두 달 공부법: 강의 통독 안 함. 기출 문제를 Claude에 던지고 “왜 이게 정답이고 나머지는 왜 틀렸는지”를 한국어로 설명받는 식 가장 짧았던 케이스: AI Practitioner는 3일, 교재 0권, 65문항 중 오답 5개 미만 먹힌 이유: 공부법보다, 평소에 굴리던 사이드 프로젝트가 그대로 시험…

업무용 AI 비서의 탄생 (2편) — 기억을 입히는 이중 인덱싱
문제: 1편의 비서는 질문마다 백지에서 도구를 긁어, 과거 맥락이 전혀 쌓이지 않았습니다. 기억: 내 질문과 검색어를 마크다운으로 쌓고, 로컬 SQLite 벡터 저장소에 증분 인덱싱했습니다. 검색: 뜻으로 찾는 의미 기반 검색과 키워드로 찾는 단어 기반 검색을 하이 브리드로 묶었습니다. 인사이트: 흩어진 조각 기록을 도메인별로 의미 군집해, 묶이기 전엔 안 보이던 패턴을 뽑아냅니다. 효과: 프롬프트에 과거 맥락과…

업무용 AI 비서의 탄생 (1편) — 도구 네 개를 한 에이전트에 엮기
계기: 이슈 하나 들여다보려면 이슈 트래커, 사내 위키, 모니터링, 운영 DB를 매번 손으로 오가야 했습니다. 결심: 분석에 필요한 정보가 네 곳에 흩어져 있어서, 그 자료를 모으는 일 자체를 대신해 줄 비서를 만들기로 했습니다. 탄생: 업무용 AI 비서에 네 도구를 MCP로 한꺼번에 물려서, LLM이 직접 여러 도구를 호출해 데이터를 모으게 했습니다. 변화: 도구를 오가던 컨텍스트 스위칭이 사라지고, 질문 한…

(메신저개발) 메시지 좋아요 카운트, 레디스 락 대신 Set 자료구조로 잡기
증상: QA 스트레스 테스트에서 좋아요 카운트가 4~8% 적게 나옴 원인: ① DB에서 읽으면 복제 지연(Replication Lag)으로 옛 값을 봄 ② Redis 숫자 카운터(INCR)는 “누가 눌렀는지”를 몰라서 같은 사람의 중복 클릭을 못 막음 해결: 숫자를 세지 않고, 누가 눌렀는지를 Set(집합)에 저장. 카운트는 집합 크기, 중복은 자료구조가 알아서 막음 효과: 오차 0%, 락도 별도 검증 로직도 필요…
LLM 답변 길이 제어 — 글자가 아닌 토큰과 max_tokens
증상: AI 답변 길이를 프롬프트로 제한(“N자 이내로”)해도 무시당하거나, 반대로 문장이 중간에 뚝 잘림 원인: 모델은 글자가 아니라 토큰으로 생성한다. 한글은 1글자가 평균 약 1.7토큰. 한도에 먼저 걸려서 잘리는 거였음 해결: 프롬프트 강제를 포기하고, 토큰↔글자 비율을 실측해서 파라미터 자체를 맞춤 효과: 문장이 중간에 잘리는 문제가 사라짐. retry 단계도 줄어듦 한계: 토큰 비율은 언어·내용마다…
AWS AI Practitioner 3일 합격기 — 교재 0권, Claude 기출 풀이만으로
요약 (TL;DR) 공부 기간: 3일 교재: 0권. Claude한테 기출 풀이 시키기만 했습니다. 점수: 65문항 중 5문제 미만 오답 (정답률 92%+) 결론: AI 자격증 공부에 가장 잘 맞는 도구는 AI였습니다. 그리고 평소에 RAG·LanceDB·Bedrock으로 사이드 프로젝트를 굴리고 있던 게 시험장에서 그대로 정답으로 튀어나왔습니다. “이 시험은 AI에 대해 물어봤지만, 정작 합격에 가장 큰 기여를 한 건…