에이전트는 어디서 어긋나기 시작하는가
에이전트가 이상한 답을 낼 때 증상은 마지막에 보이지만 어긋난 자리는 그보다 앞입니다. 한 걸음이 무너지는 여섯 자리를 나누고, 증상에서 원인을 거슬러 찾는 방법과 자리별 처방을 정리합니다.
PALDYN LEARN
AI가 어떻게 작동하는지 배웁니다. 모델의 원리부터 그 아래를 떠받치는 수학, 실제로 굴리는 방법까지.
에이전트가 이상한 답을 낼 때 증상은 마지막에 보이지만 어긋난 자리는 그보다 앞입니다. 한 걸음이 무너지는 여섯 자리를 나누고, 증상에서 원인을 거슬러 찾는 방법과 자리별 처방을 정리합니다.
에이전트는 같은 입력에도 다른 경로로 갑니다. 그래서 로그 몇 줄로는 왜 그렇게 됐는지 복원이 안 됩니다. 트레이스를 어떻게 나누고 구간마다 무엇을 붙이며 어떤 지표를 볼지 정리합니다.
걸음이 두 배면 비용은 두 배가 아니라 서너 배입니다. 왜 그렇게 되는지, 어디서 새는지, 상한을 몇 겹으로 어떻게 거는지와 실제로 효과가 큰 순서대로의 대응을 정리합니다.
승인 버튼을 걸음마다 두면 아무도 그 에이전트를 쓰지 않고, 하나도 안 두면 사고가 납니다. 게이트를 놓을 세 자리와 어느 걸음에 무엇을 걸지 정하는 순서를 정리합니다.
몇 분이면 끝나던 에이전트가 몇 시간짜리 일을 맡으면 전에 없던 문제가 생깁니다. 상태를 어디에 둘지, 체크포인트를 어디에 남길지, 같은 걸음을 두 번 밟아도 안전하게 만들려면 무엇이 필요한지 정리합니다.
여럿으로 나눈 에이전트가 기대만큼 못 하는 이유는 대개 넘기는 자리에 있습니다. 대화를 통째로 넘기는 방식이 왜 나쁜지, 봉투에 무엇을 담아야 하는지, 돌려받는 쪽에 무엇이 있어야 하는지 정리합니다.
에이전트를 여럿 세우면 그럴듯해 보이지만 대부분은 하나로 두는 편이 낫습니다. 나누는 방식 네 가지의 모양과 값, 나눌 이유가 있는지 판단하는 세 질문, 그리고 나눈 뒤에 생기는 새로운 실패를 정리합니다.
코드를 짜서 돌리는 에이전트는 유용한 만큼 위험합니다. 격리를 어디까지 세울지, 파일·네트워크·자격 증명·자원 네 갈래를 각각 어떻게 닫을지, 그리고 샌드박스가 절대 막아 주지 않는 것이 무엇인지 정리합니다.
웹은 에이전트가 가장 자주 만나는 화면이고, 그래서 가장 잘 다룰 수 있는 화면이기도 합니다. 페이지를 무엇으로 읽어 넣을지, 언제까지 기다릴지, 무엇으로 요소를 가리킬지, 그리고 페이지에 적힌 글자를 왜 믿으면 안 되는지 정리합니다.
API가 없는 프로그램을 에이전트에게 시키려면 사람처럼 화면을 쓰게 하는 수밖에 없습니다. 관측·행동 루프의 구조와 비용, 좌표·접근성 트리·DOM 중 무엇으로 가리킬지, 그리고 되돌릴 수 없는 동작과 화면에 뜬 지시를 어떻게 다룰지 정리합니다.
한 질의를 단계로 쪼개 보면 시간과 돈이 쏠리는 자리는 거의 정해져 있습니다. 검색과 생성의 지분, 근거를 줄일 때 실제로 돌아오는 값, 프롬프트 캐시가 걸리는 조건, 그리고 무엇을 먼저 재야 하는지 정리합니다.
테넌트를 가르는 방법은 전용 색인, 색인 안의 칸, 값 하나로 구분하기 셋입니다. 격리 강도와 비용이 어떻게 맞바뀌는지, 조건 하나에 격리를 맡기면 왜 위험한지, 이탈과 삭제를 어떻게 준비할지 정리합니다.
색인은 어느 시점의 사진이고, 원본은 계속 바뀝니다. 감지·처리·반영 세 지연을 나눠 재는 법, 청크 경계가 밀려 재임베딩이 번지는 문제, 삭제가 가장 자주 새는 이유를 정리합니다.
메타데이터 필터링은 조건을 하나 더 붙이는 일이 아니라 벡터 탐색의 앞뒤 어디에 끼우느냐의 문제입니다. 사전·사후 필터링의 차이, 조건이 좁을 때 근사 탐색이 무너지는 지점, 필터로 쓸 값을 어떻게 설계할지 정리합니다.
표에서 뜻을 만드는 것은 값이 아니라 행과 열이 만나는 자리입니다. 청킹이 표를 어떻게 망가뜨리는지, 색인에 넣는 세 가지 방식이 각각 어떤 질문에 맞는지, 병합 셀에서 무엇이 어긋나는지 정리합니다.
OCR은 추출이 아니라 생성입니다. 인식 정확도 98%가 청크 단위로 무엇을 뜻하는지, 같은 오류가 키워드 검색·벡터 검색·답변에서 왜 다르게 드러나는지, 신뢰도 점수를 어떻게 쓰는지 정리합니다.
PDF 안에는 글자와 좌표만 있고 문단·단·표·헤딩은 없습니다. 읽기 순서가 왜 어긋나는지, 파서를 문서마다 어떻게 고르는지, 헤딩을 살리는 것이 왜 그렇게 값을 하는지 정리합니다.
청크는 문서에서 잘려 나온 조각이라 「이번 분기」가 몇 분기인지 안에 없습니다. 색인하기 전에 맥락 한두 문장을 앞에 붙여 두는 방법과 그 비용, 흔히 어긋나는 자리를 정리합니다.
긴 청크를 임베딩 하나에 밀어 넣으면 세부가 지워집니다. 레이트 인터랙션은 토큰마다 벡터를 남겨 그 손실을 피하는 방식입니다. MaxSim이 무엇을 계산하는지, 저장 용량이 왜 문제가 되는지, 어느 자리에 놓아야 값을 하는지 정리합니다.
키워드와 벡터를 합쳤는데 기대만큼 안 좋아지는 흔한 상황을 다룹니다. 손잡이가 어디에 있는지, 만지는 순서가 왜 정해져 있는지, RRF의 k가 실제로 무엇을 바꾸는지, 한국어에서 특히 갈리는 자리를 정리합니다.
매 요청에 실려 가는 고정 비용이자 캐시의 앞부분입니다. 무엇을 넣고 무엇을 뺄지, 어떤 순서로 쌓을지, 규칙을 금지 대신 대체 행동으로 쓰는 법을 정리합니다.
여러 턴이 쌓이면 비용은 제곱으로 늘고 오래된 지시가 새 지시를 이깁니다. 언제 접을지, 무엇을 메시지 밖으로 뺄지, 접을 때 캐시를 어떻게 지킬지 정리합니다.
창이 커지면서 검색이 필요 없다는 말이 나왔지만 실제 선택은 그렇게 단순하지 않습니다. 비용이 갈리는 지점, 정확도가 무너지는 지점, 둘을 섞는 세 가지 방식을 정리합니다.
토큰 추정이 실제와 얼마나 벌어지는지, 안전 여유를 데이터로 정하는 법, 예산 초과 시 되돌리기 쉬운 것부터 버리는 강등 순서를 코드로 고정하는 방법을 정리합니다.