23.06.15
DEVOTEE를 활성화 시키면
지금 작성한 커뮤니티 글에 대해 1개의 댓글을 달아줍니다.
버튼을 누르면 글 수정 시 ChatGPT가 작성한 댓글이 수정됩니다.
| 컨텐츠 유형 | 제목 | 저장일 | 삭제 |
|---|
본인인증 로그인에 실패하였습니다.
회원이 아니시거나 본인인증 등록이
완료되지 않은 사용자입니다.
소제목을 Claude 비싸고 일단 Nova로 쓰자고 잡았다.
기존에 만들었던 모델은
이 형태의 구조인데 좀 너무 간단하고 학습될 데이터가 정형화가 되어야한다.
대부분 pdf나 docs 파일 그리고 pcap 파일은 비정형화 파일이므로
선회했다.
전체적으로 만든 구성도는 아래와 같다.
실제로 Bedrock 기반의 Claude 또는 Amazon Nova 을 써야하기때문에 일단
RAG 형태로 Q&A를 할 수 있는 기반을 이렇게 꾸몄다.
S3에는 내가 원하는 3GPP 문서 5개 그리고 RFC 문서 하나를 업로드 했고,
이걸 Opensearch serveless 그리고 Knowledge Base와 연동을 해서
RAG 형태로 학습을 할 수 있게 해줬다.
그려면 Prompt 작성 후 Answer 자체는 기본적으로
할루시네이션을 최소화를 한 문서 기반의 답변을 해준다.
아래는 실제 test 예시이다.
기본적으로 알고 있는 패킷 캡처 방법에 대해서는
Wireshark나 tcpdump 또는 SPAN포트 등을 활용하는 예시를 줬고
pcap 파일형식이 뭐야라는 바보같은 질문은 모른다 했다.
pcap이 pcap이지;
아직까지는 pcap을 읽어와서 분석하는데는 많은 시행착오가 필요하다.
현재는 신입사원이 와서 IMS registration 절차 알려줘 정도를 하면
이렇게 3GPP 기반으로 24.229 문서를 읽어와서 거기에서 IMS registraiton 분야에 대해서 알려준다.
아는사람들은 알겠지만 3GPP 문서 용량이 너무 커서 이거 loading하는데 허송세월
Ctrl+F하는데 하루종일 걸리는데 미리 학습을시켜놓으면 편하게 볼 수 있다.
일단 현재까지 실제 Prompt를 넣어서 IMS regi와 같은 Process를 규격기반으로 Return 하는것을 확인했고
일단 내가 그럼 하고싶었던 Error cause는 제대로 학습하는지 살펴보자
404 Not Found라는 Error cause를 여기에 Q&A로 넣으면 아는사람은 알지만
4XX대 Error는 Client 에러, 5XX 에러는 Server쪽 에러다.
이제 하고싶은거는 pcap 파일을 올려서 Error값을 분석하고 그 결과를
여기로 던져서 상황파악을 하고 이런걸 해보고 싶은데, 일단
pcap 파일을 학습시키려면 chunk 형태로 쪼개야 하는데 그러려면 어쩔 수 없이 또
Lambda 학습이 필요하다.
최종 Ending picture는 아래와 같은데
현재까지 만들어진건 아래와 같다.
RAG 엔진만 연결해놓은 상태이고 아래 PCAP처리 파이프라인과
Lambda 트리거 그리고 pyshark/scapy 파싱과
데이터 연동 그리고 결과해석까지 한번 쭉 만들어보자.
DEVOTEE를 활성화 시키면
지금 작성한 댓글에 AI가 댓글을 달아줍니다.