DNA / RNA 서열 도구
FASTA 정리 도구
지저분한 서열을 붙여넣으면 줄바꿈, 공백, 헤더 형식을 자동으로 정리해 깔끔한 FASTA로 만들어 줍니다. 헤더가 없는 서열에는 이름을 자동으로 붙이고, 중복된 헤더는 자동으로 구분해줍니다.
레코드: 0개
총 서열 길이: 0 nt
제거된 문자: 0개
이름 자동 생성: 0개
중복 이름 수정: 0개
빈 서열 제외: 0개
| 이름 | 길이 (nt) | 상태 |
|---|
🔒 모든 계산은 이 브라우저 안에서만 실행됩니다. 입력한 서열은 서버로 전송되거나 저장되지 않습니다.
광고 영역 (Google AdSense 승인 후 삽입 예정)
왜 FASTA 정리가 필요한가요?
논문, 데이터베이스, 시퀀서 소프트웨어 등 여러 출처에서 서열을 복사해 붙여넣다 보면, 줄바꿈 폭이 서로 다르거나, 서열 사이에 잔여 위치 번호·공백·탭이 섞여 있거나, 헤더가 아예 없거나 같은 이름이 중복되는 등 사소하지만 다음 분석 단계를 방해하는 문제가 자주 생깁니다. 이 도구는 이런 문제를 자동으로 찾아 정리한 뒤, 표준 형식의 FASTA로 다시 출력합니다.
이 도구가 자동으로 처리하는 것들
- 서열 본문 정리: 공백, 탭, 숫자(위치 번호 등 잔여 문자), 인식되지 않는 기호를 서열 본문에서 제거합니다.
- 헤더 없는 서열에 이름 부여:
>헤더가 없는 서열 블록에는 순번이 붙은 이름(예:sequence_1)을 자동으로 붙여줍니다. - 중복 헤더 자동 구분: 같은 이름의 헤더가 여러 번 나오면
_2,_3처럼 번호를 붙여 서로 구분되도록 정리합니다. - 빈 레코드 제외: 헤더만 있고 실제 서열이 없는 레코드는 결과에서 자동으로 제외합니다.
직접 선택할 수 있는 옵션
- 줄바꿈 폭: 60/70/80/100자 중에서 선택하거나, 한 줄로 이어 붙일 수 있습니다. 60자는 가장 널리 쓰이는 표준 FASTA 관례입니다.
- 대소문자: 모두 대문자, 모두 소문자, 또는 원본 그대로 유지할 수 있습니다.
- 정렬 갭 문자(-) 유지: 서열 정렬(alignment) 결과를 붙여넣는 경우, 하이픈(-)을 삭제하지 않고 그대로 보존할 수 있습니다.
- 헤더 공백을 밑줄로 치환: 헤더에 공백이 있으면 일부 프로그램에서 이름이 잘려 인식될 수 있어, 공백을 밑줄(_)로 바꿔 안전한 식별자로 만들 수 있습니다.
사용 방법
- 위 입력창에 정리하고 싶은 서열(FASTA·멀티 FASTA·헤더 없는 서열 모두 가능)을 붙여넣습니다.
- 줄바꿈 폭, 대소문자, 추가 옵션을 필요에 맞게 선택합니다.
- 결과 표에서 자동으로 이름이 붙었거나 중복이 수정된 레코드를 확인합니다.
- 정리된 FASTA를 복사하거나 파일로 다운로드합니다.
자주 묻는 질문
FASTA 정리 도구는 어떤 문제를 해결하나요?
여러 출처에서 복사한 서열은 줄바꿈 폭이 제각각이거나, 공백·탭·잔여 번호가 섞여 있거나, 헤더가 없거나 중복된 경우가 많습니다. 이 도구는 이런 문제를 자동으로 감지해 표준 FASTA 형식으로 정리합니다.
헤더가 없는 서열은 어떻게 처리되나요?
헤더(> 로 시작하는 줄)가 없는 서열 블록에는 자동으로 순번이 붙은 이름(예: sequence_1)이 부여되며, 결과 표에서 "이름 자동 생성" 배지로 표시됩니다.
정렬 서열의 갭 문자(-)도 유지할 수 있나요?
네. "정렬 갭 문자(-) 유지" 옵션을 켜면 서열 정렬(alignment) 결과에 포함된 하이픈(-)을 지우지 않고 그대로 보존합니다.
숫자나 공백이 섞인 서열도 정리할 수 있나요?
네. 서열 본문에 포함된 공백, 탭, 숫자(잔여 위치 번호 등) 등 알파벳이 아닌 문자는 자동으로 제거되며, 몇 글자가 제거되었는지 결과 화면에 표시됩니다.
입력한 서열이 서버로 전송되나요?
아니요. 모든 정리 작업은 자바스크립트로 브라우저 내부에서만 이루어지며 서버로 전송되거나 저장되지 않습니다.