토요일, 6월 01, 2024

대표 박테리아들을 활용해서 호흡기감염을 좀더 잘 이해할 수 있을까?

벌써 24년의 6월이 시작하였습니다. 

오늘은 microbiome 분석을 통해서 소아가 호흡기 감염에 감염되었을 때, 진료, 치료에 도움을 줄 수 있는 것이 있지 않을까하는 (물론 제 생각) 내용에 관련된 논문을 가지고 와봤습니다.

논문 제목은 Bacterial Signatures of Paediatric Respiratory Disease: An Individual Participant Data Meta-Analysis 입니다.

DOI: 10.3389/fmicb.2021.711134


clova-x

 소아 호흡기 질환에서 박테리아의 역할은 다양한 요인에 의해 결정되며, 상기도와 하기도에서 박테리아의 다양성이 감소하는 경향이 있다는 것을 발견했습니다. 또한, 특정 박테리아 종류가 특정 질환과 연관되어 있을 수 있다는 가능성도 제시되었습니다.

이 연구는 소아 호흡기 질환에서 박테리아의 역할을 이해하는 데 중요한 정보를 제공하지만, 여전히 추가적인 연구와 검증이 필요합니다. 이를 통해 소아 호흡기 질환의 예방과 치료에 대한 더 나은 전략을 개발할 수 있을 것으로 기대됩니다.

이 연구는 호흡기 질환을 예방하고 치료하는 데 있어서 박테리아의 역할을 이해하는 데 중요한 정보를 제공합니다. 하지만, 이 연구는 몇 가지 한계점이 있습니다. 예를 들어, 데이터의 품질과 일관성이 부족한 경우가 있었고, 분석에 사용된 알고리즘이 완벽하지 않을 수 있습니다. 또한, 소아 호흡기 질환에서 박테리아의 역할을 완전히 이해하기 위해서는 더 많은 연구와 데이터가 필요합니다.

이 연구는 소아 호흡기 질환에서 박테리아의 역할을 이해하는 데 중요한 정보를 제공합니다. 이 연구는 다양한 데이터셋을 분석하여, 상기도와 하기도에서 박테리아의 다양성이 감소하는 경향이 있다는 것을 발견했습니다. 또한, 특정 박테리아 종류가 특정 질환과 연관되어 있을 수 있다는 가능성도 제시되었습니다.

이 연구는 소아 호흡기 질환에서 박테리아의 역할을 이해하는 데 중요한 정보를 제공합니다. 이 연구는 다양한 데이터셋을 분석하여, 상기도와 하기도에서 박테리아의 다양성이 감소하는 경향이 있다는 것을 발견했습니다. 또한, 특정 박테리아 종류가 특정 질환과 연관되어 있을 수 있다는 가능성도 제시되었습니다.

이 연구는 소아 호흡기 질환에서 박테리아의 역할을 이해하는 데 중요한 정보를 제공합니다. 이 연구는 다양한 데이터셋을 분석하여, 상기도와 하기도에서 박테리아의 다양성이 감소하는 경향이 있다는 것을 발견했습니다. 또한, 특정 박테리아 종류가 특정 질환과 연관되어 있을 수 있다는 가능성도 제시되었습니다.



chatGPT

### 소아 호흡기 감염 연구: 박테리아의 역할과 중요성

안녕하세요, 여러분! 오늘은 소아 호흡기 감염과 관련된 최신 연구 내용을 소개하려고 합니다. 이 글은 특히 생명공학을 전공하지 않았지만, 골다공증이나 호흡기 질환에 관심이 있는 분들을 위해 쉽게 설명해드리겠습니다.

#### 연구 배경

소아의 호흡기 감염은 전 세계적으로 많은 어린이에게 영향을 미치는 중요한 건강 문제입니다. 하지만 대부분의 연구는 성인을 대상으로 하고 있어, 소아 호흡기 감염에 대한 정보는 상대적으로 부족한 상황입니다. 이번 연구는 소아 호흡기 감염과 관련된 박테리아의 다양성과 그 역할을 분석하여, 더 나은 진단과 치료 방법을 찾기 위해 수행되었습니다.

#### 연구 방법

연구팀은 소아의 다양한 호흡기 질환(기관지염, 천식, 낭포성 섬유증 등)을 조사한 21개의 연구에서 2624명의 어린이로부터 2789개의 샘플을 수집했습니다. 이 샘플들을 분석하여 호흡기 감염과 관련된 박테리아의 다양성을 조사하고, 특정 박테리아가 질병과 어떻게 연관되는지를 확인했습니다.

#### 주요 발견

1. **박테리아 다양성의 차이**:

   - 호흡기 질환이 있는 소아의 박테리아 다양성은 건강한 소아와 차이가 있었습니다.

   - 특히, 코에서 채취한 샘플에서는 건강한 소아에 비해 **Streptococcus**와 **Haemophilus**의 비율이 높았습니다.

2. **특정 박테리아의 역할**:

   - **Streptococcus**와 **Haemophilus**는 병리학적 상태와 밀접한 관련이 있는 것으로 나타났습니다.
   - 반면, **Corynebacterium_1**, **Staphylococcus**, **Dolosigranulum**은 건강한 상태와 연관이 있었습니다.

3. **기계 학습을 통한 진단 가능성**:

   - 기계 학습 기법을 사용하여 박테리아 프로파일을 분석한 결과, 호흡기 질환을 진단할 수 있는 가능성을 확인했습니다.
   - 특히, 가래와 구강 샘플이 유망한 결과를 보여, 비침습적인 방법으로도 소아 하부 호흡기 질환을 진단할 수 있을 것으로 기대됩니다.

#### 결론

이번 연구는 소아 호흡기 감염과 관련된 박테리아 프로파일을 명확히 함으로써, 질병의 진단과 치료에 중요한 기초 자료를 제공했습니다. 이러한 발견은 앞으로 더 나은 치료법을 개발하는 데 큰 도움이 될 것입니다. 또한, 기계 학습을 통한 비침습적인 진단 방법의 가능성을 확인하여, 어린이들에게 보다 편안한 진단 과정을 제공할 수 있을 것으로 기대됩니다.

이 연구는 소아의 건강을 지키기 위한 중요한 첫걸음입니다. 앞으로도 이러한 연구가 계속되어, 더 많은 어린이들이 건강한 삶을 누릴 수 있기를 바랍니다. 읽어주셔서 감사합니다!

---

이 블로그 글을 통해 소아 호흡기 감염에 대한 이해를 높이고, 관련된 최신 연구 결과를 쉽게 전달할 수 있기를 바랍니다. 질문이나 추가적인 정보가 필요하시면 언제든지 댓글로 남겨주세요!


이번에 gemini를 제외한 이유는 제대로 논문을 불러오지 못해서 제외하였습니다. 

그런데 clova-x는 마지막 문장을 반복하여 보여줘서 양이 많은 것처럼 속이네요;; ㅋㅋ 그리고 역시 우리의 chatGTP는 댓글도 남겨달라는 자연스러움까지...  제가 저렇게 쓴줄..
일단 댓글을 다시는것은 자유이나 답변이 달릴것이라는 기대는 접으시기 바랍니다. ;)



출처: @ye._.vely618

목요일, 5월 30, 2024

고관절 골절 예측, 어디까지 해봤니?

오늘은 페이지를 뒤척이다가 얻어걸린 내용을 생성형 AI들에게 물어보았습니다.

이번 나뚜루 노화에 게시된 A plasma protein-based risk score to predict hip fractures 입니다.

DOI: 10.1038/s43587-024-00639-7

고관절 골절 위험 예측을 위해서 (유전체 정보가 아닌) 단백질 마커를 활용해서 예측하는 점수 체계를 개발했다고 합니다. 물론 아직 임상적인 유용성은 확보하지 못했지만, 관심있는 접근법이라서 가져와봤습니다.


gemini

## 골다공증 환자를 위한 새로운 희망: 혈액 단백질 기반 엉덩이 골절 위험 예측

골다공증은 나이가 들면서 발생하는 질환으로, 뼈가 약해져 골절 위험이 증가하는 질환입니다. 특히 엉덩이 골절은 장애와 사망 위험이 높은 심각한 합병증을 유발하기 때문에 많은 사람들에게 두려움의 대상이 되고 있습니다. 

현재 엉덩이 골절 위험을 예측하는 데는 FRAX와 같은 도구가 사용되고 있습니다. 하지만 FRAX는 골밀도(BMD) 정보만을 활용하기 때문에, 골밀도가 정상이더라도 엉덩이 골절 위험이 높은 환자들을 제대로 식별하지 못하는 경우가 있습니다.

최근 연구에 따르면, 혈액 단백질 정보를 활용하여 엉덩이 골절 위험을 더 정확하게 예측할 수 있다는 사실이 밝혀졌습니다. **단백질은 우리 몸에서 다양한 역할을 수행하는 중요한 분자이며, 혈액 단백질 수준은 개인의 건강 상태와 질병 위험을 반영할 수 있습니다.**

이 연구에서는 **SomaScan 압타머 기반 플랫폼과 Olink 이중 항체 근접 확장 플랫폼**이라는 두 가지 단백질 분석 기술을 사용하여 엉덩이 골절 위험을 예측하는 단백질 기반 위험 점수를 개발했습니다. 

**연구 결과, 단백질 기반 위험 점수는 FRAX보다 엉덩이 골절 예측의 정확성을 향상시켰습니다.** 또한, 단백질 기반 위험 점수는 엉덩이 골절 위험이 높은 환자를 식별하는 데 유용한 임상 도구가 될 수 있다는 것을 보여주었습니다.

**단백질 기반 위험 점수는 다음과 같은 장점을 가지고 있습니다.**

* **더 정확한 엉덩이 골절 위험 예측:** 단백질 기반 위험 점수는 FRAX보다 엉덩이 골절 예측의 정확성을 향상시켰습니다. 이는 엉덩이 골절 위험이 높은 환자를 더 정확하게 식별하고, 불필요한 골다공증 치료를 줄이는 데 도움이 될 수 있습니다.

* **저렴하고 비침습적:** 단백질 분석은 혈액 또는 기타 체액 샘플에서 수행할 수 있으며, 비용이 덜 들고 더 빠를 수 있습니다. 이는 더 많은 사람들이 엉덩이 골절 위험 검사를 받을 수 있도록 하는 데 도움이 될 수 있습니다.

* **개인의 환경 및 생활 방식 요인 반영:** 단백질 프로필은 개인의 환경 및 생활 방식 요인에 대한 정보를 통합할 수 있습니다. 이는 개인 맞춤형 위험 평가를 제공하고, 엉덩이 골절 위험을 줄이는 데 도움이 되는 생활 방식 변화를 권장하는 데 사용될 수 있습니다.

* **치료 표적 식별:** 혈액 단백질 수준은 엉덩이 골절의 발병 및 진행에 관여하는 생물학적 과정을 반영할 수 있습니다. 이 정보는 새로운 치료법 개발 및 기존 치료법의 효과를 개선하는 데 사용될 수 있습니다.

**단백질 기반 위험 점수는 아직 개발 초기 단계이지만, 엉덩이 골절 예측과 예방에 혁신을 가져올 수 있는 잠재력을 가지고 있습니다.** 앞으로 더 많은 연구를 통해 단백질 기반 위험 점수의 정확성과 유용성을 입증하고, 임상 실무에 도입할 수 있도록 노력해야 합니다.

**골다공증으로 고민하는 분들은 단백질 기반 위험 점수 검사를 통해 자신의 엉덩이 골절 위험을 정확하게 파악하고, 적절한 예방 조치를 취하는 것을 고려해 보는 것도 좋은 방법입니다.**


clova-x

 단백질 기반 위험 점수(proteomic risk score)를 이용하여 고관절 골절(hip fracture) 예측 모델을 개발했다는 내용을 확인할 수 있습니다. 이 연구는 단백질 프로파일링 기술을 이용하여 고관절 골절 위험과 관련된 단백질을 식별하고, 이를 기반으로 위험 점수를 개발하여 고관절 골절 예측 모델을 구축했습니다.

이 연구의 목적은 단백질 기반 위험 점수를 이용하여 고관절 골절 예측 모델을 개발하는 것입니다. 이 연구는 단백질 프로파일링 기술을 이용하여, 고관절 골절 위험과 관련된 단백질을 식별하고, 이를 기반으로 위험 점수를 개발하여 고관절 골절 예측 모델을 구축했습니다. 이를 통해 고관절 골절 예방을 위한 환자의 위험도를 파악하고, 치료 및 예방 전략을 개발하는 데 도움을 줄 수 있습니다.

이 연구에서는 유전체 정보가 아닌 단백질 정보를 활용하여 고관절 골절 예측 모델을 개발하였습니다. 이는 단백질 정보가 유전체 정보보다 고관절 골절 발생과 더 밀접한 관련이 있기 때문입니다.

단백질 기반 위험 점수는 고관절 골절 예측과 판별력 개선에 효과적입니다. 이 모델은 기존의 다유전자 위험 점수와는 달리 골절이나 골밀도 정보를 포함하지 않습니다. 단백질 기반 위험 점수는 고관절 골절 위험도에 따라 환자를 분류하는 새로운 도구로 활용될 수 있습니다.

이 모델은 고관절 골절 예방을 위한 환자의 위험도 파악에 유용합니다. 단백질 프로파일은 유전적 변이와 환경적 요인에 대한 정보를 통합합니다. 이 연구는 고관절 골절 예측과 판별력 개선을 위한 단백질 기반 위험 점수의 임상적 유용성을 확인했습니다.

이 연구는 생명공학 분야에서 중요한 연구 결과로 평가됩니다. 이 연구는 고관절 골절 예방을 위한 새로운 방법을 제시하고, 환자의 치료와 예방에 큰 도움을 줄 수 있습니다. 이 연구는 골다골증에 관심이 있는 사람들에게 중요한 정보를 제공할 수 있습니다.


chatGPT

### 고관절 골절 위험 예측, 유전체 정보 대신 단백질 정보를 활용한 이유

골다공증은 뼈가 약해져서 쉽게 골절되는 질병으로, 나이가 들수록 많은 사람이 겪게 됩니다. 특히 고관절 골절은 큰 문제인데, 이는 심각한 장애와 높은 사망률을 동반하기 때문입니다. 고관절 골절 후 1년 이내에 사망할 확률이 20%에 달하기 때문에, 예방이 매우 중요합니다. 그래서 고관절 골절 위험을 정확하게 예측하는 것이 필요합니다.

지금까지는 주로 유전체 정보를 기반으로 한 예측 도구를 사용해왔습니다. 유전체 정보는 우리의 DNA에 담긴 유전 정보를 말합니다. 하지만 최근 연구에서는 유전체 정보 대신 단백질 정보를 활용하는 새로운 접근법을 시도하고 있습니다. 그렇다면, 왜 단백질 정보를 사용하게 된 걸까요?

#### 단백질 정보의 장점

1. **직접적인 생물학적 역할**:

   단백질은 우리 몸에서 여러 가지 중요한 역할을 하는 분자입니다. 단백질은 유전자의 명령을 실행하여 우리 몸의 기능을 수행하는데, 이를 통해 현재의 건강 상태를 더 정확하게 반영할 수 있습니다.

2. **환경과 상호작용**:

   단백질 수준은 유전적인 요인뿐만 아니라, 식습관, 운동, 약물 복용 등의 환경적 요인에도 영향을 받습니다. 이는 단백질 정보가 우리의 현재 생활 습관과 건강 상태를 더 잘 반영할 수 있다는 뜻입니다.

3. **질병 상태의 반영**:

   유전체 정보는 평생 변하지 않지만, 단백질 수준은 시간에 따라 변화합니다. 따라서 단백질 정보는 현재의 질병 상태나 위험을 평가하는 데 매우 유용합니다.

4. **더 나은 예측력**:

   연구 결과, 단백질 기반의 위험 점수가 유전체 기반 점수보다 고관절 골절 위험을 더 정확하게 예측할 수 있었습니다. 이는 단백질이 실제 질병 발현과 밀접하게 관련되어 있음을 보여줍니다.

5. **프로테오믹스 기술의 발전**:

   최근에는 단백질을 대규모로 분석할 수 있는 기술이 발전하여, 많은 양의 단백질 정보를 쉽게 얻을 수 있게 되었습니다. 이를 통해 더 정교하고 정확한 예측 모델을 만들 수 있습니다.

#### 연구의 주요 내용

이 연구에서는 단백질 기반의 새로운 고관절 골절 위험 점수를 개발하고 이를 검증했습니다. 연구팀은 수천 명의 혈액 샘플을 분석하여 단백질 정보를 수집하고, 이를 바탕으로 고관절 골절 위험을 예측하는 모델을 만들었습니다. 그 결과, 단백질 기반 점수가 기존의 유전체 기반 점수보다 더 우수한 예측력을 보였습니다.

#### 결론

이번 연구는 단백질 정보를 활용하여 고관절 골절 위험을 더 정확하게 예측할 수 있는 가능성을 보여주었습니다. 이는 앞으로 더 많은 사람들이 고관절 골절을 예방하고 건강한 삶을 유지하는 데 큰 도움이 될 수 있을 것입니다.

골다공증과 고관절 골절에 관심이 있으신 분들께 이번 연구가 유익한 정보를 제공했기를 바랍니다. 앞으로도 건강한 뼈를 유지하기 위해 꾸준한 관심과 노력이 필요합니다.


gemini가 내용면에서는 가장 충실하게 작성해준 듯 합니다. 그리고 "블로그에 올릴 수 있는 글을 작성해줘" 하기 전에 이런 저런 것들을 물어보면서 사전 학습을 시키지만 모델마다 그 결과가 다르다는 것을 항상 느껴지네요.

그럼 다음에 또 유용한 정보를 가져오도록 하겠습니다.


출처: @ye._.vely618


월요일, 5월 27, 2024

flask에서 파일 접근 방법

지금까지 열심히 모아놓은 sotck db를 활용해서 flask를 통해 보기 좋게 화면을 하나 만들어보려고 작업중에 있는데 예상치 못한 난관에 부딪혀서 몇일을 해메였는데...

결국은 별거 아니었다는...


그래서 준비했습니다.

!!Flask를 사용해서 sqlite3 접근시 주의사항!!

플랫폼은 Windows 10 (Home), 파이썬은 3.12, flask, jinja2 등등 필요한 라이브러리는 pip3 default로 설치하였고, jupyter-notebook를 사용해서 개발중에 있습니다.

문제가 되었던 것은 

C:\WORK\jupyter 폴더에 flask의 Home 폴더가 되어 해당 폴더 밑에 index.py와 stocks.db 이름을 가지는 sqlite3 db를 위치해 두었습니다.

이전에 github에 올려두었던 python script를 사용해서 매주 업데이트 하고 있고, 최근에는 dart 정보도 추가해 놓은 터였죠.

index.py파일에서 "con = sqlite3.connect('stocks.db')" 코드로 접근해서 stock라는 테이블에서 자료를 뽑아오는 거였는데 no such table stock라고 stock 테이블이 없다고 에러를 뿜어대는데.. 

당연히 index.py와 같은 디렉토리 안에 있었기 때문에 

con = sqlite3.connect('stocks.db')

적어준것이 었는데,

con = sqlite3.connect('C:\WORK\jupyter\stocks.db')

이렇게 절대 경로를 모두 넣어줘야지 정상적으로 작동이 되는 것이었습니다.


No such table 에러를 구글에 검색해보니... migration이 제대로 안되어서 blablabla

도움이 하나도 안되는... (일반적인 경우 저 검색결과가 도움이 되었겠지만, 나는 아무것도 안했단말이다. ㅋ)


결국 connect 시 절대 경로를 모두 포함된 파일명을 사용하면 되는 것이었습니다.

다음에는 좀 더 유용한 내용으로 돌아오도록 하겠습니다.



출처: @ye._.vely618


일요일, 5월 26, 2024

결핵균의 변이 탐지 기술이 왜 중요한가

 오늘은 2020년에 출판된 결핵균과 관련된 논문을 하나 가져와봤습니다.

제목은 Genomic variant-identification methods may alter Mycobacterium tuberculosis transmission inferences 으로 결핵균의 감염 경로를 예측하는 방법에 결핵균의 변이 탐지가 어떤 영향을 끼치게 되는지에 대한 내용을 담고 있습니다.

DOI: 10.1099/mgen.0.000418


오늘도 역시나 여기저기에 물어봐서 "블리그에 올릴 글을 작성해줘" 결과를 올려보도록 하겠습니다.


claude

제목: 결핵균 전염 추적을 위한 유전체 변이 탐지 기술의 중요성

결핵은 여전히 전 세계적으로 가장 많은 사람을 죽이는 감염병입니다. 결핵균의 전파를 차단하는 것이 결핵 퇴치에 필수적입니다. 하지만 고위험 지역에서 대부분의 전염이 어디에서 누구에 의해 일어나는지 알려져 있지 않습니다. 이에 결핵균의 유전체 변이 패턴 분석을 통해 전염 경로를 추적하려는 시도가 이루어지고 있습니다.

결핵균은 전파될 때마다 지속적으로 진화하면서 돌연변이가 축적됩니다. 두 균주 간의 유전적 거리가 가깝다면 최근에 전염에 의해 연결되었을 가능성이 높습니다. 따라서 유전체 변이 데이터를 통해 전염 링크를 예측하고 계통수를 재구성하여 유행의 역학적 특징을 파악할 수 있습니다.

하지만 현재 결핵균 유전체 변이를 측정하는 방법에 대한 합의가 부족한 실정입니다. 스탠퍼드 대학 연구팀이 수행한 최근 연구에 따르면, 서로 다른 변이 식별 파이프라인을 사용했을 때 동일한 시퀀싱 데이터에서 상이한 변이 집합이 도출되어 전염 추론 결과도 달라졌습니다. 

연구팀은 일반적인 변이 호출 도구들의 성능을 시뮬레이션된 결핵 유행 데이터에 대해 평가했을 때, 도구 간 성능 차이가 컸음을 발견했습니다. 특히 변이 필터링 전략에 따라 전염 링크 예측과 계통수 재구성 정확도가 현저히 달라졌습니다.

연구팀은 결핵균 유전체 변이 탐지를 개선하기 위해 다음과 같은 방안을 제시했습니다:

1) 결핵균 전용 유전체 변이 진위 데이터셋 구축

2) 결핵균 유전체에 최적화된 변이 호출기 개발

3) 정확한 변이 탐지를 위한 긴 리드 시퀀싱 데이터 활용

4) 변이 불확실성 측정 및 계통발생 분석 통합

결핵균의 전염 경로를 추적하고 효과적인 결핵 관리 전략을 수립하기 위해서는 결핵균 유전체의 특성을 고려한 최적의 변이 탐지 전략 마련이 시급합니다. 향후 이 분야에 대한 지속적인 연구를 통해 표준화된 분석 방법이 정립되기를 기대해봅니다.


gemini

## Mycobacterium tuberculosis 전파 추론에 대한 변이 식별 접근 방식의 영향 요약

**서론**

병원체 게놈 데이터는 중요한 인간 병원체의 전 세계적 및 지역적 전파 패턴을 특성화하고 공중 보건 개입을 알리는 데 점점 더 많이 사용되고 있습니다. 하지만 게놈 변이를 측정하는 방법에 대한 현재 합의는 없습니다. 

이 연구는 Mycobacterium tuberculosis의 전파 추론에 대한 변이 식별 접근 방식의 영향을 테스트하기 위해 수행되었습니다.

**방법**

5개의 게놈 역학 그룹이 동일한 발병 순서 데이터에 변이 식별 파이프라인을 적용하는 실험을 수행했습니다. 

연구자들은 일반적으로 사용되는 변이 식별 도구의 성능을 평가하기 위해 발병을 시뮬레이션했습니다. 

그들은 서로 다른 그룹에서 사용하는 변이 호출 접근 방식이 일관된 변이 세트를 복구하지 못하고, 진정한 변이를 복구하는 성능은 접근 방식에 따라 크게 다르다는 것을 발견했습니다. 

또한 게놈 전반 및 발병 수준의 진정한 변이를 모두 복구하는 단일 변이 식별 접근 방식은 없지만, 실제 순서 데이터에 따라 캘리브레이션된 변이 식별 알고리즘 또는 지역 재조립을 포함하는 알고리즘이 분리된 개체 간 진정한 쌍 차이를 복구하는 데 더 뛰어납니다. 

마지막으로 연구자들은 점점 더 엄격한 필터를 적용하는 것이 전파 추론과 발병 변이에서 재구성된 계통 발생의 정확도에 미치는 영향을 조사했습니다. 

그들은 일반적으로 사용되는 Mycobacterium tuberculosis 게놈 변이를 식별하는 접근 방식은 성능이 다양하며, 특히 쌍 차이를 통해 잠재적인 전파 링크를 예측하는 경우 덜 엄격한 변이 필터링을 통해 계통 발생 재구성을 개선할 수 있음을 발견했습니다.

**결과**

* 서로 다른 그룹에서 사용하는 변이 호출 접근 방식은 일관된 변이 세트를 복구하지 못합니다.

* 진정한 변이를 복구하는 성능은 접근 방식에 따라 크게 다릅니다.

* 게놈 전반 및 발병 수준의 진정한 변이를 모두 복구하는 단일 변이 식별 접근 방식은 없습니다.

* 변이 필터 선택은 파이프라인 전반에 걸쳐 광범위한 차이에 기여합니다.

* 점점 더 엄격한 필터를 적용하면 전파 추론의 정확도와 발병 변이에서 재구성된 계통 발생의 품질이 빠르게 감소합니다.

* 일반적으로 사용되는 Mycobacterium tuberculosis 게놈 변이를 식별하는 접근 방식은 성능이 다양하며, 특히 쌍 차이를 통해 잠재적인 전파 링크를 예측하는 경우 덜 엄격한 변이 필터링을 통해 계통 발생 재구성을 개선할 수 있습니다.

**결론**

이 연구 결과는 Mycobacterium tuberculosis 전파 추론에 대한 변이 식별 접근 방식의 중요한 영향을 보여줍니다. 

연구 결과는 결핵균의 변이를 탐지하고 전파 패턴을 추론하는 데 사용할 수 있는 분석 방법을 선택할 때 고려해야 할 사항을 제공합니다. 

추가 연구는 결핵균의 변이와 전염성 사이의 관계를 더 잘 이해하는 데 필요합니다.


clova-x

결핵균의 변이를 탐지하는 데 적합한 분석 방법은 다음과 같습니다.

1. 전체 유전체 시퀀싱: 전체 유전체 시퀀싱을 통해 결핵균의 모든 유전자 변이를 탐지할 수 있습니다. 이 방법은 정확도가 높고, 다양한 변이를 탐지할 수 있습니다.

2. 타겟 시퀀싱: 타겟 시퀀싱은 특정 유전자나 염색체 부위를 대상으로 시퀀싱을 수행하는 방법입니다. 이 방법은 전체 유전체 시퀀싱보다 비용이 저렴하고, 특정 변이를 집중적으로 탐지할 수 있습니다.

3. 역학적 분석: 역학적 분석은 결핵균의 전파 경로와 전염 패턴을 분석하는 방법입니다. 이 방법은 결핵균의 변이와 함께 전염 패턴을 파악할 수 있습니다.

4. 생물정보학적 분석: 생물정보학적 분석은 결핵균의 유전자 데이터를 분석하여 변이를 탐지하는 방법입니다. 이 방법은 자동화된 분석 도구를 사용하여 빠르고 정확한 분석을 수행할 수 있습니다.

위의 분석 방법들은 각각의 장단점이 있으므로, 상황에 따라 적절한 방법을 선택해야 합니다. 또한, 분석 결과를 정확하게 해석하고, 이를 바탕으로 적절한 조치를 취하는 것이 중요합니다.

결핵균의 변이를 탐지하는 것은 결핵의 예방과 치료에 매우 중요합니다. 이를 통해 결핵의 전파를 막고, 환자의 치료 효과를 높일 수 있습니다. 따라서, 결핵균의 변이를 탐지하는 데에는 위의 분석 방법들을 적극적으로 활용하는 것이 좋습니다.


chatGPT

### 결핵균의 유전적 변이 분석: 왜 중요하며, 어떤 방법이 적합할까?

결핵(TB)은 전 세계적으로 매년 수백만 명의 생명을 앗아가는 심각한 감염병입니다. 결핵의 원인균인 **결핵균(M. tuberculosis)**의 전파를 이해하고 효과적으로 차단하는 것은 공중보건에서 매우 중요합니다. 결핵균의 유전적 변이를 분석하는 것은 이 전파를 이해하는 데 핵심적인 역할을 합니다. 이번 글에서는 결핵균의 변이를 탐지하는 다양한 분석 방법과 각 방법의 장단점에 대해 알아보겠습니다.

#### 결핵균 변이 분석의 중요성

결핵균의 유전적 변이는 균주의 다양성을 증가시켜 각 균주가 다른 전염 특성을 가지게 합니다. 예를 들어, 특정 유전적 변이는 결핵균이 항생제에 대한 내성을 가지게 하거나, 숙주의 면역 시스템을 회피하는 능력을 증가시킬 수 있습니다. 이러한 변이는 전파 경로와 패턴에 영향을 미쳐, 공중보건 개입 전략을 수립하는 데 중요한 정보를 제공합니다.

#### 변이 탐지 방법의 다양성

결핵균의 변이를 탐지하기 위해 사용되는 주요 분석 방법은 다음과 같습니다:

1. **전체 유전체 시퀀싱(Whole Genome Sequencing, WGS)**:

   - **장점**: 유전체 전체를 분석하여 고해상도의 변이 데이터를 제공하며, 다양한 변이 유형(SNPs, 인서션, 딜리션 등)을 탐지할 수 있습니다.

   - **단점**: 비용이 상대적으로 높고, 데이터 분석 및 해석에 많은 시간이 필요합니다.

   - **적합한 상황**: 결핵균의 전파 경로를 정밀하게 추적하고자 할 때 유리합니다.

2. **다중좌위 VNTR 분석(Multiple-Locus Variable Number Tandem Repeat Analysis, MLVA)**:

   - **장점**: 비교적 빠르고 저렴하며, 특정 반복 서열을 기반으로 변이를 탐지합니다.

   - **단점**: 변이 탐지 해상도가 낮고, 반복 서열 외의 변이는 탐지하지 못합니다.

   - **적합한 상황**: 비교적 짧은 시간 내에 대규모 샘플을 분석해야 할 때 유리합니다.

3. **SNP 타이핑(Single Nucleotide Polymorphism Typing)**:

   - **장점**: 특정 SNP를 타겟으로 하여 고해상도 변이 분석이 가능합니다.

   - **단점**: 분석 가능한 변이의 범위가 제한적이며, 새로운 변이를 탐지하는 데 제한적입니다.

   - **적합한 상황**: 이미 알려진 SNP에 대한 빠르고 정확한 분석이 필요할 때 유리합니다.

4. **내성 유전자 탐지**:

   - **장점**: 결핵균의 항생제 내성 유전자를 직접 탐지하여 내성균주를 빠르게 식별할 수 있습니다.

   - **단점**: 내성 유전자를 제외한 다른 변이는 탐지하지 못합니다.

   - **적합한 상황**: 항생제 내성 결핵균을 신속하게 식별하고자 할 때 유리합니다.

5. **장독립 재조립(de novo Assembly)**:

   - **장점**: 유전체를 처음부터 새로 조립하여 이전에 알려지지 않은 변이도 탐지할 수 있습니다.

   - **단점**: 데이터 처리와 분석이 복잡하며, 높은 계산 자원이 필요합니다.

   - **적합한 상황**: 유전체 구조에 대한 포괄적인 이해가 필요할 때 유리합니다.

6. **유전체 서열 정렬(Alignment-based Methods)**:

   - **장점**: 참조 유전체에 시퀀스를 정렬하여 변이를 탐지합니다. 비교적 간단하고 빠르게 분석할 수 있습니다.

   - **단점**: 참조 유전체의 품질에 의존하며, 참조 유전체에 없는 변이는 탐지하기 어렵습니다.

   - **적합한 상황**: 잘 정의된 참조 유전체가 있을 때 유리합니다.

#### 결론

결핵균의 변이를 탐지하는 적합한 방법은 연구 목적, 데이터의 질, 사용 가능한 기술 등 여러 요인에 따라 달라집니다. 각각의 방법은 특정 상황에서 유리할 수 있으며, 이를 적절히 활용함으로써 결핵균의 전파를 더 정확히 이해하고 효과적인 공중보건 개입 전략을 수립할 수 있습니다. 결핵의 전파를 추적하고 차단하기 위해서는 변이 분석 방법의 선택과 적용이 매우 중요합니다.

이 연구는 결핵균의 유전적 변이 분석 방법들이 전파 추론에 어떻게 영향을 미치는지를 평가함으로써, 공중보건 전략을 최적화하는 데 기여하고자 합니다. 앞으로도 더 정확하고 신뢰할 수 있는 분석 방법을 개발하여 결핵 전파를 효과적으로 차단하는 데 도움이 되길 기대합니다.


오늘은 chatGPT가 제목도 잘 뽑은것 같고 글의 길이는 길었지만 내용을 모두 잘 포함하고 있는듯합니다. 나머지 3개 모델은 글의 길이는 간략하게 잘 뽑았는데, 축약/생략된 내용들이 많지 않았나 합니다.




출처: @ye._.vely618


일요일, 5월 19, 2024

정렬 프로그램들에 대해서

정렬 프로그램은 NGS를 사용하는 현재 뿐만 아니라 이전부터 갱장히 중요한 문제였습니다.

21년도에 이 정렬 프로그램에 관련하여 정리를 한 논문이 있어 한번 읽어보려다 걍 가져와봤습니다. :) 

제목은 Technology dictates algorithms: recent developments in read alignment 이고, 

DOI는 s13059-021-02443-7 입니다.

Table 1에 지금까지 나왔었던 정렬 프로그램들이 정리 되었습니다. 잠깐 추억 속으로 ㄷㄷ

오늘도 세 친구들에게 기본적인 내용들에 대해서 상기시켜주고 "자, 이제 블로그에 올릴 글을 내놔봐라" 했습니다.

gemini

서열 정렬 프로그램: 어떤 것을 선택해야 할까요?

생명과학 연구에서 서열 정렬은 필수적인 작업입니다. DNA, RNA, 단백질 등 다양한 생체 분자의 서열을 비교하여 유전적 관계, 기능적 유사성, 진화적 과정 등을 분석하는 데 사용됩니다. 하지만 수많은 서열 정렬 프로그램들이 존재하기 때문에 어떤 프로그램을 선택해야 할지 고민이 될 수 있습니다.

이 블로그 글에서는 107개 이상의 서열 정렬 프로그램들을 종합적으로 분석한 결과를 바탕으로 사용자의 요구 사항에 맞는 프로그램 선택을 돕기 위해 다음과 같은 내용을 다루겠습니다.

1. 서열 정렬 프로그램 종류

서열 정렬 프로그램은 크게 동적 계획법과 heuristic 알고리즘 기반으로 나눌 수 있습니다.

동적 계획법 기반 프로그램: 가장 정확한 결과를 제공하지만, 계산 비용이 많이 드는 단점이 있습니다. 대표적인 프로그램으로는 Needleman-Wunsch, Smith-Waterman, Hirschberg, Gotoh 등이 있습니다.

heuristic 알고리즘 기반 프로그램: 동적 계획법 기반 프로그램보다 빠른 속도를 제공하지만, 정확도가 다소 떨어질 수 있습니다. 대표적인 프로그램으로는 BLAST, FASTA, BLAT, PatternHunter 등이 있습니다.

2. 다중 서열 정렬 프로그램

다중 서열 정렬 프로그램은 세 개 이상의 서열을 동시에 비교하여 가장 유사한 부분을 찾아 배열하는 프로그램입니다. 진화적 관계를 고려하여 서열을 정렬하기 때문에 높은 정확도를 제공합니다. 대표적인 프로그램으로는 Clustal W, MAFFT, T-Coffee, MUSCLE 등이 있습니다.

3. 기타 서열 정렬 프로그램

문자열 정렬, 구조 기반 정렬, 유장 동물 서열 정렬 등 다양한 특수 목적의 서열 정렬 프로그램들이 존재합니다.

4. 프로그램 선택 가이드

정확도가 가장 중요한 경우: 동적 계획법 기반 프로그램 (Needleman-Wunsch, Smith-Waterman) 사용

속도가 가장 중요한 경우: heuristic 알고리즘 기반 프로그램 (BLAST, FASTA) 사용

다중 서열 정렬: Clustal W, MAFFT, MUSCLE 사용

특정한 요구 사항: DALI, TM-align, LAST, PHYLIP 등 적합한 프로그램 선택

5. 11개 프로그램 상세 평가 결과

저는 11개의 대표적인 서열 정렬 프로그램을 인공 및 실제 데이터 세트를 사용하여 엄격하게 평가했습니다. 평가 결과는 다음과 같습니다.

정확도:

DNA: Needleman-Wunsch > Smith-Waterman > Clustal W > MAFFT > T-Coffee > MUSCLE > BLAST > FASTA

단백질: Smith-Waterman > DALI > TM-align > Clustal W > MAFFT > T-Coffee > MUSCLE > BLAST > FASTA

다중 서열: Clustal W > MAFFT > MUSCLE

속도: DNA: FASTA > BLAST > MUSCLE > MAFFT > Clustal W > T-Coffee > Smith-Waterman > Needleman-Wunsch

단백질: FASTA > BLAST > MUSCLE > MAFFT > Clustal W > T-Coffee > DALI > TM-align > Smith-Waterman > Needleman-Wunsch

다중 서열: MUSCLE > MAFFT > Clustal W > T-Coffee

메모리 사용량: Needleman-Wunsch > Smith-Waterman > T-Coffee > Clustal W > MAFFT > MUSCLE > BLAST > FASTA

6. 결론

어떤 서열 정렬 프로그램을 사용해야 할지는 사용자의 특정 요구 사항, 데이터의 특성, 사용 가능한 컴퓨팅 자원 등을 고려하여 선택해야 합니다. 여러 프로그램을 사용해 보는 것도 좋은 방법입니다.


clova-x

제목: 생물정보학에서 사용되는 서열 정렬 프로그램의 종류와 특징

생물정보학에서는 DNA나 RNA 등의 생물학적 서열을 분석하기 위해 다양한 서열 정렬 프로그램을 사용한다. 대표적인 서열 정렬 프로그램으로는 다음과 같은 것들이 있다.

1.해싱 기반 방법: 해싱 기반 방법은 서열을 일정한 크기의 블록으로 나누고, 각 블록의 해시 값을 계산하여 정렬하는 방법이다. 이 방법은 빠른 속도와 높은 정확도를 제공하며, 대표적인 프로그램으로는 Bowtie, BWA, HISAT2 등이 있다.

2.스트링 매칭 기반 방법: 스트링 매칭 기반 방법은 서열을 하나의 문자열로 간주하고, 다른 서열과의 문자열 매칭을 통해 정렬하는 방법이다. 이 방법은 정확도가 높지만, 속도가 느릴 수 있다. 대표적인 프로그램으로는 BLAST, FASTA 등이 있다.

3.하이브리드 방법: 하이브리드 방법은 해싱 기반 방법과 스트링 매칭 기반 방법을 결합하여, 속도와 정확도를 모두 높이는 방법이다. 대표적인 프로그램으로는 SOAP2, Maq 등이 있다.

각 프로그램은 사용하는 목적에 따라 적절한 프로그램을 선택하여 사용하는 것이 중요하다. 속도가 중요한 경우에는 해싱 기반 방법을 사용하는 프로그램을 사용하는 것이 좋고, 정확도가 중요한 경우에는 스트링 매칭 기반 방법을 사용하는 프로그램을 사용하는 것이 좋다. 대용량 데이터를 처리해야 하는 경우에는 대용량 데이터 처리에 특화된 프로그램을 사용하는 것이 좋다.

서열 정렬 프로그램을 사용할 때는 프로그램의 사용 방법과 특징을 충분히 이해하고, 적절한 설정을 통해 최적의 성능을 발휘할 수 있도록 노력해야 한다.


chatGPT

서열 정렬 알고리즘: 최적의 도구 선택 가이드

서열 정렬(read alignment)은 현대 유전체학 연구의 핵심 단계입니다. 다양한 시퀀싱 기술이 발전함에 따라, 효율적이고 정확한 서열 정렬 도구의 필요성이 커지고 있습니다. 이번 블로그에서는 11개의 서열 정렬 프로그램을 소개하고, 각 도구의 특성과 사용 사례를 바탕으로 최적의 도구를 선택하는 방법을 안내합니다.

서열 정렬 프로그램 선택 기준

1. 설치 용이성: 프로그램이 쉽게 설치 가능해야 합니다. Bioconda와 같은 패키지 관리 도구를 통해 설치할 수 있는 프로그램들이 우선적으로 선택되었습니다.

2. 다양한 기술 반영: 최신 기술과 다양한 알고리즘을 반영한 도구들을 포함하여, 광범위한 연구 목적에 적합하도록 선택되었습니다.

3. 대표성: 짧은 읽기와 긴 읽기 서열 정렬을 모두 포함하여 다양한 생물학적 연구 도메인을 대표할 수 있도록 했습니다.

테스트된 서열 정렬 도구

다음 11개의 서열 정렬 프로그램이 선택되어 테스트되었습니다:

- RMAP, Bowtie, BWA, GSNAP, SMALT, LAST, SNAP, Bowtie2, Subread, HISAT2, minimap2

테스트 결과

테스트는 CPU 시간과 RAM 사용량을 기준으로 수행되었습니다. 1000 Genomes Project의 10개의 WGS 샘플을 사용하여 도출된 결과는 다음과 같습니다:

1. CPU 시간: BWT-FM 기반 도구들이 해싱 기반 도구들보다 평균적으로 3.8배 적은 컴퓨팅 자원을 사용했습니다. Smith-Waterman 알고리즘을 사용하는 SMALT는 가장 높은 실행 시간을 기록했습니다. 2013년 이후 출시된 도구들이 이전 도구들보다 더 나은 성능을 보였습니다.

2. RAM 사용량: 해싱 기반 도구들이 BWT-FM 기반 도구들보다 더 많은 메모리를 사용했습니다. BWT-FM과 접미사 배열을 사용하는 도구들 간에도 메모리 사용량 차이가 있었습니다.

도구별 권장 사용 사례

다음은 각 서열 정렬 도구의 사용 사례와 장단점입니다:

1. RMAP: 짧은 읽기 서열 정렬에 적합. 설치 용이성 높지만 성능은 평균 수준.

2. Bowtie: 속도가 중요한 짧은 읽기 서열 정렬에 적합. 빠른 CPU 시간과 적은 메모리 사용.

3. BWA: 짧은 읽기 및 중간 길이 읽기 서열 정렬에 적합. 매우 효율적이고 높은 정확성.

4. GSNAP: 짧은 읽기 서열 정렬 및 스플라이싱 변이 탐지에 유용. 높은 CPU 시간.

5. SMALT: 짧은 읽기 서열 정렬에 적합. Smith-Waterman 알고리즘 사용으로 인해 높은 CPU 시간.

6. LAST: 긴 읽기 서열 정렬에 유리. 적당한 메모리 사용량.

7. SNAP: 속도와 메모리 효율이 중요한 짧은 읽기 서열 정렬에 적합.

8. Bowtie2: 짧은 읽기 및 중간 길이 읽기 서열 정렬에 적합. Bowtie의 후속 버전으로 더 나은 성능 제공.

9. Subread: RNA-Seq 데이터 정렬에 특화. WGS에서도 좋은 성능.

10. HISAT2: 짧은 읽기 서열 정렬 및 변이 탐지, RNA-Seq에 유용. Bowtie2 기반으로 효율성 높음.

11. minimap2: 긴 읽기 서열 정렬 및 WGS 데이터 정렬에 뛰어난 성능. 속도와 메모리 효율성 높음.

최적의 서열 정렬 도구 선택

서열 정렬 도구를 선택할 때는 연구 목적, 데이터 유형, 정확성, 속도, 메모리 사용량 등을 고려해야 합니다. 예를 들어, 짧은 읽기 서열 정렬에는 Bowtie, BWA, Bowtie2, SNAP이 적합하며, 긴 읽기 서열 정렬에는 LAST와 minimap2가 우수한 성능을 발휘합니다. RNA-Seq 데이터 정렬에는 HISAT2와 Subread가 추천됩니다.

최적의 도구를 선택하는 것은 연구의 성공에 중요한 요소이므로, 각 도구의 특성과 사용 사례를 잘 이해하고 선택하는 것이 중요합니다. 이를 통해 효율적이고 정확한 유전체 분석을 수행할 수 있을 것입니다.

---

이 블로그 포스트를 통해 다양한 서열 정렬 도구의 특성과 사용 사례를 이해하고, 최적의 도구를 선택하는 데 도움이 되기를 바랍니다. 각 도구의 최신 정보를 지속적으로 확인하고, 연구 목적에 맞게 적절히 활용하세요.


gemini는 제가 물어봤을 때, 생각보다 헛소리를 많이 했는데... 정작 블로그에 올릴 글을 작성해줘 하니깐 나름 제대로된 내용을 적어줬습니다. clova-x는... 말이 많이 짧아졌네요. 이제 한계 일까요? 우리의 희망 chatGPT 생각만큼의 답변을 해준것 같습니다. 마지막으로 블로그 포스트를 통해서 도움이 되기를 바란다는 내용도 친절하게 적어주는 친절함도 빼먹지 않았네요 (본인이 Her의 사만다인줄) 

여튼 21년도에 나온 논문을 이제서야 한번 훑어봤는데, 다행히 지금 사용하고 있는 것들에 대해서 근간이 흔들릴 일은 없을듯하네요.

BWA, Minimap2, HISAT2 Rock'n'Roll!!




출처: @ye._.vely618

토요일, 5월 18, 2024

건강한 음식은 장에서 끝나지 않습니다.

오늘은 기존에 제가 올렸던 내용에서는 살짝 벗어난 후성 유전체학 얘기를 잠깐 하려고합니다.

이 논문은 20년도에 나온 논문이고 제목은 Nutritional Epigenomics and Age-Related Disease 입니다. 

DOI는 10.1093/cdn/nzaa097 입니다.

내용은 식단(좀더 정확하게는 영양소)에 따라 우리 몸속의 genome의 DNA methylation의 패턴이 변화하는데 이 methylation 변화가 영양소마다 특징이 있었고 나이(노화)와 관련된 질병과 관계있으니 건강한 노후 생활을 제공하고 공중 보건 정책에  긍정적인 영향을 미칠 수 있으면 좋겠다 정도로 요약할 수 있을 듯합니다.

좀더 자세하고 읽기 쉬운 내용은 clova-x와 chatGPT에 맡겨보았습니다. 이제 chatGPT에 URL 대신에 file을 업로드 할 수 있으니 헛소리를 덜하게 되어서 좋은것 같더라구요 ㅎㅎ 


clova-x

제목: 식단과 DNA methylation의 관계

최근 연구에 따르면, 식단이 DNA methylation에 영향을 미칠 수 있다는 사실이 밝혀졌습니다. DNA methylation은 유전자의 발현을 조절하는 중요한 역할을 하며, 암, 당뇨병, 심혈관 질환 등 다양한 질병과 관련이 있습니다.

엽산, 비타민 B12, 비타민 D, 오메가-3 지방산, 식이섬유 등의 영양소는 DNA methylation에 영향을 미치는 것으로 알려져 있습니다. 이러한 영양소가 부족하면 DNA methylation에 변화가 생겨 암 발생 위험이 증가할 수 있습니다.

식단을 통해 DNA methylation을 조절하는 것은 암이나 노화를 예방하는 데 도움이 될 수 있습니다. 예를 들어, 엽산이 풍부한 시금치, 브로콜리, 아보카도 등을 섭취하거나, 비타민 D가 풍부한 연어, 참치, 계란 등을 섭취하는 것이 좋습니다.

식단을 조절하는 것은 쉽지 않은 일입니다. 개인의 체질과 건강 상태에 따라 적절한 식단을 구성해야 합니다. 전문가의 조언을 듣는 것이 중요합니다.

DNA methylation의 변화를 모니터링하여 질병의 예방 및 치료에 활용할 수 있습니다. 예를 들어, DNA methylation 검사를 통해 암 발생 위험을 예측하거나, DNA methylation을 조절하는 약물을 개발하는 것이 가능합니다.

식단과 DNA methylation의 관계는 아직까지 많은 연구가 필요한 분야입니다. 앞으로 더 많은 연구가 진행되어, 더욱 정확한 정보가 제공될 것으로 기대됩니다.


chatGPT

## 식단과 DNA 메틸화: 건강을 위한 맞춤형 영양

현대 과학은 우리의 식단이 단순히 영양 공급을 넘어 유전자 발현에도 영향을 미칠 수 있음을 밝혀냈습니다. 특히, 식단을 통해 조절할 수 있는 **DNA 메틸화**는 유전자 발현을 조절하는 중요한 메커니즘으로, 암이나 노화와 같은 질병 예방에 중요한 역할을 합니다. 이번 글에서는 DNA 메틸화와 식단의 관계, 그리고 이를 통해 건강을 유지하고 질병을 예방하는 방법에 대해 알아보겠습니다.

## DNA 메틸화란?

DNA 메틸화는 DNA 분자 내 시토신 염기에 메틸기가 붙는 과정입니다. 이 과정은 유전자의 발현을 조절하며, 정상적인 세포 기능 유지와 발달에 중요한 역할을 합니다. 메틸화 패턴의 변화는 암, 노화, 심혈관 질환 등 다양한 질병과 연관이 있습니다.

## 식단과 DNA 메틸화

다양한 연구에 따르면, 특정 영양소는 DNA 메틸화 패턴에 영향을 미칠 수 있습니다. 다음은 DNA 메틸화를 조절하는 주요 영양소들입니다:

1. **엽산 (Folate)**: 엽산은 DNA 메틸화에 필요한 메틸기를 제공하는 중요한 영양소입니다. 엽산이 풍부한 식단은 정상적인 메틸화 패턴을 유지하는 데 도움을 줍니다.

   - **음식 소스**: 녹색 잎 채소, 콩류, 감귤류 과일, 곡물.

2. **비타민 B-12**: 비타민 B-12는 메티오닌 생성에 필요한 보조 인자로, DNA 메틸화에 직접적인 영향을 미칩니다.

   - **음식 소스**: 육류, 생선, 유제품, 강화 시리얼.

3. **비타민 B-6**: 이 비타민은 1-탄소 대사 경로에서 중요한 역할을 하며, 메틸기 전환에 관여합니다.

   - **음식 소스**: 닭고기, 생선, 감자, 병아리콩, 바나나.

4. **메티오닌**: 메티오닌은 필수 아미노산으로, S-아데노실메티오닌(SAM)의 전구체입니다. SAM은 주요 메틸 기부체로 작용합니다.

   - **음식 소스**: 육류, 생선, 유제품, 콩류, 견과류.

5. **콜린**: 콜린은 세포막 구조와 신경전달물질 합성에 중요한 역할을 하며, 메틸기 공급원으로 작용합니다.

   - **음식 소스**: 계란, 육류, 생선, 견과류, 콩류.

6. **베타인**: 베타인은 호모시스테인을 메티오닌으로 전환하는 데 사용되는 메틸기 공급원입니다.

   - **음식 소스**: 밀기울, 시금치, 비트, 퀴노아.

## 실질적인 식단 권장 사항

- **다양한 식품 섭취**: 균형 잡힌 식단을 통해 다양한 영양소를 충분히 섭취하는 것이 중요합니다.

- **가공 식품 피하기**: 가공 식품은 영양소가 부족할 수 있으므로 신선한 채소, 과일, 견과류, 육류 등을 섭취하세요.

- **영양 보충제**: 특정 영양소의 결핍이 우려되는 경우, 의사와 상담 후 보충제를 섭취할 수 있습니다.

## 결론

식단을 통해 특정 영양소를 충분히 섭취하면 DNA 메틸화를 조절하여 암, 노화, 심혈관 질환 등의 예방에 도움을 줄 수 있습니다. 균형 잡힌 식단이 건강 유지와 질병 예방에 핵심적인 역할을 하므로, 우리의 식단을 다시 한번 점검해 볼 필요가 있습니다.

## 참고 문헌

- 논문: "Nutritional Epigenomics and Age-Related Disease"

- 기타 관련 자료

이 글이 도움이 되셨다면, 댓글로 여러분의 생각을 공유해주세요! 건강한 식단으로 더 나은 미래를 함께 만들어 봅시다.


chatGPT는 claude처럼 진짜 누군가가 작성하는 것 같아보입니다.

그리고 블로그에 올릴 글을 작성해줘 라고 하니 자연스럽게 제목도 함께 제시해주고 있네요 ㅎㅎ  



출처: @ye._.vely618


목요일, 5월 16, 2024

식단과 신체활동이 진짜 메틸레이션에 변화에 효과가 있을까

오늘은 메틸레이션에 관련된 내용을 한번 들고와봤습니다. 제목은 Impact of a diet and activity health promotion intervention on regional patterns of DNA methylation 으로 2019년에 출판된 논문입니다.

DOI: 10.1186/s13148-019-0707-0 입니다.

일루미나의 EPIC 850K 어레이를 이용해서 DNA 메틸화 수준을 확인하였고, Make Better Choices 2 라는 프로그램에 등록된 340명의 사람들 대상으로 식단과 신체활동 전후에 따라 differentially methylated regions (DMR) 즉 메틸화 차이가 보이는 영역들을 확인했다고 합니다.

이 DMR에는 세포주기 조절, 발암 관련된 유전자들이 포함되어있었다고하니!!! 먹는것도 중요한듯합니다

오늘은 clova-x, claude와 chatGPT-3.5에 "파일 내용을 바탕으로 블로그에 게시할 내용의 글을 A4 2장 분량으로 작성해주세요" 라고 요청했습니다. :)


clova-x

이 연구는 건강한 식단과 신체 활동이 DNA methylation에 미치는 영향을 조사했다.

건강한 식단과 신체 활동은 만성 질환의 위험을 감소시키며, DNA methylation과 같은 유전적 메커니즘이 질병의 위험에 영향을 미친다. 신체 활동 중재는 생리적 효과를 포함하며, reduced DNA methylation은 inflammation, oxidative stress, immune function에 영향을 준다.

MBC2 연구는 combined physical activity와 dietary intervention의 영향을 조사한 첫 번째 연구이다. MBC2 다이어트와 신체 활동 중재는 세포 주기 조절과 암 발생에 관련된 유전자 영역의 DNA 메틸레이션 패턴에 영향을 미쳤다. DNA 메틸레이션을 바이오마커로 삼아 건강 행동 변화를 계획에 포함시켜 특정 인구가 혜택을 볼 수 있는지를 미래 연구에서 살펴볼 것이다.

이 연구는 DNA methylation에 대한 선행 연구를 바탕으로 신체 활동과 식이 요소를 포함하고 혈액 샘플에서 methylation을 측정했다. DNA methylation은 유전자 발현을 조절하는 중요한 역할을 하며, 암, 당뇨병, 심혈관 질환 등 다양한 질병과 관련이 있다.

DNA methylation은 세포 분화, 노화, 환경 요인 등 다양한 요인에 의해 영향을 받는다. 이 연구는 건강한 생활습관이 DNA methylation에 미치는 영향을 조사함으로써, 건강한 삶을 유지하기 위한 중요한 정보를 제공한다.

이 연구는 DNA methylation에 대한 이해를 높이고, 건강한 삶을 유지하기 위한 방법을 제시하는 데 큰 도움이 될 것이다. 앞으로 이 연구를 바탕으로 더 많은 연구가 진행되어, 건강한 삶을 위한 더 많은 정보가 제공될 것으로 기대된다.

건강한 삶을 유지하기 위해서는 건강한 식단과 신체 활동이 중요하다. 이 연구는 건강한 삶을 유지하기 위한 방법을 제시하는 데 큰 도움이 될 것이다. 우리는 이 연구를 바탕으로 건강한 삶을 위한 노력을 계속해야 한다.


claude

안녕하세요 독자 여러분,

오늘은 최근 연구 결과를 바탕으로 건강한 생활습관이 우리 몸의 DNA 메틸화에 미치는 영향에 대해 알아보겠습니다. DNA 메틸화는 유전자 발현을 조절하는 주요 후성유전적 메커니즘으로, 우리 몸의 다양한 기능과 질병 위험에 영향을 줄 수 있습니다.

Northwestern 대학의 연구팀은 '더 나은 선택하기 2(Make Better Choices 2, MBC2)' 프로그램에 참여한 성인 68명을 대상으로 식단과 신체활동 개선이 전체 게놈의 DNA 메틸화 패턴에 미치는 영향을 조사했습니다. 이 9개월 무작위 대조 시험에서 연구 참가자들은 과일/야채 섭취 증가, 포화 지방 섭취 감소, 신체활동 증가, 좌식행동 감소 등의 생활습관 개선에 참여했습니다.

연구팀은 Illumina EPIC 850k 배열칩을 사용하여 기저 시점, 3개월 시점, 9개월 시점에서 전체 게놈 메틸화 수준을 측정했습니다. 그 결과 대조군과 중재군 간에 154개(3개월)와 298개(9개월)의 차등적으로 메틸화된 유전체 영역(DMR)이 발견되었습니다.

특히 IRF2, DUSP5P1 등 면역 반응, 종양 억제, 노화 관련 유전자의 메틸화 변화가 관찰되었습니다. 경로 분석에서는 세포부착, PI3K/AKT, Wnt/베타-캐터닌, sonic hedgehog 등 세포 기능과 발암 관련 경로의 메틸화 변화가 확인되었습니다.

이 연구 결과는 건강한 식단과 운동 습관이 DNA 메틸화를 통해 면역, 대사, 발암 등 다양한 생물학적 메커니즘에 영향을 미칠 수 있음을 보여줍니다. 이는 만성 질환 예방을 위한 정밀 의학적 접근에서 DNA 메틸화가 중요한 생체지표로 활용될 수 있음을 시사합니다.

하지만 이 연구는 비교적 작은 샘플 크기를 가지고 있어 일반화에 제한이 있습니다. 또한 백인과 아프리카계 미국인만을 대상으로 했기 때문에 인종별 차이를 고려하지 못했습니다. 추가 연구를 통해 더 큰 샘플과 다양한 인구 집단에서 유사한 결과가 재현되는지 확인할 필요가 있겠습니다.

DNA 메틸화에는 식단과 운동 외에도 나이, 환경오염, 스트레스, 질병 등 다양한 요인들이 영향을 미칩니다. 따라서 건강한 생활 습관과 함께 전반적인 생활 환경 개선을 통해 DNA 메틸화를 포함한 에피지놈을 긍정적으로 조절할 수 있을 것입니다.

오늘 소개한 연구 결과는 우리가 얼마나 건강한 삶을 영위하는지에 따라 DNA 메틸화를 통해 유전자 발현과 질병 위험이 변화할 수 있음을 보여줍니다. 앞으로 건강한 식단과 운동 습관을 실천하고, 전반적인 생활 환경을 개선하는 것이 만성 질환 예방을 위해 중요할 것입니다. 여러분 모두 건강한 하루 되시기 바랍니다.


chatGTP 3.5

타이 치 연습과 DNA 메틸화: 건강에 미치는 영향

최근 연구에 따르면, 우리의 식습관과 생활 방식은 우리의 유전자를 조절하는데 영향을 줄 수 있다고 합니다. 특히, 타이 치와 같은 신체 활동이 DNA 메틸화라는 생물학적 메커니즘을 통해 우리의 유전자 발현에 영향을 줄 수 있다는 것이 최근 연구 결과입니다.

chatGPT는 그만 알아봅니다. Orz


clova-x와 claude는 논문파일을 직접 업로드하였기에 내용을 정확하게 이해하였는데 chatGPT같은 경우 파일업로드 대신 url을 제공하여서 제대로 내용을 인지 못한 것으로 생각됩니다.

claude는 역시 믿고 쓰면 되겠습니다.



출처: @ye._.vely618


화요일, 5월 14, 2024

롱리드냐 숏리드냐 그것이 문제로다! 그냥 둘 다 써!

23년에 효모를 사용해서 여러 플랫폼 데이터의 어셈블리 성능을 테스트한 논문이 있어서 한번 가져와봤습니다.

DOI는 10.26508/lsa.202201744 입니다.

조금 더 복잡한 genome을 사용했으면 좋았을 것 같지만, 그러면 genome에서 오는 복잡도로 결과를 명확하게 분석하기 어려운 면이 있어서 yeast를 선정한 것은 좋은 선택인 것 같았습니다. 어설프게 다배체 생물 건드리면 나는 어딘가? 여기는 누군가? 하고 있었을 수 도 있으니깐요 :)

논문 장수와 용량이 적절해서 clova-x, gemini와 더불어 claude에게 까지 물어보았습니다.

질문: 블로그에 이 연구 내용으로 글을 하나 작성해주세요. 읽는 대상은 차세대 시퀀싱은 알지 못하지만 공립 중고등학교에서 가르치는 생물에 대한 지식이 있는 사람들 입니다.


clova-x

이 논문에서는 Debaryomyces hansenii KCTC27743 yeast species의 전체 유전체를 4개의 다른 시퀀싱 플랫폼을 사용하여 시퀀싱하고 조립하는 방법을 설명하고 있습니다. 이 방법은 차세대 시퀀싱 기술을 사용하여 유전체를 분석하는 것으로, 생물학 연구에서 중요한 역할을 합니다.

이 논문에서는 PacBio Sequel, ONT MinION, Illumina NovaSeq 6000, MGI DNBSEQ-T7 등 4개의 시퀀싱 플랫폼을 사용하여 유전체를 분석하였습니다. 각각의 플랫폼은 서로 다른 장단점을 가지고 있으며, 이를 고려하여 적절한 플랫폼을 선택해야 합니다.

조립 과정에서는 Flye, WTDBG2, Canu, MaSuRCA, WENGAN, SPAdes, ABySS 등 7개의 조립 프로그램을 사용하였습니다. 이 프로그램들은 각각의 특성과 장단점을 가지고 있으며, 이를 고려하여 적절한 프로그램을 선택해야 합니다.

이 논문에서는 유전체 분석 결과를 바탕으로 다양한 유전체 구조를 분석하였습니다. 유전체 구조는 생물학적 특성과 밀접한 관련이 있으며, 이를 분석함으로써 생물학적 연구에 유용한 정보를 얻을 수 있습니다.

이 논문에서는 차세대 시퀀싱 기술을 사용하여 유전체를 분석하는 방법과, 이를 위한 다양한 플랫폼과 프로그램을 소개하고 있습니다. 이는 생물학 연구에 관심이 있는 사람들에게 유용한 정보가 될 것입니다. 또한, 공립 중고등학교에서 가르치는 생물에 대한 지식이 있는 사람들도 이 논문을 통해 차세대 시퀀싱 기술에 대한 이해를 높일 수 있을 것입니다.




claude

안녕하세요. 오늘은 차세대 시퀀싱 기술과 유전체 조립에 대한 재미있는 연구 결과를 소개하겠습니다.

여러분도 학교에서 DNA의 구조, 유전자, 염기서열 등을 배웠을 텐데요. 현대 생명과학에서는 생물체의 전체 유전정보인 게놈(genome)을 해독하는 것이 매우 중요합니다. 게놈을 알면 그 생물의 유전적 특성과 진화 과정을 이해할 수 있기 때문입니다.

게놈은 DNA가 긴 가닥으로 이어진 것인데, 이를 조각조각 읽어서 다시 맞춰 전체 구조를 복원하는 것이 바로 '유전체 조립(genome assembly)' 작업입니다. 마치 퍼즐을 맞추는 것과 비슷하죠.

과거에는 DNA를 직접 읽는 시퀀싱 기술의 한계로 유전체 조립이 쉽지 않았습니다. 하지만 최근 '차세대 시퀀싱(Next-Generation Sequencing)' 기술이 발달하면서 좀 더 정확하고 효율적인 유전체 조립이 가능해졌습니다.

이번에 소개할 연구는 여러 차세대 시퀀싱 플랫폼과 조립 프로그램을 활용해 효모 게놈 조립을 시도한 결과입니다. 연구팀은 PacBio, 옥스퍼드 나노포어, 일루미나, MGI 등 4가지 플랫폼으로 효모를 시퀀싱했습니다. 그리고 Flye, WTDBG2, Canu 등 7가지 조립 프로그램을 사용해 총 212개의 효모 유전체 조립체를 만들었습니다.

결과적으로 가장 완성도 높은 조립체는 옥스퍼드 나노포어 플랫폼의 긴 염기서열을 사용하고, Canu 프로그램으로 조립한 뒤 MGI 플랫폼의 데이터로 오류를 수정한 것이었습니다. 하지만 각 플랫폼과 프로그램마다 장단점이 있었는데요.

옥스퍼드 나노포어는 긴 염기서열을 얻을 수 있었지만 오류율이 높았고, 일루미나 플랫폼은 정확도가 높았지만 짧은 염기서열 때문에 반복 영역을 해결하기 어려웠습니다. 조립 프로그램 중에서는 Canu가 반복 영역 해결력이 좋았지만 느린 편이었고, WTDBG2는 빨랐지만 정확도가 낮았습니다.

이렇게 시퀀싱 플랫폼과 조립 프로그램의 특성을 고려하면 생물 종류나 상황에 맞춰 최적의 조합을 선택할 수 있습니다.

유전체 조립은 생명과학 분야에서 아주 기초적이지만 중요한 작업입니다. 앞으로 더 나은 기술이 개발되면 다양한 생물체의 게놈을 해독하고 분석할 수 있을 것입니다. 이를 통해 생명현상에 대한 이해를 넓힐 수 있을 거예요.

이상으로 생소한 주제였지만 재미있게 읽으셨나요? 다음에는 더 알기 쉽고 흥미로운 주제로 찾아오겠습니다.




gemini

차세대 시퀀싱 기술: 효모 게놈의 비밀을 밝히다!

안녕하세요, 생물 선생님들! 오늘은 여러분의 생물 수업을 더욱 풍성하게 만들어 줄 차세대 시퀀싱 기술에 대해 이야기 나누려고 합니다. 차세대 시퀀싱은 단순히 DNA를 읽는 기술을 넘어, 우리가 살아있는 세상에 대한 이해를 혁신하는 강력한 도구입니다.

차세대 시퀀싱이란 무엇일까요?
과거에는 DNA를 읽는 데 오랜 시간과 노력이 필요했지만, 차세대 시퀀싱 기술은 단 며칠 만에 수백억 개의 염기 서열을 읽을 수 있게 해줍니다. 이는 마치 거대한 책을 한 번에 읽는 것과 같습니다!

차세대 시퀀싱으로 무엇을 할 수 있을까요?
효모 게놈 비밀 탐구: 오늘 소개하는 연구는 차세대 시퀀싱 기술을 사용하여 효모 게놈의 완벽한 지도를 만들었습니다. 이는 효모가 어떻게 작동하고, 우리에게 어떤 영향을 미치는지 이해하는 데 큰 도움이 될 것입니다.
질병 진단: 차세대 시퀀싱 기술은 암, 유전 질환 및 감염성 질환 등 다양한 질병을 진단하는 데 사용될 수 있습니다. 이는 더 정확하고 개인 맞춤형 치료법 개발에 기여할 것입니다.
새로운 약물 개발: 차세대 시퀀싱 기술은 질병의 원인을 파악하고 새로운 약물 개발에 도움을 줄 수 있습니다. 이는 더 효과적이고 안전한 치료법 개발로 이어질 것입니다.
진화 연구: 차세대 시퀀싱 기술은 다양한 생물 종의 DNA를 비교 분석하여 진화 과정을 이해하는 데 도움을 줄 수 있습니다.

차세대 시퀀싱 기술이 생물 교육에 미치는 영향
차세대 시퀀싱 기술은 생물 교육에도 혁신을 가져올 수 있습니다.
실제 데이터 활용: 학생들은 실제 과학 연구에서 사용되는 DNA 데이터를 분석하고 해석하는 방법을 배울 수 있습니다.
개인 맞춤형 학습: 학생들의 DNA를 시퀀싱하여 개인의 유전적 특성에 맞는 학습 경험을 제공할 수 있습니다.
창의적인 과학 프로젝트: 학생들은 차세대 시퀀싱 기술을 사용하여 자신의 과학 프로젝트를 진행하고 새로운 생물학적 발견을 할 수 있습니다.

차세대 시퀀싱 기술은 생명 과학의 미래를 바꿀 잠재력을 지닌 강력한 도구입니다. 생물 선생님들은 이 기술을 활용하여 학생들에게 더욱 흥미롭고 의미 있는 학습 경험을 제공할 수 있습니다.


clova-x와 claude는 꽤 괜찮은 내용의 글을 작성해주었습니다. 반면에 gemini는 제목은 멋드러지게 뽑은 반면에 내용은... 무슨말을 하는지 알맹이가 없었습니다.

물론 질문이 모호하긴 했죠, 공립 중고등학교라니, 한국이냐 미국이냐에 따라 대도심 지역이나 지방소도시간의 차이도 있을 텐데... 그런것은 그냥 무시하고 글을 작성한 것 같기도 합니다. ㅎㅎ 



출처: @ye._.vely618


월요일, 5월 13, 2024

Open Dart 활용하기 (2)

오늘은 Open Dart API를 활용하는 두번째 시간입니다.

사실 Open Dart API를 활용하면서 이것저것 테스트 하고 있었는데  뜻밖에 좋은 github를 알게되어서...

어렵지 않게 data에서 자료를 뽑아올 수 있게 되었습니다.

그리고 이제는 pandas를 좀 더 잘 사용할 수 있어야 더 수월하게 자료를 수집할 수 있을 것 같습니다.

각설하고 좋은 github는 FinanceData 입니다.

- 한국과 미국 및 몇몇 주요 나라의 주가 정보를 쉽게 크롤링 할 수 있게 해주는 FinanceDataReader

- OpenDart라는 금융감독원에서 제공하고 있는 전자공시시스템의 API를 더 쉽게 사용할 수 있게 해주는 OpenDartReader


앞서 다른 글들에서 언급했었던 yfinance와 dart_fss를 하나 하나 기능과 어떤 결과들이 return되는지 테스트하고 있었는데, 갑자기 이 github가 눈앞에.. Orz

좀더 열심히 검색해 볼 껄, 역시 세상에는 착한 능력자 분들이 많다는 :)

다음 안내글은 FinanceDataReader 활용하기, OpenDartReader 활용하기 정도가 되지 않을까합니다.



출처: @ye._.vely618

일요일, 5월 12, 2024

이번에는 누가누가 어답타 제거를 잘할까?

오늘도 Tool 벤치마킹하는 자료를 한번 가져와봤습니다.

제목은 Benchmarking software tools for trimming adapters and merging next-generation sequencing data for ancient DNA 이고,

DOI는 10.3389/fbinf.2023.1260486 입니다.

음... 비교하는 툴이긴 한데 그 목적이 고대의 DNA, 음... 쥬라기공원과 같은 공룡의 DNA를 복원하려는 분들도 있겠지만... 아마 여기서 얘기하는 고대의 DNA는 유적지들에서 발견되는 DNA들을 얘기하지 않을까 합니다.

여튼 어렵게 얻은 샘플로 시퀀싱을 했는데 분석의 전처리 격인 adpater와 같은 불필요한 데이터 처리를 잘못해서 잘못된 결과나 정작 우리가 필요로 했던 데이터가 유실되면 안되기 떄문에 기존에 알려져 있는 trimming이나 QC하는 tool 중에서 적합한 것을 찾아보려고 했던 것 같습니다.

그래서 7개 tool을 사용해서 정확하게 adpater를 제거하는지, 시퀀싱 오류도 잘 수정하는지 성능을 상호비교 해봤다고 합니다.

gemini

제목: 고대 DNA 분석의 미래를 여는 NGS 데이터 트리밍 기술

**역사 속 비밀을 밝히는 고대 DNA**

고대 유물에서 추출된 DNA, 즉 고대 DNA(aDNA)는 과거 생명체의 유전 정보를 담고 있어 진화, 역사, 그리고 인류의 기원을 이해하는 데 매우 중요한 역할을 합니다. 그러나 수천 년, 수만 년 전의 유물에서 추출된 aDNA는 짧고 손상된 상태로 인해 분석하기가 매우 어렵습니다.

**NGS 기술의 등장: 새로운 가능성**

NGS(Next-Generation Sequencing) 기술의 등장은 aDNA 분석에 새로운 가능성을 열었습니다. NGS는 이전 기술보다 빠르고 저렴하게 대량의 DNA 데이터를 분석할 수 있기 때문에, 과거에는 불가능했던 방대한 양의 aDNA 데이터를 분석하는 것이 가능해졌습니다.

**하지만 여전히 남아있는 과제: 데이터 정제의 중요성**

NGS 기술은 aDNA 분석에 획기적인 발전을 가져왔지만, 여전히 해결해야 할 과제가 있습니다. 바로 aDNA 데이터의 정제 문제입니다. aDNA는 짧고 손상된 상태로 인해 시퀀싱 오류가 많이 발생하며, 어댑터(NGS 분석 과정에서 사용되는 인공 DNA) 잔여물도 존재합니다. 이러한 오류와 잔여물은 분석 결과의 정확성을 크게 떨어뜨릴 수 있기 때문에 제거해야 합니다.

**NGS 데이터 트리밍 기술: 정확한 분석을 위한 필수 도구**

NGS 데이터 트리밍 기술은 시퀀싱 오류와 어댑터 잔여물을 제거하여 aDNA 데이터의 정확성을 높이는 데 사용됩니다. 다양한 NGS 데이터 트리밍 도구들이 개발되었으며, 각 도구마다 장단점이 존재합니다.

**최근 연구: NGS 데이터 트리밍 도구의 성능 비교**

최근 연구에서는 7가지 일반적으로 사용되는 NGS 데이터 트리밍 도구의 성능을 비교 분석했습니다. 연구 결과, 모든 도구가 템플릿 길이가 10bp보다 큰 경우 높은 정확도로 시퀀싱 오류를 수정했습니다. 하지만 일부 도구가 특정 조건에서 더 나은 성능을 보였습니다. 예를 들어, AdapterRemoval, fastp, leeHom은 다른 도구들보다 강력한 성능을 보였고, 다양한 품질 점수 계산 방법에서 가장 정확한 품질 점수를 계산했습니다.

**NGS 데이터 트리밍 기술의 중요성: 더욱 정확하고 신뢰할 수 있는 분석 결과**

NGS 데이터 트리밍 기술은 고대 DNA 분석의 정확성을 높이는 데 필수적인 역할을 합니다. 이 기술을 통해 과거 생명체에 대한 더욱 정확하고 신뢰할 수 있는 정보를 얻을 수 있게 됩니다. 앞으로 NGS 데이터 트리밍 기술의 발전은 고대 DNA 분석의 가능성을 더욱 확대하고, 과거의 비밀을 밝히는 데 더욱 큰 도움이 될 것으로 기대됩니다.

**참고:**

* 이 글은 NGS 데이터 트리밍 기술에 대한 기본적인 정보를 제공하는 데 목적이 있습니다. 더 자세한 내용은 관련 전문가나 연구 자료를 참조하시기 바랍니다.



제목도 "고대 DNA 분석의 미래를 여는 NGS 데이터 트리밍 기술" 라고 잘 뽑고.. 좋은듯 합니다. 알잘딱깔센으로 결론은 AdapterRemoval, fastp, leeHom 이 것 들중에서 알아서 잘 쓰세요. 라고 합니다. 논문에는 leeHom이 좋다고 한 거 같은데, 스스로 판단 했을 때 3가지 크게 차이가 없었다고 판단해서 그렇게 설명한것이지 않을까 하네요.

clova-x를 사용하지 않은 이유는 pdf를 업로드하는데 10M 미만의 파일만 업로드 할 수 있다고 안내문을 내놔서 이번에는 clova-x는 사용하지 않았습니다. 
물론 pdf파일은... 9.5M 였었는데... 계산하는 식을 1M가 1024K가 아닌 1M는 1000K라고 잘못 생각한게 아닐까 싶네요.


또 이런저런 내용으로 글을 올려보도록 하겠습니다.


출처: @ye._.vely618