방법 논문

구조 기반 시뮬레이션 및 원자 스케일 스테핑에서 거친 입자 확산에 이르기까지 DNA를 따른 전사 인자 단백질 움직임의 샘플링

DOI:

10.3791/63406

2022년 3월 1일

* These authors contributed equally

이 논문에서

요약

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

이 프로토콜의 목표는 식물 전사 인자 WRKY 도메인 단백질을 모범적 인 시스템으로 사용하여 DNA를 따라 단백질의 일차원 확산의 구조적 역학을 밝히는 것입니다. 이를 위해 원자 론적 및 거친 입자 역학 시뮬레이션과 광범위한 계산 샘플링이 구현되었습니다.

초록

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

DNA를 따라 전사 인자 (TF) 단백질의 1차원 (1-D) 슬라이딩은 유전자 조절을 위한 표적 DNA 부위를 찾기 위한 TF의 확산을 용이하게 하는데 필수적이다. DNA를 슬라이딩하거나 밟는 TF의 염기쌍(bp) 분해능을 검출하는 것은 여전히 실험적으로 어려운 과제이다. 우리는 최근에 DNA를 따라 작은 WRKY 도메인 TF 단백질의 자발적인 1-bp 스테핑을 포착하는 모든 원자 분자 역학 (MD) 시뮬레이션을 수행했습니다. 이러한 시뮬레이션으로부터 수득된 10μs WRKY 스테핑 경로에 기초하여, 여기의 프로토콜은 MSM 구축을 위해 시험된 다양한 수의 마이크로- 및 매크로-상태와 함께 1-bp 단백질 스테핑을 위한 마르코프 상태 모델(MSM)을 구성함으로써, TF-DNA 시스템의 보다 광범위한 입체 형태 샘플링을 수행하는 방법을 보여준다. DNA와 함께 TF 단백질의 처리적인 1-D 확산 탐색을 구조적 기초와 함께 검사하기 위해, 프로토콜은 시스템의 장시간 스케일 다이내믹을 샘플링하기 위해 거친 그레인 (CG) MD 시뮬레이션을 수행하는 방법을 추가로 보여줍니다. 이러한 CG 모델링 및 시뮬레이션은 모든 원자 시뮬레이션으로부터 밝혀진 서브마이크로초 내지 마이크로초 단백질 스테핑 모션과 비교하여 수십 마이크로초 이상의 TF 단백질의 처리적 확산 운동에 대한 단백질-DNA 정전기적 영향을 밝히는데 특히 유용하다.

서론

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

전사 인자 (TF)는 유전자 전사 및 관련 활성에 결합하고 조절하기 위해 표적 DNA를 검색한다1. 3차원 (3D) 확산 이외에도, TF의 촉진된 확산은 표적 DNA 탐색에 필수적인 것으로 제안되었으며, 여기서 단백질은 또한 1차원 (1D) DNA를 따라 미끄러 지거나 홉 또는 DNA 2,3,4,5,6,7 상의 분절 간 전달로 점프할 수 있다.

최근 연구에서, 우리는 DNA8 상의 WRKY 도메인 단백질인 식물 TF에 대해 수십 마이크로초(μs) 모든 원자 평형 분자 역학(MD) 시뮬레이션을 수행하였다. 마이크로초 내에 폴리-A DNA에 대한 WRKY의 완전한 1-bp 스테핑이 포착되었다. DNA 홈과 수소 결합 (HBs)을 따라 단백질의 움직임이 파괴 - 개질 역학이 관찰되었습니다. 이러한 궤적은 하나의 샘플링 된 경로를 나타내는 반면, 전체 단백질 스테핑 환경은 여전히 부족합니다. 여기에서, 우리는 실질적인 형태 변화 및 시간 척도 분리를 포함하는 다양한 생체 분자 시스템을 시뮬레이션하기 위해 널리 구현 된 건설 된 Markov 상태 모델 (MSM)을 사용하여 초기 포획 된 단백질 스테핑 경로 주위에서 계산 샘플링을 확장하는 방법을 보여줍니다 9,10,11,12,13,14,15,16, 17,18,19. 목적은 하나의 순환 단계를 위해 DNA를 따라 확산된 TF 단백질의 형태적 앙상블 및 메타-안정 상태를 밝히는 것이다.

위의 MD 시뮬레이션은 DNA 상에서 1bp에 대한 단백질 이동의 원자 분해능을 나타내지만, 동일한 고해상도에서 DNA를 따라 TF의 오랜 시간 공정 확산의 구조적 역학은 거의 접근 할 수 없다. 그러나 잔류 물 수준에서 거친 그레인 (CG) MD 시뮬레이션을 수행하는 것은 기술적으로 접근 할 수 있습니다. CG 시뮬레이션 시간 척도는 원자 시뮬레이션 20,21,22,23,24,25,26,27,28,29보다 수십 배 또는 수백 배 더 길게 효과적으로 확장될 수 있다. 여기서는 타카다 랩30에서 개발한 CafeMol 소프트웨어를 구현하여 수행한 CG 시뮬레이션을 보여줍니다.

현재 프로토콜에서는 폴리-A DNA와 MSM 구축을 따라 WRKY 도메인 단백질의 원자 시뮬레이션을 먼저 제시하며, 이는 DNA를 따라 단지 1 bp에 대한 단백질 스테핑 모션을 샘플링하는 데 중점을 둡니다. 그런 다음 동일한 단백질-DNA 시스템의 CG 모델링 및 시뮬레이션을 제시하여 전산 샘플링을 DNA를 따라 수십 bps에 걸쳐 단백질 처리 확산으로 확장합니다.

여기서, 우리는 GROMACS 31,32,33 소프트웨어를 사용하여 MD 시뮬레이션을 수행하고 MSMbuilder 34를 사용하여 샘플링 된 형태 스냅 샷을위한 MSM을 구성하고 VMD 35를 사용하여 생체 분자를 시각화합니다. 이 프로토콜은 사용자가 위의 소프트웨어를 설치하고 구현할 수 있어야합니다. CafeMol30 소프트웨어의 설치 및 구현은 CG MD 시뮬레이션을 수행하는 데 필요합니다. 궤적 및 시각화에 대한 추가 분석도 VMD에서 수행됩니다.

액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.

프로토콜

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

1. 원자 MD 시뮬레이션에서 마르코프 상태 모델 (MSM)의 구축

  1. 자발적인 단백질 스테핑 경로 및 초기 구조 수집
    1. 이전에 수득된 10-μs 전원자 MD 궤적8 을 사용하여 "순방향" 1-bp 스테핑 경로(즉, 각 나노초마다 하나의 프레임)로부터 10000개의 프레임을 고르게 추출한다. 프레임의 총 수는 모든 대표적인 형태를 포함하기에 충분히 커야 한다.
    2. 파일 > 좌표 저장을 클릭하여 VMD에서 10000 프레임으로 전환 경로를 준비하고, 선택한 원자에 단백질 또는 핵산을 입력하고 프레임 상자에서 프레임을 선택하고 저장을 클릭하여 필요한 프레임을 가져옵니다.
      참고: 34-bp 동종 폴리-A DNA8 상에서 WRKY 스테핑을 위한 이전에 획득된 10μs 모든 원자 MD 시뮬레이션 궤적(여기서는 "순방향 스테핑 궤적"이라고 함)을 추가 입체 샘플링을 개시하기 위한 초기 경로로 사용하였다. 그러나 대부분의 사례에서는 조향 또는 표적 MD 시뮬레이션을 수행하거나 일반적인 경로 생성 방법 등을 구현하여 초기 경로를 구성합니다.36,37,38,39.
    3. 기준 DNA의 장축(결정 구조로부터)을 x축에 정렬하고, 추가 데이터 분석의 편의를 위해 좌표 공간의 원점에 전체 34bp DNA의 질량 중심(COM)을 설정한다. 이렇게 하려면 VMD에서 Tk 콘솔 > 확장을 클릭하고 Tk 콘솔 명령 창에 다음을 입력합니다.
      소스 회전.tcl
      tcl 스크립트는 보충 파일 3에서 찾을 수 있습니다.
    4. 그런 다음 결정 구조40으로부터 중앙 10 bp DNA (A14 내지 23 및 T14' 내지 23')를 정렬함으로써 단백질 백본의 평균 제곱 거리 (RMSD)를 계산하고, RMSD는 시스템의 기하학적 척도를 나타낸다 ( 도 1A 참조). 이렇게 하려면 VMD > 확장 > 분석 > RMSD 궤적 도구를 클릭하고 원자 선택 상자에 핵산 및 잔기 14~23 및 46~55를 입력하고 정렬 을 클릭한 다음 RMSD 상자를 클릭하여 RMSD 값을 계산합니다.
    5. 명령을 입력하여 MATLAB의 y-z 평면에서 DNA Θ(t) 주위의 단백질의 회전 정도를 계산합니다.
      rad2deg(아탄(z/y))
      이전에 8에서 수행된 것처럼 Θ(0)=0으로 정의된 초기 각도 위치 지정을사용합니다.
    6. MATLAB41에 다음 명령을 입력하여 K-means 메서드 42,43,44를 사용하고 입력하여 10000개의 구조를 25개의 클러스터로 분류합니다.
      [idx, C]=kmeans(X, 25)
      여기서 X 는 RMSD의 2D 행렬이며 DNA에 대한 WRKY의 회전 각도입니다. 추가 MD 시뮬레이션을 위해 이 25개 클러스터 센터의 구조를 수집합니다.
      참고 : DNA에 대해 샘플링 된 단백질 RMSD는 약 25 Å의 범위를 다루기 때문에 옹스트롬 당 하나의 클러스터를 갖기 위해 25 개의 클러스터를 선택합니다.
  2. MD 시뮬레이션 1 및 시뮬레이션 설정 수행
    1. parmbsc1 force 필드(45) 하에 GROMACS 5.1.2 소프트웨어(32)를 사용하고 쉘의 보충 파일 2로부터의 buildsystem.sh 파일을 사용하여 25개의 구조물에 대한 원자론적 시스템을 구축한다.
    2. 셸에 다음 명령을 입력하여 2fs의 시간 단계로 NPT 앙상블 아래에서 이러한 25개 시스템에 대해 60ns MD 시뮬레이션을 수행합니다.
      gmx_mpi grompp -f md.mdp -c npt.gro -p topol.top -o md.tpr
      gmx_mpi mdrun -deffnm md
  3. 클러스터링 1세인트 둥근 MD 궤적
    1. 셸에 입력하여 각 시뮬레이션 궤적의 처음 10ns를 제거합니다.
      gmx_mpi trjcat -f md.xtc -b 10000 -e 600000 -o newtraj.xtc
      클러스터링을 위한 25 × 50ns 궤적으로부터 형상을 수집하여 후속 보다 광범위한 샘플링(2 라운드 MD 시뮬레이션)을 위한 입력 구조를 준비합니다.
      참고: 초기 경로의 영향을 줄이고 로컬 평형을 허용하기 위해 초기 시뮬레이션 기간의 10ns를 제거했습니다.
    2. 단백질과 DNA 사이의 거리 쌍을 시간 독립적 성분 분석(tICA) 46,47,48 프로젝션을 위한 입력 파라미터로 선택합니다. GROMACS에서 make_ndx 명령을 사용하여 다음을 수행하십시오.
      gmx_mpi make_ndx -f 입력.pdb -o index.ndx
      참고: 여기서, 단백질 CA 원자 및 잔기 Y119, K122, K125, R131, Y133, Q146, K144, R135, W116, R117, Y134, K118, Q121의 잔기 Y119, K122, K121의 잔기 Y119, K122, N121의 잔기 Y119, K122, N136의 잔기 Y119, T19-23). 선택된 아미노산은 DNA와 안정한 HB 또는 염 다리를 형성 할 수 있습니다.
    3. 위에서 선택한 원자 인덱스를 index.ndx 파일에서 새 텍스트 파일(인덱스.dat)로 복사합니다. 보충 파일 1 generate_atom_indices.py에서 파이썬 스크립트로 이러한 원자 사이의 쌍 정보를 얻고 입력하십시오 :
      python2.6 generate_atom_indices.py 인덱스 .dat > AtomIndices .txt
      이것은 단백질과 DNA 사이의 415 거리 쌍을 생성합니다.
    4. MSMbuilder 명령 창에 다음 명령을 입력하여 모든 궤적에서 415개의 거리 쌍을 계산합니다.
      msmb AtomPairsFeaturizer -out pair_features --pair_indices AtomIndices.txt --top references.pdb --trjs "trajectories/*.xtc" --transformed pair_features --stride 5
    5. tICA를 수행하여 다음을 입력하여 처음 2개의 시간 독립적 구성 요소(tIC) 또는 벡터로 데이터 차원을 줄입니다.
      msmb tICA -i .. /tica_rc_a/tmp/ -o tica_results --n_components 2 --lag_time 10 --감마 0.05 -t tica_results.h5
      참고: tICA는 방정식에 의해 시뮬레이션 시스템의 가장 느린 자유도를 결정하기 위해 시간 지연 상관 행렬 figure-protocol-1 의 고유값을 계산하는 치수 감소 방법입니다.
      figure-protocol-2
      여기서 Xi(t)는 시간 t에서의 i번째 반응 좌표의 값이고, Xj(t+Δt)는 시간 t+Δt에서의 j번째 반응 좌표의 값이다. figure-protocol-3 는 Xi(t) 및 Xj(t+Δt) 전체 시뮬레이션 궤적의 곱의 기대값이다. 가장 느린 이완 자유도를 따른 방향은 위의 시간 지연 상관 행렬figure-protocol-4의 가장 큰 고유값에 해당합니다. 여기서 2 개의 tIC는 MSM 구성시 세 개의 매크로 상태를 구별하기위한 최소 집합 인 것 같습니다 (나중에 해결). 하나는 또한 일반화된 매트릭스 레일리 지수(GMRQ) 스코어(49)를 계산하여, 예를 들어, 사용될 최적의 컴포넌트 세트를 탐색할 수 있다.
    6. MSMbuilder의 명령을 사용하여 K-center43,44 방법으로 프로젝션된 데이터 세트를 100개의 클러스터로 클러스터링합니다(그림 1B 참조).
      msmb KCenters -i ./tica_results.h5 -o -o kcenters_output -t kcenters_output --n_clusters 100.
      각 클러스터의 중심 구조를 2 MD 시뮬레이션의 초기 구조로 선택합니다. 속도를 제외한 위치, 온도, 압력 등을 포함하여 시뮬레이션된 100개 구조물의 시뮬레이션 정보를 유지합니다.
      참고: 25번의 시뮬레이션의 첫 번째 라운드 후에 초기 경로의 메모리가 감소되었으므로 두 번째 라운드에서 더 많은 클러스터(예: 100개의 클러스터)를 생성하여 형태 샘플링을 크게 확장합니다.
  4. 2 라운드 광범위한 MD 시뮬레이션 수행
    1. 모든 원자에 임의의 초기 속도를 부과 한 후이 100 개의 초기 구조에서 시작하여 60-ns MD 시뮬레이션을 수행하십시오. mdp 파일에서 속도 생성을 켜는 것, 즉 md.mdp 파일을 = no로 변경하여 임의의 초기 속도를 gen_vel = gen_vel = yes로 추가합니다.
    2. 단계 1.3.1에 설명된 대로 각 시뮬레이션의 처음 10ns를 제거하고 100×50ns 궤적에서 2,500,000개의 스냅샷을 균등하게 수집하여 MSM을 구성합니다.
      참고 : 이후의 거시 상태 구성에서는 특히 낮은 인구 (X-Θ 평면의 하단에 ~ 0.2 %)를 가진 소수의 오프 경로 상태가 발견되었습니다. 이러한 오프 경로 상태는 총 매크로 상태 수가 3~6으로 설정된 경우 하나의 매크로 상태로 분류됩니다(그림 2B). 이러한 낮은 모집단 매크로 상태에는 결국 제거 된 3 개의 궤적 만 포함되기 때문에이 프로토콜에 표시된 결과는 실제로 97 × 50 ns 궤적에서 얻었으며 총 2,425,000 프레임 또는 스냅 샷이 있습니다.
  5. 2 MD 궤적을 클러스터링
    1. 이전에 수행 한 것처럼 2라운드 궤적에 대해 tICA를 수행하십시오. MSMbuilder에 입력:
      msmb tICA -i .. /tica_rc_a/tmp/ -o tica_results --n_components 2 --lag_time 10 --감마 0.05 -t tica_results.h5
    2. 암시적 시간 척도를 계산하여 상관 지연 시간 Δt 및 미세 상태 수에 대한 파라미터를 검증합니다( 그림 1C 참조).
      figure-protocol-5
      여기서 τ는 전이 확률 매트릭스(TPM)를 구축하는데 사용되는 지연 시간을 나타내고; μk(τ)는 τ의 지연 시간 하에서 TPM의 k번째 고유값을 나타낸다. 이 파이썬 BuildMSMsAsVaryLagTime.py -d 에 대해 보충 파일 1 의 파이썬 스크립트를 사용하십시오. / -f .. /trajlist_num -i 50 -m 1000 -t 10 -n 20 -s 500.
    3. 지연 시간 τ 및 미세 상태 수를 변경하여 위에 사용 된 매개 변수를 변경하여 변경하십시오.
      파이썬 BuildMSMsAsVaryLagTime.py -d .. / -f .. /trajlist_num -i 50 -m 1000 -t 5 10 20 30 40 -n 20 -s 20 200 400 500 800 2000
      주: 이 시스템은 암시적 시간 척도 곡선이 시간 척도 분리로 수평 해제되기 시작할 때 마르코비안으로 간주됩니다. 그런 다음 상관 지연 시간으로 Dt를 선택하고 암시적 시간 척도가 레벨오프되기 시작하는 지연 시간 τ를 선택하여 MSM을 빌드합니다.
    4. 따라서, 비교적 큰(그러나 너무 크지는 않은) 상태의 수, N = 500, 및 비교적 짧은 상관 지연 시간 Δt = 10 ns를 선택한다. 지연 시간은 MSM을 구축하기 위해 τ = 10ns인 것으로 밝혀졌다.
    5. 다음 명령을 사용하여 구조를 500개의 클러스터로 분류합니다( 그림 1D 참조).
      msmb KCenters -i ./tica_results.h5 -o -o kcenters_output -t kcenters_output --n_clusters 500
  6. MSM 건설
    1. 보충 파일 1 파이썬 msm_lumping_usingPCCAplus.py의 파이썬 스크립트를 사용하여 MSMbuilder의 PCCA+ 알고리즘 50에 따라 가장 적합한 매크로 상태의 수를 찾기 위해500 개의 마이크로 상태를 3-6 매크로 상태로 묶으십시오. 생체분자의 가장 필수적인 형태적 변화에 대한 모델의 감소된 운동 네트워크를 확인하고, 소수의 거대 상태, 즉 아래에 설명된 바와 같이 수백 개의 미세상태를 동역학적으로 덩어리화할 때,즉 17,51을 구성한다.
    2. 단계 1.1.3 및 1.1.4에 기술된 바와 같이 각 거대 상태에 대한 DNA를 따른 X(DNA 장축을 따른 단백질 이동) 및 단백질의 회전 각도에 고차원 입체 형태를 매핑한다(예를 들어, 1%< 너무 낮은 집단을 갖는 상태가 없다; 도 2C 참조). 그런 다음 시스템을 가장 잘 나타내는 3개의 매크로 상태를 찾습니다(그림 1E). DNA를 따른 단백질의 움직임과 DNA 주위의 단백질 회전 각도에 대한 스냅샷은 도 2D 를 참조하십시오.
      참고: 10μs 자발적 단백질 순방향 스테핑 경로를 생성하는 이전 작업에서는 샘플링을 적당히 확장하기 위해 5 x 4μs 평형 MD 시뮬레이션을 추가로 수행했습니다. 우리는 원래의 순방향 경로 (그림 2A 왼쪽 참조)의 매핑과 이전에 수행 된 순방향 경로에서 4-μs 샘플링 궤적을 추가로 보여주었습니다 (그림 2A 오른쪽 참조)8. 이 작업에 사용된 원래 100ns × 50ns(왼쪽 그림 2B 참조)8 및 97× 50ns 궤적의 매핑이 표시됩니다(오른쪽 그림 2B 참조).
  7. 평균 첫 번째 통과 시간(MFPT)의 계산
    1. MC의 시간 단계로 설정된 10ns의 지연 시간을 사용하여 500 마이크로 스테이트 MSM의 TPM을 기반으로 5개의 10ms 몬테카를로(MC) 궤적을 수행합니다. 보충 파일 1 파이썬 파이썬 mfpt_msm3.py의 파이썬 스크립트에 의해 각 매크로 상태 쌍 사이의 MFPT52를 계산합니다(그림 3).
    2. 보충 파일 2의 bash 파일을 사용하여 MFPT의 평균 및 표준 오류를 계산하고 다음을 입력하십시오.
      sh mfpt_analysis.bash

2. 오랜 시간 역학을 샘플링하기 위해 거친 그레인 (CG) 시뮬레이션 수행

  1. CafeMol 3.0 소프트웨어(30)를 이용하여 CG 시뮬레이션을 실시한다. 입력 구조, 시뮬레이션 매개 변수, 출력 파일 등을 포함하여 확장자가 .inp인 입력 구성 파일에 지정된 CG 시뮬레이션 설정을 참조하십시오. 터미널에서 다음 명령을 입력하여 CG 시뮬레이션을 실행합니다.
    카페몰 XXX.inp
  2. 입력 파일에서 다음 블록을 지정하고, 각 블록은 레이블 < and ending with >>>>로 시작합니다.
    1. 파일 이름 블록(필수)을 설정하여 작업 디렉토리와 입/출력 파일 저장소 경로를 지정합니다. 이러한 시뮬레이션의 파일 이름 블록에 대해 다음을 입력합니다.
      파일 이름 <<<<
      경로 = XXXXX (작업 경로)
      파일 이름 = wrky (출력 파일 이름)
      출력 psf pdb 영화 dcd rst
      path_pdb = XXXXX(입력 기본 구조 경로)
      path_ini = XXXXX(입력 초기 구조 경로)
      path_natinfo = XXXXX(기본 정보 파일 경로)
      path_para = XXXXX(매개변수 파일 경로)
      >>>>
      참고: Go-model(53 )이 CG 모델링에서 활용되기 때문에, 즉, 단백질은 천연 형태에 편향될 것이므로, 모델링된 구조를 네이티브 형태로서 설정해야 한다. 여기서, 입력 결정 구조는 기본 입체 구조로 설정되었다.
    2. 작업 제어 블록(필수)을 설정하여 시뮬레이션의 실행 모드를 정의합니다. 다음 명령을 입력합니다.
      <<<< job_cntl
      i_run_mode = 2 (= 2 항온 시뮬레이션)
      i_simulate_type = 1 (=1 랑게빈 역학)
      i_initial_state = 2(=2는 초기 구성이 기본 구성임을 의미함)
      >>>>
      항온 Langevin 역학 시뮬레이션을 선택합니다.
    3. 단위 및 상태 블록(필수)을 설정하여 입력 구조에 대한 정보를 정의합니다. 다음 명령을 입력합니다.
      <<<< unit_and_state
      i_seq_read_style = 1(=1은 PDB 파일에서 읽은 시퀀스를 의미함)
      i_go_native_read_style = 1 (=1은 네이티브 구조가 PDB 파일에서 가져온 것임을 의미)
      1 단백질 단백질.pdb (unit&state molecular_type native_structure)
      2-3 dna DNA.pdb (unit&state molecular_type native_structure)
      >>>>
      참고: 초기 입력 구조 파일(단백질.pdb 및 DNA.pdb은 여기)이 필요합니다. 구조는 pdb 형식으로 작성됩니다. 하나는 WRKY(단위 1)의 중원자 좌표를 포함하는 단백질 구조 파일이고, 다른 하나는 200bp 이중 가닥(ds) DNA의 좌표입니다(단위 2-3). 단백질은 처음에 DNA로부터 15 Å 떨어진 곳에 배치됩니다.
    4. energy_function 블록에 정의된 에너지 기능 블록(필수)을 설정합니다. 다음 명령을 입력합니다.
      <<<< energy_function
      현지(1) L_GO
      현지(2-3) L_DNA2
      NLOCAL(1/1) GO EXV ELE
      NLOCAL(2-3/2-3) ELE DNA
      NLOCAL(1/2-3) EXV ELE
      i_use_atom_protein = 0
      i_use_atom_dna = 0
      i_para_from_ninfo = 1
      i_triple_angle_term = 2
      >>>>
      참고: CG 시뮬레이션에서, 단백질은 Go-model53 에 의해 굵은 입자화되고, 각각의 아미노산은 CG 입자로 대표되며 Cα 위치에 배치된다. 단백질 입체 형태는 이동 전위 하에서 천연 구조 또는 결정 구조를 향해 편향될 것이다(왼쪽 그림 4A ). DNA는 3SPN.2 모델54에 의해 설명되며, 여기서 각각의 뉴클레오티드는 각각 당, 인산염 및 질소 염기에 상응하는 3개의 CG 입자 S, P, N으로 표시된다(도 4A 우측). 정전기 및 vdW 상호 작용은 서로 다른 체인 간에 고려됩니다. CG 시뮬레이션에서 단백질과 DNA 사이의 정전기적 상호작용은 Debye-Hückel 전위(55)에 의해 근사된다. vdW 반발 에너지는 Go 모델과 동일한 형태를 취합니다.
    5. md_information 블록(필수)을 설정하여 시뮬레이션 정보를 정의합니다. 다음 명령을 입력합니다.
      <<<< md_information
      n_step_sim = 1
      n_tstep(1) = 500000000
      tstep_size = 0.1
      n_step_save = 1000
      n_step_neighbor = 100
      i_com_zeroing = 0
      i_no_trans_rot = 0
      tempk = 300.0
      n_seed = -1
      >>>>
      n_tstep은 시뮬레이션 단계입니다. tstep_size를 각 MD 단계의 시간 길이로 설정하고, 각 CG 카페몰 시간 단계는 약 200 fs30이므로 여기서의 각 MD 단계는 원칙적으로 200 × 0.1 fs입니다. 100MD 단계마다 인접 목록을 업데이트합니다(n_step_neighbor = 100). 시뮬레이션 온도를 300K로 설정합니다. Berendsen 서모스탯(56)을 사용하여 단백질 구조를 업데이트하기 위한 속도형 Verlet 알고리즘을 사용하여 온도를 제어합니다.
      참고: n_step_sim은 Go 모델 기반 전위의 분지 수 또는 에너지 곡선의 로컬 최소 수입니다. 다중 분지 전위는 단백질 입체 형태가 상이한 형태에 편향되도록 허용하여 단백질 입체 형태가 하나의 국부적 최소치에서 다른 국부적으로 변할 수 있도록 한다. 여기서는 단일 분지 Go 모델만 사용되며, 이는 시뮬레이션에서 단백질에 대해 하나의 편향된 입체 형태(결정 구조)만을 의미합니다. 한편, CG 컨텍스트에서 모델링된 단백질-DNA 수소 결합 상호작용 등이 없기 때문에, 분자 운동은 원자 시뮬레이션에서보다 훨씬 빠르게, 즉 > 10배 더 빠르게 샘플링될 수 있다.
    6. 정전기 블록 (정전기 상호 작용이 사용될 때만 필요함)을 서로 다른 체인간에 정전기 상호 작용이 고려되므로 이 블록을 사용하여 다음을 입력하여 정전기 상호 작용에 대한 매개 변수를 정의하십시오.
      <<<< 정전기
      cutoff_ele = 10.0
      ionic_strength = 0.15
      >>>>
      정전기 상호작용에서 Debye 길이를 용액 조건에 해당하는 10 Å로 설정하십시오. 생리적 조건에서와 같이 이온 강도를 0.15 M로 설정하십시오.

액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.

결과

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

MSM 구조에서 WRKY의 회전 결합 슬라이딩 또는 1bp 스테핑
DNA 상의 모든 단백질 입체형태는 DNA를 따라 단백질 COM의 종방향 이동 X 및 회전 각도에 매핑된다( 도 3A 참조). 이 두 도의 선형 결합은 DNA 상의 WRKY 도메인 단백질의 회전 결합 스테핑을 나타낸다. 상기 형태들은 MSM에서 3개의 매크로스테이트들(S1, S2, 및 S3)로 더 클러스터링될 수 있다. WRKY의 전진 단계는 매크로 상태 전환 S1->S2->S3을 따릅니다. S1은 ~6%의 집단을 갖는 모델링된 구조(WRKY-DNA 복합체(40)의 결정 구조를 기초로)에 의해 개시되는 준안정 상태를 의미한다. 현재의 모델링에서, 초기 단백질 입체 형태는 단백질이 특정 W-box DNA 서열(40)과 결합하는 결정 구조로부터 채택되었다. 이러한 모델링된 단백질-폴리...

액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.

토론

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

이 작업은 구조 기반 계산 시뮬레이션 및 샘플링을 수행하여 DNA를 따라 이동하는 전사 인자 또는 TF 단백질을 스테핑의 원자 세부 사항뿐만 아니라 DNA 표적 검색에서 TF의 촉진 확산에 필수적인 프로세스 확산에서도 밝히는 방법을 다룹니다. 이를 위해, 균질한 폴리-A DNA를 따라 1-bp를 밟는 작은 TF 도메인 단백질 WRKY 스테핑의 마르코프 상태 모델 또는 MSM이 먼저 구축되어, 단백질-DNA 계면에서의 집단적 수소 결합 또는 HB 역학과 함께 DNA 상의 단백질 입체형태의 앙상블이 드러날 수 있다. MSM을 얻기 위해, 우리는 자발적인 단백질 스테핑 경로 (이전의 10-μs 시뮬레이션에서 얻은 것)를 따라 광범위한 모든 원자 MD 시뮬레이션의 두 라운드를 수행했으며, 현재 샘플링은 7.5 μs (125 x 60 ns)의 응집으로 이루어졌습니다. 이러한 광범위한 샘플링은 수백 개의 미세 상태로 구성 클러스터링을위한 스냅 샷을 제공하여 단백질-DNA 계면 쌍 거리를 클러스터링을위한 기하학적 척도로 활용합니다. MSM ...

액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.

공개 사항

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

저자는 이해 상충이 없습니다.

감사의 글

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

이 작업은 NSFC Grant #11775016 및 #11635002에서 지원되었습니다. JY는 NSF DMS 1763272와 UCI의 Simons Foundation 보조금 #594598 및 창업 기금을 통해 UCI의 CMCF의 지원을 받았습니다. LTD는 상하이 #20ZR1425400 및 #21JC1403100의 자연 과학 재단의 지원을 받고 있습니다. 우리는 또한 베이징 전산 과학 연구 센터 (CSRC)의 전산 지원을 인정합니다.

액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.

재료

이 논문에 사용된 재료 목록
이름회사카탈로그 번호댓글
CafeMol교토 대학거친 입자 (CG) 시뮬레이션
GROMACS흐로 닝언 대학 왕립 공과 대학 웁살라 대학분자 역학 시뮬레이션 소프트웨어
MatlabMathWorks수치 계산 소프트웨어
MSMbuilder스탠포드 대학빌드 MSM
VMD일리노이 대학교 어바나-샴페인 분자시각화 프로그램

참고문헌

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,
  1. Latchman, D. S. Transcription factors: an overview. The International Journal of Biochemistry & Cell Biology. 29 (12), 1305-1312 (1997).
  2. Berg, O. G., von Hippel, P. H. Selection of DNA binding sites by regulatory proteins. Statistical-mechanical theory and application to operators and promoters. Journal of Molecular Biology. 193 (4), 723-750 (1987).
  3. von Hippel, P. H., Berg, O. G. Facilitated target location in biological systems. The Journal of Biological Chemistry. 264 (2), 675-678 (1989).
  4. Halford, S. E., Marko, J. F. How do site-specific DNA-binding proteins find their targets. Nucleic Acids Research. 32 (10), 3040-3052 (2004).
  5. Slusky, M., Mirny, L. A. Kinetics of protein-DNA interaction: facilitated target location in sequence-dependent potential. Biophysical Journal. 87 (6), 4021-4035 (2004).
  6. Bauer, M., Metzler, R. Generalized facilitated diffusion model for DNA-binding proteins with search and recognition states. Biophysical Journal. 102 (10), 2321-2330 (2012).
  7. Shvets, A. A., Kochugaeva, M. P., Kolomeisky, A. B. Mechanisms of Protein Search for Targets on DNA: Theoretical Insights. Molecules. 23 (9), Basel, Switzerland. 2106(2018).
  8. Dai, L., Xu, Y., Du, Z., Su, X. D., Yu, J. Revealing atomic-scale molecular diffusion of a plant-transcription factor WRKY domain protein along DNA. Proceedings of the National Academy of Sciences of the United States of America. 118 (23), 2102621118(2021).
  9. Chodera, J. D., Singhal, N., Pande, V. S., Dill, K. A., Swope, W. C. Automatic discovery of metastable states for the construction of Markov models of macromolecular conformational dynamics. The Journal of Chemical Physics. 126 (15), 155101(2007).
  10. Pan, A. C., Roux, B. Building Markov state models along pathways to determine free energies and rates of transitions. The Journal of Chemical Physics. 129 (6), 064107(2008).
  11. Bowman, G. R., Huang, X., Pande, V. S. Using generalized ensemble simulations and Markov state models to identify conformational states. Methods. 49 (2), San Diego, California. 197-201 (2009).
  12. Prinz, J. H., et al. Markov models of molecular kinetics: Generation and validation. The Journal of chemical physics. 134 (17), 174105(2011).
  13. Chodera, J. D., Noé, F. Markov state models of biomolecular conformational dynamics. Current Opinion in Structural Biology. 25, 135-144 (2014).
  14. Malmstrom, R. D., Lee, C. T., Van Wart, A. T., Amaro, R. E. On the Application of Molecular-Dynamics Based Markov State Models to Functional Proteins. Journal of Chemical Theory and Computation. 10 (7), 2648-2657 (2014).
  15. Husic, B. E., Pande, V. S. Markov State Models: From an Art to a Science. Journal of the American Chemical Society. 140 (7), 2386-2396 (2018).
  16. Sittel, F., Stock, G. Perspective: Identification of collective variables and metastable states of protein dynamics. The Journal of chemical physics. 149 (15), 150901(2018).
  17. Wang, W., Cao, S., Zhu, L., Huang, X. Constructing Markov State Models to elucidate the functional conformational changes of complex biomolecules. WIREs Computational Molecular Science. 8, 1343(2018).
  18. Peng, S., et al. Target search and recognition mechanisms of glycosylase AlkD revealed by scanning FRET-FCS and Markov state models. Proceedings of the National Academy of Sciences of the United States of America. 117 (36), 21889-21895 (2020).
  19. Tian, J., Wang, L., Da, L. T. Atomic resolution of short-range sliding dynamics of thymine DNA glycosylase along DNA minor-groove for lesion recognition. Nucleic Acids Research. 49 (3), 1278-1293 (2021).
  20. Chu, J. -W., Izveko, S., Voth, G. The multiscale challenge for biomolecular systems: coarse-grained modeling. Molecular Simulation. 32 (3-4), 211-218 (2006).
  21. Marrink, S. J., Risselada, H. J., Yefimov, S., Tieleman, D. P., De Vries, A. H. The MARTINI force field: coarse grained model for biomolecular simulations. The Journal of Physical Chemistry B. 111 (27), 7812-7824 (2007).
  22. Givaty, O., Levy, Y. Protein sliding along DNA: dynamics and structural characterization. Journal of Molecular Biology. 385 (4), 1087-1097 (2009).
  23. Khazanov, N., Levy, Y. Sliding of p53 along DNA can be modulated by its oligomeric state and by cross-talks between its constituent domains. Journal of Molecular Biology. 408 (2), 335-355 (2011).
  24. Riniker, S., Allison, J. R., van Gunsteren, W. F. On developing coarse-grained models for biomolecular simulation: a review. Physical Chemistry Chemical Physics : PCCP. 14 (36), 12423-12430 (2012).
  25. Kmiecik, S., et al. Coarse-Grained Protein Models and Their Applications. Chemical Reviews. 116 (14), 7898-7936 (2006).
  26. Bhattacherjee, A., Krepel, D., Levy, Y. Coarse-grained models for studying protein diffusion along DNA. WIREs Computational Molecular Science. 6, 515-531 (2016).
  27. Wang, J., et al. Machine Learning of Coarse-Grained Molecular Dynamics Force Fields. ACS Central Science. 5 (5), 755-767 (2019).
  28. Joshi, S. Y., Deshmukh, S. A. A review of advancements in coarse-grained molecular dynamics simulations. Molecular Simulation. 47 (10-11), 786-803 (2021).
  29. Bigman, L. S., Greenblatt, H. M., Levy, Y. What Are the Molecular Requirements for Protein Sliding along DNA. The Journal of Physical Chemistry B. 125 (12), 3119-3131 (2021).
  30. Kenzaki, H., et al. CafeMol: A Coarse-Grained Biomolecular Simulator for Simulating Proteins at Work. Journal of Chemical Theory and Computation. 7 (6), 1979-1989 (2011).
  31. Berendsen, H. J. C., vander Spoel, D., van Drunen, R. GROMACS: a message-passing parallel molecular dynamics implementation. Computer Physics Communications. 91 (1-3), 43-56 (1995).
  32. vander Spoel, D., et al. GROMACS: fast, flexible, and free. Journal of Computational Chemistry. 26 (16), 1701-1718 (2005).
  33. Abraham, M. J., et al. GROMACS: High performance molecular simulations through multi-level parallelism from laptops to supercomputers. SoftwareX. 1-2, 19-25 (2015).
  34. Harrigan, M. P., et al. MSMBuilder: Statistical Models for Biomolecular Dynamics. Biophysical journal. 112 (1), 10-15 (2017).
  35. Humphrey, W., Dalke, A., Schulten, K. VMD: visual molecular dynamics. Journal of Molecular Graphics. 14 (1), 33-38 (1996).
  36. Izrailev, S., et al. Steered Molecular Dynamics. Computational Molecular Dynamics: Challenges, Methods, Ideas. 4, Springer. Berlin, Heidelberg. 39-65 (1999).
  37. Schlitter, J., Engels, M., Krüger, P. Targeted molecular dynamics: a new approach for searching pathways of conformational transitions. Journal of Molecular Graphics. 12 (2), 84-89 (1994).
  38. Maragliano, L., Fischer, A., Vanden-Eijnden, E., Ciccotti, G. String method in collective variables: minimum free energy paths and isocommittor surfaces. The Journal of Chemical Physics. 125 (2), 24106(2006).
  39. Weiss, D. R., Levitt, M. Can morphing methods predict intermediate structures. Journal of Molecular Biology. 385 (2), 665-674 (2009).
  40. Xu, Y. P., Xu, H., Wang, B., Su, X. D. Crystal structures of N-terminal WRKY transcription factors and DNA complexes. Protein. 11 (3), 208-213 (2020).
  41. Higham, D. J., Higham, N. J. MATLAB guide. Society for Industrial and Applied Mathematics. , (2016).
  42. Hartigan, J. A., Wong, M. A. Algorithm AS 136: A K-Means Clustering Algorithm. Journal of the Royal Statistical Society. Series C (Applied Statistics). 28 (1), 100-108 (1979).
  43. Gonzalez, T. F. Clustering to minimize the maximum intercluster distance. Theoretical Computer Science. 38, 293-306 (1985).
  44. Zhao, Y., Sheong, F. K., Sun, J., Sander, P., Huang, X. A fast parallel clustering algorithm for molecular simulation trajectories. Journal of Computational Chemistry. 34 (2), 95-104 (2013).
  45. Ivani, I., et al. Parmbsc1: a refined force field for DNA simulations. Nature Methods. 13 (1), 55-58 (2016).
  46. Naritomi, Y., Fuchigami, S. Slow dynamics of a protein backbone in molecular dynamics simulation revealed by time-structure based independent component analysis. The Journal of Chemical Physics. 139 (21), 215102(2013).
  47. Naritomi, Y., Fuchigami, S. Slow dynamics in protein fluctuations revealed by time-structure based independent component analysis: the case of domain motions. The Journal of Chemical Physics. 134 (6), 065101(2011).
  48. Pérez-Hernández, G., Paul, F., Giorgino, T., De Fabritiis, G., Noé, F. Identification of slow molecular order parameters for Markov model construction. The Journal of Chemical Physics. 139 (1), 015102(2013).
  49. McGibbon, R. T., Pande, V. S. Variational cross-validation of slow dynamical modes in molecular kinetics. The Journal of Chemical Physics. 142 (12), 124105(2015).
  50. Deuflhard, P., Weber, M. Robust Perron cluster analysis in conformation dynamics. Linear Algebra and its Applications. 398, 161-184 (2005).
  51. Silva, D. A., et al. Millisecond dynamics of RNA polymerase II translocation at atomic resolution. Proceedings of the National Academy of Sciences of the United States of America. 111 (21), 7665-7670 (2014).
  52. Swope, W. C., Pitera, J. W., Suits, F. Describing Protein Folding Kinetics by Molecular Dynamics Simulations. 1. Theory. The Journal of Physical Chemistry B. 108 (21), 6571-6581 (2004).
  53. Clementi, C., Nymeyer, H., Onuchic, J. N. Topological and energetic factors: what determines the structural details of the transition state ensemble and "en-route" intermediates for protein folding? An investigation for small globular proteins. Journal of molecular biology. 298 (5), 937-953 (2000).
  54. Hinckley, D. M., Freeman, G. S., Whitmer, J. K., De Pablo, J. J. An experimentally-informed coarse-grained 3-Site-Per-Nucleotide model of DNA: structure, thermodynamics, and dynamics of hybridization. The Journal of chemical physics. 139 (14), 144903(2013).
  55. Debye, P., Huckel, E. The theory of the electrolyte II-The border law for electrical conductivity. Physikalische Zeitschrift. 24, 305-325 (1923).
  56. Berendsen, H. J., Postma, J. V., van Gunsteren, W. F., DiNola, A., Haak, J. R. Molecular dynamics with coupling to an external bath. The Journal of Chemical Physics. 81, 3684-3690 (1984).
  57. Bowman, G. R. Improved coarse-graining of Markov state models via explicit consideration of statistical uncertainty. The Journal of Chemical Physics. 137 (13), 134111(2012).
  58. Jain, A., Stock, G. Identifying metastable states of folding proteins. Journal of Chemical Theory and Computation. 8 (10), 3810-3819 (2012).
  59. Röblitz, S., Weber, M. Fuzzy spectral clustering by PCCA+: application to Markov state models and data classification. Advances in Data Analysis and Classification. 7, 147-179 (2013).
  60. Mardt, A., Pasquali, L., Wu, H., Noé, F. VAMPnets for deep learning of molecular kinetics. Nature Communications. 9 (1), 5(2018).
  61. Wang, W., Liang, T., Sheong, F. K., Fan, X., Huang, X. An efficient Bayesian kinetic lumping algorithm to identify metastable conformational states via Gibbs sampling. The Journal of Chemical Physics. 149 (7), 072337(2018).
  62. Chen, W., Sidky, H., Ferguson, A. L. Nonlinear discovery of slow molecular modes using state-free reversible VAMPnets. The Journal of Chemical Physics. 150 (21), 214114(2019).
  63. Gu, H., et al. RPnet: a reverse-projection-based neural network for coarse-graining metastable conformational states for protein dynamics. Physical Chemistry Chemical Physics :PCCP. 24 (3), 1462-1474 (2022).
  64. Lane, T. J., Bowman, G. R., Beauchamp, K., Voelz, V. A., Pande, V. S. Markov state model reveals folding and functional dynamics in ultra-long MD trajectories. Journal of the American Chemical Society. 133 (45), 18413-18419 (2011).
  65. Konovalov, K. A., Unarta, I. C., Cao, S., Goonetilleke, E. C., Huang, X. Markov State Models to Study the Functional Dynamics of Proteins in the Wake of Machine Learning. JACS Au. 1 (9), 1330-1341 (2021).
  66. Cao, S., Montoya-Castillo, A., Wang, W., Markland, T. E., Huang, X. On the advantages of exploiting memory in Markov state models for biomolecular dynamics. The Journal of Chemical Physics. 153 (1), 014105(2020).
  67. Brandani, G. B., Takada, S. Chromatin remodelers couple inchworm motion with twist-defect formation to slide nucleosomal DNA. PLoS Computational Biology. 14 (11), 1006512(2018).
  68. Tan, C., Terakawa, T., Takada, S. Dynamic Coupling among Protein Binding, Sliding, and DNA Bending Revealed by Molecular Dynamics. Journal of the American Chemical Society. 138 (27), 8512-8522 (2016).
  69. Terakawa, T., Takada, S. p53 dynamics upon response element recognition explored by molecular simulations. Scientific reports. 5, 17107(2015).
  70. Brandani, G. B., Niina, T., Tan, C., Takada, S. DNA sliding in nucleosomes via twist defect propagation revealed by molecular simulations. Nucleic Acids Research. 46 (6), 2788-2801 (2018).
  71. Knotts, T. A., Rathore, N., Schwartz, D. C., de Pablo, J. J. A coarse grain model for DNA. The Journal of Chemical Physics. 126 (8), 084901(2007).
  72. Freeman, G. S., Hinckley, D. M., Lequieu, J. P., Whitmer, J. K., de Pablo, J. J. Coarse-grained modeling of DNA curvature. The Journal of Chemical Physics. 141 (16), 165103(2014).

액세스가 제한되었습니다. 이 콘텐츠를 보려면 로그인하거나 체험판을 시작하세요.

재인쇄 및 허가

이 JoVE 논문의 텍스트 또는 그림 재사용 허가 요청

허가 요청

태그

Transcription Factor DiffusionProtein DNA SlidingMarkov State ModelMolecular Dynamics SimulationCoarse Grained SimulationWRKY Domain ProteinOne Dimensional DiffusionProtein Stepping MotionHydrogen Bond DynamicsZinc Finger Region

관련 논문