← 모든 글

온라인 음악 생성을 위한 신경망: 텍스트를 기반으로 트랙을 만드는 방법

온라인 음악 생성을 위한 신경망: 텍스트를 기반으로 트랙을 만드는 방법 - NeuralSpace

주요 사항에 대해 간략히 설명합니다 (BLUF)

텍스트 설명을 기반으로 한 트랙은 이미 현실입니다. 장르, 분위기, 단어가 필요한지 여부를 작성하면 신경망이 몇 분 안에 완성된 음악을 반환합니다. 우리는 무엇을 얻을 수 있는지, 그것이 어떻게 작동하는지, 생성을 다른 도구와 연결하는 방법을 보여줍니다.

일주일 전에 나는 팟캐스트를 위한 노래가 필요했습니다. 이전에는 프리랜서 교환소에 가서 참조 조건을 설명하고 3일을 기다렸다가 수정을 요청했을 것입니다. 그리고 여기서는 분위기와 장르를 설명했고, 1분 뒤에는 보컬과 편곡이 포함된 네 가지 버전을 들어봤습니다. 음악을 생성하기 위한 신경망은 이상하지만 작동합니다. 안에 모듈 “음악” NeuralSpace 지금 당장 시도해 볼 수 있습니다.

당신이 얻을 수 있는 것

  • 전체 노래 - 보컬, 절, 코러스 포함
  • 비디오용 악기 및 배경 음악
  • 팟캐스트 및 YouTube용 징글
  • 데모 버전: 가사와 함께 멜로디를 흥얼거리며 편곡을 하게 됩니다. 글쎄, 정확히 "흥얼거리는" 것은 아니지만 리듬과 분위기를 설명하는 것입니다.
신경망은 텍스트를 기반으로 음악 트랙을 생성합니다.

어떻게 작동하나요?

장르, 템포, 분위기, 참조 등 트랙을 설명합니다. "공부용 재생 목록처럼 Lo-fi, 차분함, 85BPM" - 모델은 이해합니다. 별도로 노래 가사를 러시아어 또는 영어로 제공할 수 있습니다. 출력은 최대 몇 분 길이의 2~4개 옵션입니다.

다른 도구와의 연결

트랙을 사운드트랙으로 즉시 던질 수 있습니다. 동영상. 표지 - 드로우인 이미지 생성기. 사이트에 대한 설명 - 쓰기 대상 GPT 채팅. 모든 것이 하나의 구독 내에 있습니다. 실제 결과에 대한 지불.

실습에서 얻은 팁

  • BPM과 기분을 지정하세요. 이것이 없으면 결과를 예측할 수 없습니다.
  • 최대 1~2개의 참조. "라디오헤드 + 90년대 러시안 록 + lo-fi"처럼 모델이 혼란스러워질 것입니다.
  • 짧은 줄의 가사가 더 좋습니다. 모델이 리듬에 더 정확하게 들어갑니다.
  • 3~4개의 옵션을 생성하고 가장 좋은 옵션을 선택하세요. 첫 번째 옵션은 거의 이상적이지 않습니다.

솔직한 마이너스: 신경망은 복잡한 배열과 비표준 크기로 인해 여전히 다소 약합니다. 그러나 배경 음악, 징글 및 데모에는 충분합니다.

등록하다 — 환영 토큰의 첫 번째 트랙입니다.

자주 묻는 질문(FAQ)

질문: 신경망에서 최상의 결과를 얻는 방법은 무엇입니까?
답변: 영어로 된 자세한 프롬프트(설명)를 사용하고 장면의 스타일과 세부 사항을 설정하세요.

질문: 이 자료를 상업적 목적으로 사용할 수 있나요?
답변: 예, 생성된 콘텐츠는 전적으로 귀하의 것입니다.