대규모로 AI 콘텐츠를 인간화하는 에이전시용 방법
초안 작성은 에이전시가 모델을 채택한 그 주에 더 이상 병목이 아니게 되었다. 편집자가 같은 주에 병목이 되었고, 대부분의 팀은 그에 맞추어 과정을 다시 설계하지 않았다. 이것이 운영적 버전이다. 사람이 반드시 차지해야 하는 세 지점, 모든 클라이언트 전반에서 한 번 결정할 가치가 있는 사항, 그리고 시스템이 아무리 좋아져도 표준화에 저항하는 작업이다.
열한 명의 리테이너 고객을 둔 한 에이전시는 두 명의 작가와 한 명의 편집자로 한 달에 60페이지를 제작한다. 초안 작성은 그들이 한 모델을 채택한 주에 더 이상 병목이 아니게 되었다. 같은 주에 편집자가 병목이 되었고, 아무도 그에 맞게 프로세스를 다시 설계하지 않았다.
대규모로 AI 콘텐츠를 인간화한다는 것은 좋은 편집 감각을 60번 따로 적용하고 그것이 유지되기를 바라는 것이 아니라, 많은 글에 걸쳐 반복 가능한 프로세스를 실행하는 것을 뜻한다. 그 차이는 무엇이 기록되는지에서 드러난다. 잘 편집된 한 페이지는 어느 편집자가 그것을 맡았는지에 달려 있다. 하나의 프로그램은 한 번 내려진 결정이 어디에나 적용되고, 누구도 건너뛸 권한이 없는 고정된 지점에서 점검되는 데 달려 있다.
규정 준수 문제에 대해서는 한 단락만 언급하겠다, 아래의 모든 것을 지배하기 때문이다. Google's spam policy는 사용자에게 도움을 주기보다 순위를 조작하는 주된 목적을 위해 대규모로 생성된 페이지를 설명하며, 이로써 목적이 발동 요인이고 양은 증상임을 보여 준다. 독자가 다른 곳에서는 얻을 수 없는 사실을 담은, 진정으로 서로 다른 60페이지는 그 문장에 해당하지 않는다. 변수를 하나 바꾼 거의 동일한 60페이지는 월간 총량이 무엇을 말하든 그 문장에 해당한다. Google's documented position on AI-assisted content은 어떤 대량 생산 프로그램도 승인되기 전에 전체를 읽어 볼 가치가 있으며, 이하의 모든 내용은 목적 검사가 이미 통과되었다고 가정한다.
대규모로 AI 콘텐츠를 인간화하기, 편집자는 어디에 있어야 하는가
Wikipedia에 무엇인가를 게시하려면 인간 편집자가 세 곳에 있어야 한다. 그중 하나만 초안이 존재한 뒤에 일어난다. 하나는 브리프다, 누군가 앉아서 이렇게 묻는다, '이 페이지는 다른 어떤 페이지도 알지 못하는 무엇을 아는가?' 또 하나는 검증이다, 확인 가능한 모든 사실과 인용을 위해 모든 출처를 연다. 그리고 세 번째는 최종 승인이다, 누군가 자신의 이름을 그것에 올린다. 이들 사이의 모든 것은 자동화할 수 있다. 그러나 이 셋은 어느 것도 자동화할 수 없다.
대부분의 에이전시는 이 세 가지를 모두 마지막에 한꺼번에 묶어 편집이라고 부르는데, 바로 그 지점에서 병목이 생긴다. 브리프 단계에서 내리는 결정은 10분이면 끝난다. 초안 작성 후에 내리는 결정은 전면 재작성으로 이어진다. 이미 완성된 페이지를 넘겨받았지만 그 페이지가 말할 내용을 한 번도 부여받지 못한 편집자는 되돌려 보내는 것 외에는 선택지가 없고, 그 왕복이 워크플로에서 가장 비용이 큰 단일 사건이다.
승인은 역할이 아니라 특정 인물이 맡아야 한다. Google의 자체 가이드라인은 방문자가 콘텐츠의 작성자가 누구인지 자명하게 알 수 있는지, 페이지에 기대되는 위치에 byline이 있는지, 그리고 이를 요구하기보다 정확한 저자 정보를 권장하는지 묻는다. 실제 인물로 연결되는 byline은 어떤 정책도 요구하지 않는 내부적으로 유용한 일도 하나 더 한다. 즉, 클라이언트 앞에서 방어할 수 없는 페이지를 승인하려 하지 않는 식별 가능한 한 명의 인간을 만들어 낸다.
모든 클라이언트에 대해 한 번만 표준화할 것
문서마다 달라지지 않는 모든 것을 표준화하라. 사내 용어, 구조적 기본값, 프롬프트 골격, 도구 설정, 그리고 완료의 서면 정의가 여기에 해당한다. 이러한 결정은 한 번, 일주일 동안만 논쟁할 가치가 있고, 그 이후에는 다시 논쟁할 필요가 없다. 그 결과는 대기열의 어떤 페이지를 열어도 본질에 시간을 쓰고, 사내 스타일이 연속 쉼표를 쓰는지 여부를 두고 다시 논쟁하지 않는 검토자이다.
| 계층 | 모든 클라이언트에 걸쳐 한 번 표준화됨 | 각 항목마다 결정됨 |
|---|---|---|
| 음성 | 금지어 목록, 문장 길이 범위, 그리고 섹션을 그 자체의 제목을 다시 말하며 시작하지 말아야 한다는 규칙 | 한 클라이언트의 어조가 기본값에서 얼마나 벗어나는지 |
| 구조 | 제목 깊이, 각 제목 아래에 직접 답변을 두는 위치, 표와 목록의 관례 | 이 특정 항목에 표가 정말 필요한지 여부 |
| 출처 | 무엇이 출처로 간주되는지, 그리고 모든 수치에는 출처가 하나씩 따라야 한다는 규칙 | 이 주장에 어떤 출처가 필요한지, 그리고 누가 그것들을 여는지 |
| 도구 설정 | 클라이언트마다 저장된 humanizer 설정 하나, 그래서 출력이 운영자마다 달라지지 않음 | 없음. 항목별 도구 조작은 배치를 더 이상 배치가 아니게 만드는 방식이다 |
| 책임성 | 클라이언트마다 지정된 검토자 한 명과 완료 기준의 서면 정의 | 이 페이지를 승인한 지정된 사람이 누구인지 |
도구 설정 행은 기관이 가장 자주 잘못 처리하는 부분이다. 각 작성자가 자신의 설정으로 작업하면 출력은 운영자마다 달라지고, 그 차이는 누구도 정확히 품질 문제라고 이름 붙이기 어려운, 한 클라이언트 사이트 내부의 불일치로 드러난다. 설정은 클라이언트별로 정하고, 저장하며, 그 변경은 누군가가 목요일 오후에 슬쩍 조정한 슬라이더가 아니라 기록되는 결정으로 취급해야 한다.
자신의 논문을 인간적으로 다듬기
중요한 단어나 인용은 건드리지 않고, AI 보조로 작성한 텍스트를 자연스럽고 사람처럼 들리게 바꾸세요.
템플릿화할 수 없는 것
표준화할 수 없는 것이 세 가지 있고, 바로 그 세 가지가 페이지가 애초에 존재해야 하는지 여부를 결정한다. 표준화할 수 없는 첫 번째 것은 구체적인 입력이다. 그것은 이 클라이언트가 측정한 수치일 수도 있고, 실제 대시보드의 스크린샷일 수도 있고, 영업팀이 매주 상대하는 이의제기일 수도 있다. 표준화할 수 없는 두 번째 것은 검증 가능한 것을 확인하는 일이다. 즉, 초안을 믿지 말고 출처를 열어 보아야 한다. 그리고 표준화할 수 없는 세 번째 것은 이 페이지가 이미 해당 용어에서 순위가 매겨진 기존 내용에 무엇인가를 더하는지에 대해 판단을 내리는 일이다.
그 특정한 입력은 글쓰기 문제이기 전에, 고객 접근 문제이다. 그래서 그것은 매우 조용하면서도 매우 지속적이어서 사라지지 않는다. 고객의 데이터에 접근할 수 없고, 그 일을 하는 사람과 15분 동안 앉아 있을 수 없으며, 실제 수치를 제시할 수 없는 작성자는 현재 상위 10개 답변에 대한 충분히 무난한 요약을 만들어 낼 것이다. 작성자가 얼마나 뛰어난지는 중요하지 않다. 그들이 당신의 분야에 대해 무엇을 알고 있는지, 또는 당신이 그들의 능력을 어떻게 평가하는지도 중요하지 않다.
사내 어휘는 검토로가 아니라 기계적으로 강제할 가치가 있는 유일한 음성 결정인데, 이는 검토자가 대략 20쪽쯤 가면 더 이상 알아차리지 않게 되는 것이기 때문이다. 무료 AI 단어 정리 도구를 편집자에게 도달하기 전에 실행하면, 가장 비용이 적게 드는 시점에서 상투적 표현을 제거할 수 있고, 그 결과 인간 검토 시간은 판단이 필요한 부분에 집중된다. 편집되지 않은 초안을 드러내는 반복 패턴은 다른 곳에서 자세히 정리되어 있으며, 그 자료를 바탕으로 만든 사내 목록은 지난달 검토자가 불쾌해했던 것들로 임시로 만든 목록보다 더 오래 간다.
분량 프로그램을 방어 가능하게 유지하기
목적 검사는 개별 페이지가 아니라 프로그램 전체에 관한 것이다. 계획 수준에서 답하고, 문서로도 답해야 한다. 한 묶음을 의뢰하기 전에, 그 안의 각 페이지가 그 묶음의 다른 어떤 페이지에도 없는 무엇을 담을 것인지 명시해야 한다. 스프레드시트의 한 열이 의미하는 것은 그 묶음이 변수만 다른 하나의 페이지이며, 분량이 모든 일을 하고 있다는 뜻이다. 페이지마다 서로 다른 사실 집합이 있다는 것은, 그 묶음이 단지 형태만 공유하는 문서들의 집합이라는 뜻이다.
그에 따라 두 가지 운영 습관이 뒤따른다. 프로그램을 여러 위성 사이트로 분산시키지 말고 하나의 도메인 아래에서 게시해야 한다. 콘텐츠의 대량 생산 성격을 숨기기 위해 여러 사이트를 만드는 것은 정책 아래 Google 자체 예시 목록에 들어 있기 때문이다. 또한 게시 분량은 그 반대로 하지 말고 편집 역량이 정하도록 해야 한다. 먼저 페이지 수를 약속한 뒤 검토 시간을 찾아 나서는 기관은, 3개월째에 조용히 검증 단계를 생략하는 기관이다.
마케팅 및 SEO 콘텐츠를 위해 구축된 humanizer는 신중하게 설정할 가치가 가장 큰 스택의 일부인데, 모든 배치의 모든 페이지에 영향을 미치고 기본 설정이 우연히 에이전시의 목소리가 되기 때문이다. 그것이 바꾸는 것은 페이지의 읽히는 방식이다. 그것이 바꿀 수 없는 것은 페이지가 알고 있는 내용이며, 그것에 대한 어떤 설정도 위의 세 지점에서 인간을 제거하지 못한다.
에이전시가 실제로 얼마나 많이 발행할 수 있는지를 제한하는 것은 무엇인가?
대부분의 경우 검증 시간이다. 초안 작성은 모델이 프로세스에 들어오는 순간 거의 0으로 떨어졌고, 브리핑과 승인도 연습을 통해 상당히 잘 압축된다. 수치가 실제인지, 인용이 존재하는 문서를 가리키는지, 그리고 클라이언트의 주장이 클라이언트가 책임질 수 있는 것인지 확인하는 일은 전혀 압축되지 않는다. 누군가가 출처를 열어 읽어야 하기 때문이다. 초안 작성 속도에 기반한 모든 용량 모델은 과도하게 약속하게 되며, 한 달이 짧아질 때 잘려 나가는 단계는 전체 프로그램을 지탱하고 있는 단계이다.
이것이 콘텐츠 팀에 제기하는 두 가지 질문은 별도로 답할 수 있다. AI 콘텐츠가 Google에서 순위에 오르는지, 그리고 애초에 그것이 SEO에 해로운지이다.
이번 달에 발행한 페이지 수를 팀이 출처를 여는 데 실제로 사용한 시간으로 나누라. 돌아오는 수치가 실제 용량이며, 대부분의 에이전시는 누군가 의도적으로 결정하지 않았는데도 한동안 그 수치를 넘어서 발행해 왔음을 알게 된다.
자주 묻는 질문
항목마다 변하지 않는 결정을 표준화하고, 검토자에게는 판단이 필요한 사항만 남겨 두어야 한다. 사내 용어 목록, 구조적 기본값, 그리고 클라이언트별로 저장된 하나의 도구 설정은 운영자 간 출력의 일관성을 유지한다. 대규모로 AI 콘텐츠를 인간화하려면, 변동하는 부분은 각 페이지가 담는 구체적 입력이어야 하며, 초안을 맡은 사람이 우연히 선택한 설정이어서는 안 된다.
Content strategist at TextPulse, here since the company started. Mark writes the product and technical coverage: how the humanizer works under the hood, what changes in each release, and what a specification actually means for your writing. His reviews of writing software come from using them on real documents rather than reading a feature list.