Bài 2 — Transcribe cuộc họp đúng cách để AI hiểu được
Mọi thứ về sau đều phụ thuộc vào chất lượng transcript. "Rác vào, rác ra": nếu bản ghi không phân biệt được ai nói câu nào, AI sẽ gán owner sai và bịa quyết định. Bài này giúp bạn tạo ra một transcript sạch mà không cần công cụ đắt tiền hay kỹ năng kỹ thuật.
Transcript tốt cho BA cần gì?
- Speaker labels (nhãn người nói): ai nói câu gì — bắt buộc để gán owner cho action item.
- Timestamp: để bạn tua lại kiểm chứng khi AI cho kết quả đáng ngờ.
- Văn bản gần đúng nguyên văn, không bị công cụ tự "làm đẹp" đến mức mất chi tiết.
Các bước tạo transcript sạch
- Ghi âm/ghi hình có kiểm soát: dùng chức năng record của Zoom/Google Meet/MS Teams. Nhắc mọi người bật tính năng bản ghi để công cụ tách speaker tốt hơn. Ở Việt Nam, nhớ xin phép ghi âm đầu buổi — vừa đúng luật vừa lịch sự.
- Xuất transcript tự động: Teams/Meet/Zoom đều có transcript kèm tên người nói. Nếu chỉ có file âm thanh, dùng công cụ speech-to-text hỗ trợ tiếng Việt.
- Làm sạch nhanh bằng AI: transcript thô thường có từ đệm ("à", "ừm"), câu lặp. Dùng AI để gọn lại NHƯNG giữ nguyên ý và speaker.
- Kiểm tra tên riêng và thuật ngữ: công cụ hay ghi sai tên người và thuật ngữ nghiệp vụ (ví dụ "CR" thành "xi a"). Sửa tay các chỗ quan trọng.
- Lưu bản gốc: luôn giữ transcript gốc chưa chỉnh, phòng khi cần đối chiếu.
Ví dụ prompt làm sạch transcript
Đây là transcript thô từ một cuộc họp tiếng Việt, có nhiễu và từ đệm.
Hãy làm sạch theo đúng các nguyên tắc:
- GIỮ NGUYÊN nhãn người nói và thứ tự phát biểu.
- Bỏ từ đệm (à, ừm, kiểu như), câu bị lặp do nói vấp.
- KHÔNG tóm tắt, KHÔNG diễn giải lại, KHÔNG thêm ý mới.
- Nếu một đoạn nghe không rõ, giữ nguyên và đánh dấu [không rõ].
Định dạng đầu ra: [Người nói]: nội dung.--- TRANSCRIPT THÔ ---
{dán vào đây}
Lưu ý điểm mấu chốt trong prompt: câu "KHÔNG tóm tắt, KHÔNG thêm ý mới". Nếu thiếu ràng buộc này, AI sẽ tự tóm tắt và bạn mất chi tiết cần cho việc bóc yêu cầu ở bài sau.
Xử lý transcript dài quá giới hạn
Cuộc họp 90 phút có thể vượt độ dài AI xử lý tốt một lần. Cách làm:
- Chia transcript theo mốc thời gian (ví dụ mỗi 20 phút một khối).
- Làm sạch từng khối rồi ghép lại.
- Khi bóc tách, xử lý từng khối và gộp kết quả — tránh để AI "quên" phần đầu khi đọc phần cuối.
Template quy ước tên người nói
Gán nhãn nhất quán giúp Aya AI gán owner chính xác:
[PO - Lan]: Product Owner, chị Lan
[BA - Bạn]: Business Analyst (người ghi)
[Ops - Anh Dũng]: Trưởng phòng Vận hành
[Dev Lead - Minh]: Trưởng nhóm phát triển
[Khách - Cty ABC]: Đại diện khách hàng
Dán bảng quy ước này kèm transcript để AI không nhầm "anh Dũng" với "Dev Lead".
Sai lầm thường gặp
- Bỏ qua speaker labels: transcript không có tên người nói khiến AI đoán owner — một dạng ảo giác nguy hiểm vì trông rất hợp lý. Không có nhãn thì đừng để AI gán owner tự động; hãy gán tay.
- Để AI "làm đẹp" quá tay: nếu prompt không cấm tóm tắt, AI cắt gọt mất một yêu cầu quan trọng nói lướt qua. Luôn đối chiếu độ dài đầu ra với đầu vào.
- Quên xin phép ghi âm / dùng công cụ không rõ nơi lưu dữ liệu: một số công cụ transcribe miễn phí lưu và dùng lại dữ liệu của bạn. Với cuộc họp chứa thông tin nhạy cảm, chỉ dùng công cụ được công ty phê duyệt, hoặc transcribe on-premise. Đây là ranh giới giữa tiện lợi và rò rỉ dữ liệu.
Checklist trước khi chuyển sang bóc tách
- [ ] Transcript có nhãn người nói rõ ràng.
- [ ] Đã sửa tên riêng và thuật ngữ nghiệp vụ quan trọng.
- [ ] Đã bỏ nhiễu nhưng KHÔNG mất ý.
- [ ] Đã che/ẩn dữ liệu nhạy cảm nếu dùng AI công cộng.
- [ ] Đã lưu bản gốc để đối chiếu.
Học xong bài này rồi?
Tạo tài khoản miễn phí để lưu lại — lần sau vào là biết ngay đang dở ở đâu,
và học hết khóa thì có chứng chỉ.
Lưu tiến độ của tôi