Cấu hình luồng hội thoại trong ElevenAgents

Cấu hình cách trợ lý của bạn xử lý tình trạng hết thời gian chờ (timeout), ngắt lời và luân phiên lượt nói trong các cuộc hội thoại.

Tổng quan

Các cài đặt luồng hội thoại xác định cách trợ lý xử lý những khoảng lặng của người dùng, việc bị ngắt lời khi đang nói và hành vi luân phiên lượt nói. Những cài đặt này giúp tạo ra các cuộc hội thoại tự nhiên hơn và có thể được tùy chỉnh dựa trên trường hợp sử dụng cụ thể của bạn.

  • Thời lượng hội thoại tối đa: Giới hạn tổng thời gian của mỗi cuộc hội thoại
  • Luân phiên lượt nói sau khoảng lặng: Cấu hình thời gian chờ của trợ lý trong các khoảng lặng
  • Thời gian chờ mềm (Soft timeout): Cung cấp phản hồi âm thanh tự nhiên khi agent cần thời gian suy nghĩ
  • Ngắt lời: Kiểm soát việc người dùng có thể ngắt lời trợ lý khi đang nói hay không
  • Mức độ chủ động chuyển lượt: Điều chỉnh tốc độ phản hồi của trợ lý đối với đầu vào từ người dùng

Thời lượng hội thoại tối đa

Cài đặt Max conversation duration giới hạn tổng thời gian một cuộc hội thoại có thể duy trì trạng thái hoạt động. Giới hạn tổng thể này bắt đầu tính từ khi cuộc hội thoại mới bắt đầu và hoạt động độc lập với các giới hạn thời gian chờ ở cấp độ lượt nói. Giá trị mặc định là 600 giây (10 phút). Bạn có thể thiết lập giá trị trong khoảng từ 60 đến 7.200 giây.

Cấu hình

Trong CLI và API, hãy cấu hình cài đặt này bằng trường conversation_config.conversation.max_duration_seconds.

Cập nhật dashboard

Mở agent của bạn trong dashboard, chuyển đến tab Advanced và điều chỉnh Max conversation duration trong mục Call limits. Lưu lại các thay đổi.

Cập nhật qua CLI

1. Tải cấu hình agent về

elevenlabs agents pull --agent agent_7101k5zvyjhmfg983brhmhkd98n6

2. Chỉnh sửa cấu hình agent

Thiết lập conversation_config.conversation.max_duration_seconds:

{
  "conversation_config": {
    "conversation": {
      "max_duration_seconds": 1200
    }
  }
}

3. Đẩy cấu hình agent lên

elevenlabs agents push --agent agent_7101k5zvyjhmfg983brhmhkd98n6

Cập nhật qua API

Python

from elevenlabs import ElevenLabs

elevenlabs = ElevenLabs()

elevenlabs.conversational_ai.agents.update(
    agent_id="agent_7101k5zvyjhmfg983brhmhkd98n6",
    conversation_config={
        "conversation": {"max_duration_seconds": 1200},
    },
)

TypeScript

import { ElevenLabsClient } from "@elevenlabs/elevenlabs-js";

const elevenlabs = new ElevenLabsClient();

await elevenlabs.conversationalAi.agents.update("agent_7101k5zvyjhmfg983brhmhkd98n6", {
  conversationConfig: {
    conversation: { maxDurationSeconds: 1200 },
  },
});

Các cuộc hội thoại qua tin nhắn WhatsApp có thời gian chờ không hoạt động mặc định là 15 phút, tính từ phản hồi gần nhất của agent. Thời gian chờ này có thể kết thúc cuộc hội thoại tin nhắn trước khi đạt đến thời lượng tối đa đã cấu hình. Các khách hàng doanh nghiệp có nhu cầu về thời gian chờ khác nên liên hệ với bộ phận hỗ trợ qua địa chỉ support@elevenlabs.io.

Luân phiên lượt nói sau khoảng lặng

Cài đặt Take turn after silence xác định thời gian trợ lý chờ đợi trong các khoảng lặng của người dùng trước khi thực hiện lượt nói tiếp theo và yêu cầu phản hồi.

Cấu hình

Giá trị được xác định bằng giây và phải nằm trong khoảng từ 1 đến 30 giây. Trong CLI và API, hãy cấu hình cài đặt này bằng trường conversation_config.turn.turn_timeout.

Cập nhật qua dashboard

Mở agent của bạn trong dashboard, chuyển đến tab Advanced và điều chỉnh giá trị Take turn after silence. Lưu lại các thay đổi.

Cài đặt "Take turn after silence"
Cài đặt "Take turn after silence"

Cập nhật qua CLI

1. Tải cấu hình agent về

elevenlabs agents pull --agent "<agent-name>"

2. Chỉnh sửa file agent_configs/<agent-name>.json

Thiết lập conversation_config.turn.turn_timeout:

{
  "conversation_config": {
    "turn": {
      "turn_timeout": 7
    }
  }
}

3. Đẩy các thay đổi của bạn lên

elevenlabs agents push --agent "<agent-name>"

Cập nhật qua API

Python

from elevenlabs import ElevenLabs

elevenlabs = ElevenLabs()

elevenlabs.conversational_ai.agents.update(
    agent_id="agent_7101k5zvyjhmfg983brhmhkd98n6",
    conversation_config={
        "turn": {"turn_timeout": 7},
    },
)

TypeScript

import { ElevenLabsClient } from "@elevenlabs/elevenlabs-js";

const elevenlabs = new ElevenLabsClient();

await elevenlabs.conversationalAi.agents.update("agent_7101k5zvyjhmfg983brhmhkd98n6", {
  conversationConfig: {
    turn: { turnTimeout: 7 },
  },
});

Chọn khoảng thời gian chờ phù hợp dựa trên trường hợp sử dụng của bạn. Thời gian chờ ngắn hơn giúp cuộc hội thoại phản hồi nhanh hơn nhưng có thể ngắt lời người dùng khi họ cần thêm thời gian để trả lời, khiến cuộc hội thoại trở nên kém tự nhiên.

Các phương pháp tối ưu

  • Đặt thời gian chờ ngắn (5-10 giây) cho các cuộc hội thoại thông thường, nơi cần sự trao đổi qua lại nhanh chóng.
  • Sử dụng thời gian chờ dài hơn (10-30 giây) khi người dùng có thể cần thêm thời gian để suy nghĩ hoặc soạn thảo các câu trả lời phức tạp.
  • Cân nhắc bối cảnh người dùng: Dịch vụ khách hàng có thể phù hợp với thời gian chờ ngắn, trong khi hỗ trợ kỹ thuật có thể cần thời gian chờ dài hơn.

Soft timeout (Thời gian chờ mềm)

Tính năng Soft timeout cung cấp phản hồi âm thanh ngay lập tức khi LLM mất nhiều thời gian hơn dự kiến ​​để tạo câu trả lời. Thay vì sự im lặng gượng gạo trong lúc chờ đợi, agent sẽ nói một cụm từ đệm ngắn gọn như "Hmm..." hoặc "Để tôi suy nghĩ chút..." để duy trì mạch hội thoại tự nhiên.

Tính năng này hữu ích cho:

  • Các truy vấn phức tạp đòi hỏi thời gian xử lý lâu hơn từ LLM.
  • Xử lý độ trễ biến thiên từ các nhà cung cấp LLM.
  • Tạo ra các cuộc hội thoại giống con người hơn với những khoảng nghỉ suy nghĩ tự nhiên.

Cơ chế hoạt động

  1. Khi người dùng nói xong, hệ thống bắt đầu tạo phản hồi từ LLM.
  2. Bộ đếm thời gian bắt đầu chạy dựa trên khoảng thời gian chờ (timeout) đã được cấu hình.
  3. Nếu phản hồi từ LLM đến trước khi hết thời gian chờ, hệ thống sẽ không phát câu đệm (filler message).
  4. Nếu hết thời gian chờ mà LLM vẫn chưa phản hồi:
    • Câu đệm đã cấu hình sẽ được phát ngay lập tức.
    • Agent tiếp tục chờ phản hồi chính thức.
    • Khi có phản hồi, agent sẽ phát toàn bộ nội dung phản hồi từ LLM.

Cơ chế Soft timeout chỉ kích hoạt một lần mỗi lượt hội thoại để tránh phát nhiều câu đệm liên tiếp.

Cấu hình

Cập nhật qua dashboard

Mở agent của bạn trong dashboard, chuyển đến tab Advanced và điều chỉnh cài đặt Soft timeout. Lưu lại các thay đổi.

Cài đặt Soft timeout
Cài đặt Soft timeout

Cập nhật qua CLI

1. Tải cấu hình agent về

elevenlabs agents pull --agent "<agent-name>"

2. Chỉnh sửa file agent_configs/<agent-name>.json

Thiết lập conversation_config.turn.soft_timeout_config:

{
  "conversation_config": {
    "turn": {
      "soft_timeout_config": {
        "timeout_seconds": 3.0,
        "message": "Hhmmmm...yeah.",
        "use_llm_generated_message": false
      }
    }
  }
}

3. Đẩy các thay đổi của bạn lên

elevenlabs agents push --agent "<agent-name>"

Cập nhật qua API

Python

from elevenlabs import ElevenLabs

elevenlabs = ElevenLabs()

elevenlabs.conversational_ai.agents.update(
    agent_id="agent_7101k5zvyjhmfg983brhmhkd98n6",
    conversation_config={
        "turn": {
            "soft_timeout_config": {
                "timeout_seconds": 3.0,
                "message": "Hhmmmm...yeah.",
                "use_llm_generated_message": False,
            },
        },
    },
)

TypeScript

import { ElevenLabsClient } from "@elevenlabs/elevenlabs-js";

const elevenlabs = new ElevenLabsClient();

await elevenlabs.conversationalAi.agents.update("agent_7101k5zvyjhmfg983brhmhkd98n6", {
  conversationConfig: {
    turn: {
      softTimeoutConfig: {
        timeoutSeconds: 3.0,
        message: "Hhmmmm...yeah.",
        useLlmGeneratedMessage: false,
      },
    },
  },
});

Độ dài thời gian chờ

Khoảng thời gian (tính bằng giây) trước khi câu đệm được phát trong lúc chờ phản hồi từ LLM.

Cài đặt Mô tả
Default -1 (bị vô hiệu hóa)
Range 0.5 đến 8.0 giây
Recommended 3.0 giây

Hãy bắt đầu với mốc 3,0 giây - đủ dài để tránh các từ đệm không cần thiết khi phản hồi nhanh, nhưng cũng đủ ngắn để ngăn những khoảng lặng gượng gạo.

Thông điệp cố định

Một cụm từ đệm được thiết lập sẵn, sẽ được phát ra khi kích hoạt cơ chế chờ phản hồi (timeout) ở mức nhẹ.

Cài đặt Mô tả
Default "Hhmmmm...yeah."
Length 1–200 ký tự

Thông báo này hỗ trợ:

  • Language overrides: Tự động dịch sang các ngôn ngữ bổ sung đã được cấu hình cho agent (agent) của bạn.
  • Client overrides: Có thể tùy chỉnh cho từng cuộc gọi thông qua SDK.

Thông báo do LLM tạo

Khi được kích hoạt, hệ thống sẽ tự động tạo một cụm từ đệm phù hợp với ngữ cảnh bằng cách sử dụng một mô hình LLM gọn nhẹ, thay vì sử dụng thông báo cố định.

Cài đặt Mô tả
Default false
Fallback Sử dụng thông báo tĩnh nếu việc tạo thất bại

Hệ thống sử dụng ngữ cảnh cuộc trò chuyện gần đây (tối đa 4 tin nhắn, 1000 ký tự) để tạo ra các từ đệm (filler) phù hợp như “Hmm…”, “Tôi hiểu rồi…”, “Đã rõ…”, “Tôi nắm được rồi…” hoặc “Được thôi…”

Vẫn cần có một tin nhắn dự phòng cố định khi sử dụng các tin nhắn do LLM tạo ra.

Các phương pháp hay nhất

  • Tránh sử dụng các từ ngữ chỉ thời gian trong tin nhắn đệm (ví dụ: “Chờ một chút…”) vì thời gian phản hồi thực tế không thể dự đoán trước.
  • Tắt tính năng Soft Timeout đối với các bot FAQ (câu hỏi thường gặp) có tốc độ phản hồi nhanh và ổn định.

Ngắt lời

Tính năng Interruptions quyết định việc người dùng có thể ngắt lời trợ lý ảo của bạn trong khi nó đang nói hay không.

Cấu hình

Các cài đặt về ngắt lời có thể được cấu hình trong tab Advanced của agent tại mục Client Events.

Để kích hoạt tính năng ngắt lời, hãy đảm bảo rằng Interruption đã được chọn trong phần sự kiện phía client.

Bật tính năng Interruptions

Cho phép ngắt lời
Cho phép ngắt lời

Tắt tính năng Interruptions

Bỏ qua việc ngắt lời
Bỏ qua việc ngắt lời

Hãy tắt tính năng ngắt lời khi việc truyền tải đầy đủ thông tin là yếu tố then chốt, chẳng hạn như các tuyên bố miễn trừ trách nhiệm pháp lý hoặc hướng dẫn an toàn.

Các phương pháp hay nhất cho Interruptions

  • Bật tính năng ngắt lời cho các luồng hội thoại tự nhiên, nơi cần sự đối thoại qua lại.
    Tắt tính năng ngắt lời khi việc truyền tải trọn vẹn tin nhắn là rất quan trọng (ví dụ: các điều khoản và điều kiện, thông tin an toàn).
    Cân nhắc ngữ cảnh sử dụng: dịch vụ khách hàng có thể hưởng lợi từ tính năng ngắt lời, trong khi việc truyền tải thông tin thì có thể không cần thiết.

Mức độ chủ động chuyển lượt (Turn eagerness)

Turn eagerness kiểm soát tốc độ phản hồi của trợ lý ảo đối với đầu vào của người dùng trong cuộc trò chuyện. Cài đặt này xác định mức độ sẵn sàng của trợ lý trong việc chuyển lượt và bắt đầu nói dựa trên các kiểu mẫu giọng nói được phát hiện.

Cách thức hoạt động

Trợ lý ảo hiện có hai cải tiến quan trọng giúp việc chuyển lượt diễn ra tự nhiên hơn:

  1. Tạo phản hồi nhanh hơn - Trợ lý bắt đầu nói ngay khi nhận đủ số từ và dấu phẩy từ mô hình ngôn ngữ, thay vì phải đợi đến khi câu hoàn chỉnh. Điều này giúp giảm độ trễ và tạo ra các cuộc trò chuyện phản hồi nhanh nhạy hơn, đặc biệt là khi trợ lý có những câu trả lời dài.
  2. Có thể tùy chỉnh mức độ chủ động chuyển lượt - Kiểm soát tốc độ trợ lý nhận diện các khoảng dừng hoặc kiểu mẫu giọng nói để coi đó là cơ hội phản hồi.

Cấu hình

Có ba chế độ khả dụng:

  • Eager - Trợ lý phản hồi nhanh chóng với đầu vào của người dùng, tham gia vào cuộc hội thoại ngay khi có cơ hội sớm nhất. Phù hợp nhất cho các cuộc trò chuyện nhịp độ nhanh, nơi coi trọng sự phản hồi tức thì.
  • Normal - Chuyển lượt cân bằng, hoạt động hiệu quả trong hầu hết các tình huống hội thoại. Trợ lý chờ những khoảng nghỉ tự nhiên trong cuộc hội thoại trước khi phản hồi.
  • Patient – Trợ lý chờ lâu hơn trước khi đến lượt mình, giúp người dùng có thêm thời gian để diễn đạt trọn vẹn ý tưởng. Đây là lựa chọn lý tưởng khi cần thu thập thông tin chi tiết hoặc khi người dùng cần thời gian để suy nghĩ và đưa ra câu trả lời.

Cập nhật qua dashboard

Mở trợ lý ảo của bạn trong dashboard, điều hướng đến cài đặt Agent và chọn chế độ phản hồi nhanh mong muốn. Lưu các thay đổi của bạn.

Cập nhật qua giao diện dòng lệnh (CLI)

1. Tải cấu hình agent về

elevenlabs agents pull --agent "<agent-name>"

2. Chỉnh sửa file agent_configs/<agent-name>.json

Đặt giá trị cho conversation_config.turn.turn_eagerness là một trong các tùy chọn: "patient", "normal" hoặc "eager":

{
  "conversation_config": {
    "turn": {
      "turn_eagerness": "normal"
    }
  }
}

3. Đẩy các thay đổi của bạn lên

elevenlabs agents push --agent "<agent-name>"

Cập nhật qua API

Python

from elevenlabs import ElevenLabs

elevenlabs = ElevenLabs()

elevenlabs.conversational_ai.agents.update(
    agent_id="agent_7101k5zvyjhmfg983brhmhkd98n6",
    conversation_config={
        "turn": {"turn_eagerness": "normal"},
    },
)

TypeScript

import { ElevenLabsClient } from "@elevenlabs/elevenlabs-js";

const elevenlabs = new ElevenLabsClient();

await elevenlabs.conversationalAi.agents.update("agent_7101k5zvyjhmfg983brhmhkd98n6", {
  conversationConfig: {
    turn: { turnEagerness: "normal" },
  },
});

Chế độ phản hồi nhanh đặc biệt hiệu quả khi kết hợp với quy trình làm việc. Bạn có thể điều chỉnh động khả năng phản hồi của trợ lý dựa trên ngữ cảnh - giúp trợ lý phản hồi nhanh hơn trong các cuộc trò chuyện thông thường hoặc chờ lâu hơn khi thu thập thông tin nhạy cảm như số điện thoại hoặc địa chỉ email.

Các phương pháp tốt nhất cho Turn eagerness

  • Sử dụng chế độ Eager cho các tình huống dịch vụ khách hàng, nơi phản hồi nhanh giúp cải thiện trải nghiệm người dùng
  • Sử dụng chế độ Patient khi thu thập thông tin có cấu trúc như số điện thoại, địa chỉ hoặc địa chỉ email
  • Sử dụng chế độ Normal làm mặc định cho các luồng hội thoại chung
  • Kết hợp với quy trình làm việc để điều chỉnh động chế độ phản hồi nhanh dựa trên ngữ cảnh hội thoại
  • Kiểm tra các cài đặt khác nhau với trường hợp sử dụng cụ thể của bạn để tìm ra sự cân bằng tối ưu

Các cấu hình đề xuất

Dịch vụ khách hàng

Thời gian chờ ngắn hơn (5-10 giây) để đảm bảo tương tác phản hồi nhanh

  • Cho phép ngắt lời để khách hàng có thể đặt câu hỏi
  • Mức độ sẵn sàng chuyển lượt cao (Eager) để tạo ra cuộc trò chuyện linh hoạt, nhạy bén

Thu thập thông tin

Thời gian chờ vừa phải (10-15 giây) để người dùng có thời gian thu thập thông tin

  • Cho phép ngắt lời để duy trì luồng trò chuyện tự nhiên
  • Mức độ sẵn sàng chuyển lượt thấp (Patient) khi thu thập số điện thoại, địa chỉ hoặc địa chỉ email

Thông báo pháp lý

Thời gian chờ dài hơn (15-30 giây) để cho phép các phản hồi phức tạp

  • Tắt tính năng ngắt lời để đảm bảo truyền tải đầy đủ thông tin pháp lý
  • Mức độ sẵn sàng chuyển lượt ở mức bình thường (Normal) để duy trì nhịp độ ổn định

Công nghệ giáo dục (EdTech) có tính tương tác hội thoại

Thời gian chờ dài hơn (10-30 giây) để có thời gian suy nghĩ và soạn thảo câu trả lời

  • Cho phép ngắt lời để học sinh có thể đặt câu hỏi
  • Mức độ sẵn sàng chuyển lượt thấp (Patient) để học sinh có đủ thời gian phản hồi
Thứ Hai, 05/10/2026 14:40
5 ★ 1 👨 25
Xác thực tài khoản!

Theo Nghị định 147/2024/ND-CP, bạn cần xác thực tài khoản trước khi sử dụng tính năng này. Chúng tôi sẽ gửi mã xác thực qua SMS hoặc Zalo tới số điện thoại mà bạn nhập dưới đây:

Số điện thoại chưa đúng định dạng!
Số điện thoại này đã được xác thực!
Bạn có thể dùng Sđt này đăng nhập tại đây!
Lỗi gửi SMS, liên hệ Admin
0 Bình luận
Sắp xếp theo