Bỏ qua đến nội dung chính

What is thinking?

📖 Nội dung bài học

Video

Tư duy là gì?

Một số tác vụ cần nhiều hơn là một câu trả lời nhanh. Claude có thể tự giải quyết vấn đề trước khi phản hồi — một tính năng gọi là tư duy mở rộng (extended thinking). Trong bài học này, chúng ta sẽ tìm hiểu tư duy mở rộng là gì, cách bật tính năng này và khi nào nó thực sự hữu ích.

Đây là lỗi phổ biến (failure mode) mà chúng ta muốn tránh: Khi bạn hỏi mô hình một câu hỏi gồm nhiều bước và yêu cầu trả lời ngay lập tức, nó có thể tự tin đưa ra đáp án sai:

Sơ đồ một ứng dụng gửi câu hỏi nhiều bước về quả táo cho mô hình, mô hình ngay lập tức trả lời sai: bạn sẽ có 6,5 quả táo

Tư duy mở rộng (extended thinking) là gì?

Tư duy mở rộng cho phép Claude lập luận từng bước trước khi đưa ra phản hồi cuối cùng. Khi được kích hoạt, Claude sẽ tạo ra các token lập luận nội bộ — thường được gọi là chuỗi suy nghĩ (chain of thought) — rồi mới đưa ra câu trả lời. Quá trình lập luận này không bị ẩn đi: bạn có thể nhìn thấy nó trong phản hồi ngay cạnh văn bản cuối cùng.

Tư duy thích ứng (adaptive thinking) trên Opus 4.7

Với Opus 4.7, tính năng tư duy là thích ứng (adaptive). Bạn không cần chọn giới hạn token (token budget). Bạn chỉ cần bật nó lên, và Claude sẽ tự động quyết định khi nào cần tư duy và tư duy bao nhiêu.

Để kiểm soát mức độ tư duy của Claude, hãy dùng tham số effort. Một lưu ý quan trọng: tham số này nằm bên trong output_config, chứ không phải bên cạnh block thinking. Các mức độ gồm:

  • low
  • medium
  • high (mặc định)
  • xhigh (rất cao)
  • max

Khi nào nên dùng (và khi nào nên bỏ qua)

Tư duy mở rộng giúp ích cho:

  • Toán học và logic nhiều bước
  • Debug code
  • Phân tích quy định pháp lý
  • Bất kỳ tác vụ nào cần cân nhắc đánh đổi hoặc so sánh các lựa chọn

Slide hiển thị các trường hợp sử dụng tư duy mở rộng: toán học, logic nhiều bước, debug code, phân tích quy định và so sánh phức tạp

Hãy bỏ qua tính năng này đối với các tác vụ phân loại đơn giản, trích xuất thông tin hoặc tạo code mẫu (boilerplate). Với những tác vụ đó, nó chỉ làm tăng độ trễ (latency) và chi phí mà không thực sự cải thiện kết quả.

Trải nghiệm thực tế

Hãy xem cách hoạt động của nó. Dưới đây là một vòng lặp agent với một tool thời tiết. Chúng ta sẽ yêu cầu Claude lên kế hoạch cho một chuyến đi phượt xuất phát từ San Francisco — gồm hai điểm dừng, có cân nhắc đến yếu tố thời tiết và thời gian lái xe. Đây là một bài toán đánh đổi thực tế, kiểu câu hỏi mà tư duy mở rộng sẽ phát huy tối đa giá trị.

import anthropic

client = anthropic.Anthropic()

weather_tool = {
    "name": "get_weather",
    "description": "Get the current weather for a city.",
    "input_schema": {
        "type": "object",
        "properties": {
            "city": {"type": "string", "description": "City name"}
        },
        "required": ["city"],
    },
}

response = client.messages.create(
    model="claude-opus-4-7",
    max_tokens=16000,
    thinking={"type": "adaptive"},
    output_config={"effort": "high"},  # low | medium | high | xhigh | max
    tools=[weather_tool],
    messages=[
        {
            "role": "user",
            "content": "Plan a road trip out of San Francisco with two stops, "
                       "weighing weather and drive time.",
        }
    ],
)

Khi chạy đoạn code này, kết quả trả về sẽ thú vị hơn bình thường. Bạn sẽ thấy các thinking block nơi Claude phân tích các yếu tố đánh đổi, tiếp theo là các lượt gọi tool (tool call) để kiểm tra thời tiết từng thành phố, và cuối cùng là một text block chứa gợi ý thực tế.

Quá trình lập luận được hiển thị rõ ràng — đó chính là điểm mấu chốt.

Tại sao điều này lại quan trọng trong môi trường production

Trong một ứng dụng chạy thực tế (production), đây là điểm khác biệt giữa một agent chỉ tìm lỗi đơn lẻ và một agent biết kết nối các vấn đề lại với nhau. Hãy lấy ví dụ về một ứng dụng kiểm duyệt tuân thủ (compliance review): việc bật tư duy thích ứng cho lượt gọi tự động kiểm duyệt cho phép agent lập luận xuyên suốt các phần của báo cáo — phát hiện ra những điểm mâu thuẫn như thông số tải trọng gió ở phần ba xung đột với thông số vật liệu ở một phần khác trong tài liệu.

Giao diện ứng dụng kiểm duyệt tuân thủ với hộp kiểm Thorough review được bật, chạy tính năng tự động kiểm duyệt để đối chiếu chéo các phát hiện giữa các phần của báo cáo

Tóm tắt

  • Tư duy mở rộng (extended thinking) giúp Claude có không gian để lập luận trước khi trả lời, và quá trình lập luận này hiển thị rõ ràng trong phản hồi.
  • Với Opus 4.7, hãy bật tính năng này bằng thinking: {"type": "adaptive"} — không cần giới hạn token; Claude sẽ tự quyết định khi nào cần tư duy và tư duy bao nhiêu.
  • Điều chỉnh độ sâu bằng tham số effort bên trong output_config: low, medium, high (mặc định), xhigh, hoặc max.
  • Hãy dùng tính năng này cho các bài toán khó, đòi hỏi nhiều sự cân nhắc đánh đổi. Bỏ qua đối với các tác vụ đơn giản — vì nó sẽ chỉ làm tốn thêm độ trễ và token.

🎬 Bản ghi video

Source video: 4SunBsMGRwA

Không có transcript — xem phần nội dung bài học bên trên.

🔁 Bài học liên quan

📚 Nguồn & ghi nhận

Góp ý / Báo lỗiPhát hiện sai sót hoặc có ý tưởng cải thiện?