GPT-6 Astra is now live on CometAPI →
ai-model/Nghiên cứu CometAPI

Hướng dẫn định giá & di chuyển cho API Gemini 3.6 Flash (2026)

Gemini 3.6 Flash có giá $1.50/M cho đầu vào và $7.50/M cho đầu ra. Xem bảng giá API, các điểm chuẩn, các thay đổi khi chuyển đổi, các ví dụ Python và hướng dẫn cho môi trường sản xuất.

CometAPI
Mia MarenĐội ngũ nghiên cứu mô hình AI và API
Đã cập nhật Sep 3, 2026 17 phút đọc
Hướng dẫn định giá & di chuyển cho API Gemini 3.6 Flash (2026)
Sử dụng mẫu này

Thực hiện API call đầu tiên.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR

Gemini 3.6 Flash có giá $1.50/M đầu vào và $7.50/M đầu ra, với giá đầu ra thấp hơn và hiệu năng lập trình cùng tác nhân tốt hơn theo báo cáo so với Gemini 3.5 Flash. Trong môi trường sản xuất, dùng 3.6 Flash cho suy luận phức tạp và tác nhân; định tuyến các khối lượng đơn giản, lưu lượng lớn sang Gemini 3.5 Flash-Lite rẻ hơn.

Gemini 3.6 Flash không chỉ là một bản cập nhật model-ID nữa.

Đối với các nhà phát triển đã dùng Gemini 3.5 Flash, thay đổi lớn hơn nằm ở kinh tế. Google giữ nguyên giá đầu vào $1.50 cho mỗi triệu token, giảm giá đầu ra từ $9.00 xuống $7.50, và báo cáo hiệu năng tốt hơn trên một số benchmark về lập trình và tác nhân.

Câu hỏi thực tế là liệu những cải tiến đó có đủ lớn để biện minh cho việc chuyển khối lượng sản xuất hay không.

Câu trả lời phụ thuộc vào khối lượng công việc. Tác nhân lập trình, phân tích đa phương thức và sử dụng công cụ nhiều bước có thể hưởng lợi nhiều hơn so với trích xuất hay phân loại đơn giản. Việc di chuyển cũng đòi hỏi một vài kiểm tra tương thích API dễ bị bỏ qua nếu bạn chỉ đổi tên model.

Hướng dẫn này bao gồm giá API Gemini 3.6 Flash, quyền truy cập free-tier, kết quả benchmark, thay đổi khi di chuyển, ví dụ Python, và những gì cần kiểm thử trước khi chuyển lưu lượng sản xuất.

Gemini 3.6 Flash là gì?

Gemini 3.6 Flash là model Flash mới hơn của Google dành cho lập trình, suy luận đa phương thức và quy trình tác nhân nhiều bước. Ra mắt ngày 21 tháng 7 năm 2026, nó được thiết kế cho các khối lượng sản xuất cần khả năng suy luận và tác nhân mạnh hơn trong khi vẫn nằm trong phân hạng Flash của Google.

Thông số chính gồm:

Hạng mụcGemini 3.6 Flash
Model IDgemini-3.6-flash
Giá đầu vào chuẩn$1.50 / 1M tokens
Giá đầu ra chuẩn$7.50 / 1M tokens
Đầu vào cached chuẩn$0.15 / 1M tokens
Mức tư duy mặc địnhmedium
Ngữ cảnh đầu vào1,048,576 tokens
Đầu ra tối đa65,536 tokens
Đầu vàoVăn bản, hình ảnh, video, âm thanh, PDF
Đầu raVăn bản
Phù hợp nhất choLập trình, suy luận đa phương thức, tác nhân phức tạp

Google định vị Gemini 3.6 Flash cho các khối lượng như lập trình, suy luận không gian và đa phương thức, và các tác vụ tác nhân nhiều bước.

Model cũng hỗ trợ các tính năng như gọi hàm (function calling), đầu ra có cấu trúc, thực thi mã, bộ nhớ đệm ngữ cảnh (context caching), File Search, ngữ cảnh URL, grounding với Google Search, và grounding với Google Maps.

Bạn có thể xem thông số mới nhất và hướng dẫn di chuyển trong hướng dẫn model Gemini mới nhất của Google.

Với các nhà phát triển đến từ thế hệ trước, hướng dẫn API Gemini 3.5 Flash của CometAPI cung cấp cơ sở tích hợp hữu ích.

API Gemini 3.6 Flash tốn bao nhiêu?

Gemini 3.6 Flash có giá $1.50 mỗi triệu token đầu vào và $7.50 mỗi triệu token đầu ra trên gói trả phí Standard của Google.

So với Gemini 3.5 Flash, giá đầu vào không đổi, trong khi giá đầu ra giảm từ $9.00 xuống $7.50 mỗi triệu token - giảm 16.7%.

Google cũng cung cấp xử lý Batch, Flex và Priority.

Tầng Gemini 3.6 FlashĐầu vào / 1MĐầu vào cached / 1MĐầu ra / 1M
Standard$1.50$0.15$7.50
Batch$0.75$0.075$3.75
Flex$0.75$0.075$3.75
Priority$2.70$0.27$13.50

Quan trọng:** Token tư duy (thinking tokens) được tính phí theo mức giá token đầu ra. Vì vậy, một phản hồi hiển thị ngắn có thể tiêu thụ nhiều token đầu ra tính phí hơn so với độ dài câu trả lời cuối cùng gợi ý.

Bộ nhớ đệm ngữ cảnh cũng có thể tạo khác biệt đáng kể cho ứng dụng thường xuyên gửi cùng một system prompt lớn, ngữ cảnh kho mã, tập tài liệu, hoặc lịch sử hội thoại.

Trên gói trả phí Standard, đầu vào cached của Gemini 3.6 Flash có giá $0.15 cho mỗi triệu token, so với $1.50 cho đầu vào thường.

Ví dụ: 15,000 Input Tokens + 8,000 Output Tokens

Xét một tác vụ dùng 15,000 token đầu vào và 8,000 token đầu ra.

ModelChi phí ước tính
Gemini 3.5 Flash$0.0945
Gemini 3.6 Flash với cùng khối lượng token$0.0825
Gemini 3.6 Flash với ít hơn 17% token đầu ra$0.0723
Gemini 3.5 Flash-Lite với cùng khối lượng$0.0245

Với mức sử dụng token giống hệt, Gemini 3.6 Flash rẻ hơn khoảng 12.7% so với Gemini 3.5 Flash trong ví dụ này.

Google cũng báo cáo Gemini 3.6 Flash dùng ít hơn 17% token đầu ra trên Artificial Analysis Index. Nếu một khối lượng sản xuất tái hiện được mức giảm đó, khoản tiết kiệm mô phỏng trong ví dụ này sẽ tăng lên khoảng 23.5%.

Google cũng báo cáo giảm token đầu ra lên tới 65% trên DeepSWE. Những con số này đo các khối lượng khác nhau và không nên hoán đổi: 17% là cho Artificial Analysis Index, còn 65% đến từ một benchmark lập trình cụ thể.

Công thức tính chi phí token cơ bản là:

Request cost =
(input tokens x input price + output tokens x output price) / 1,000,000

Đối với tác nhân, chi phí thực tế rộng hơn:

Total task cost =
initial model call
+ retries
+ fallback calls
+ paid tools
+ grounding or search costs

Đó là lý do model rẻ nhất theo token không phải lúc nào cũng là model rẻ nhất để hoàn thành một tác vụ.

Gemini 3.6 Flash có miễn phí không?

Có. Bảng giá Gemini Developer API hiện tại của Google liệt kê quyền truy cập Free Tier cho mức sử dụng Standard của Gemini 3.6 Flash.

Free-tier không đồng nghĩa năng lực sản xuất không giới hạn. Giới hạn API phụ thuộc vào dự án và tầng sử dụng, vì vậy nhà phát triển nên kiểm tra giới hạn tốc độ áp dụng cho dự án của mình thay vì dựa vào con số yêu cầu mỗi phút cố định từ bài viết bên thứ ba.

Cho kế hoạch sản xuất, hãy dùng bảng giá Gemini API hiện tại và tài liệu giới hạn tốc độ của Google khi ước tính năng lực.

Nhà phát triển có thể truy cập Gemini 3.6 Flash qua Gemini API và Google AI Studio. Các đội dùng quy trình đa model hợp nhất cũng có thể thử model qua trang model Gemini 3.6 Flash của CometAPI.

Gemini 3.6 Flash so với Gemini 3.5 Flash như thế nào?

Kết quả công bố của Google cho thấy cải thiện lớn nhất ở lập trình, thực thi tác nhân, sử dụng máy tính và công việc tri thức.

BenchmarkGemini 3.6 FlashGemini 3.5 FlashThay đổi
DeepSWE49.00%37.00%+12.0 điểm
MLE-Bench63.90%49.70%+14.2 điểm
OSWorld-Verified83.00%78.40%+4.6 điểm
GDPval-AA v21,4211,34972

Google cũng cho biết Gemini 3.6 Flash hoàn thành các quy trình nhiều bước với ít bước suy luận, ít lượt hội thoại và ít lần gọi công cụ hơn so với Gemini 3.5 Flash.

Công ty báo cáo:

  • Ít hơn 17% token đầu ra trên Artificial Analysis Index.
  • Ít hơn tới 65% token đầu ra trên DeepSWE.
  • Ít chỉnh sửa mã không mong muốn và vòng lặp thực thi hơn.
  • Cải thiện suy luận đa phương thức và không gian.

Kết quả gốc có trong thông báo ra mắt Gemini 3.6 Flash của Google.

Những benchmark này khiến 3.6 Flash trở thành ứng viên mạnh để đánh giá, đặc biệt với các khối lượng mà một yêu cầu có thể biến thành nhiều vòng suy luận, gọi công cụ và sửa lỗi.

Tuy nhiên, chúng không nên thay thế việc kiểm thử trên ứng dụng của chính bạn.

Google cũng lưu ý rằng 3.6 Flash có thể thực hiện nhiều kiểm tra theo lập trình ở bước đầu trước khi thay đổi mã. Trên một kho mã lớn, điều đó có thể cải thiện độ chính xác. Trên một chỉnh sửa frontend phạm vi hẹp, nó có thể chỉ thêm thăm dò không cần thiết.

Ranh giới tệp rõ ràng, tiêu chí chấp nhận và hướng dẫn triển khai vẫn rất quan trọng.

Gemini 3.6 Flash vs Gemini 3.5 Flash-Lite: Bạn nên dùng model nào?

Khi bạn đã quyết định Gemini 3.6 Flash đáng để thử nghiệm, câu hỏi tiếp theo là liệu mỗi yêu cầu có thực sự cần nó hay không.

Với nhiều hệ thống sản xuất, câu trả lời sẽ là không.

Gemini 3.5 Flash-Lite rẻ hơn đáng kể và có thể là mặc định tốt hơn cho các khối lượng dự đoán được, lưu lượng lớn.

Hạng mụcGemini 3.6 FlashGemini 3.5 Flash-Lite
Giá đầu vào chuẩn$1.50 / 1M tokens$0.30 / 1M tokens
Giá đầu ra chuẩn$7.50 / 1M tokens$2.50 / 1M tokens
Đầu vào cached chuẩn$0.15 / 1M tokens$0.03 / 1M tokens
Mức tư duy mặc địnhmediumminimal
Phù hợp nhất choSuy luận phức tạp, lập trình, tác nhânTrích xuất, định tuyến, phân loại

Với giá Standard, Flash-Lite rẻ hơn 5× ở đầu vào và 3× ở đầu ra so với Gemini 3.6 Flash.

Bắt đầu với Gemini 3.5 Flash-Lite cho:

  • Phân loại
  • Định tuyến yêu cầu
  • Trích xuất JSON và cấu trúc
  • Xử lý tài liệu
  • Chuyển đổi dữ liệu
  • Dịch thuật ở quy mô lớn
  • Tiểu tác nhân nhẹ
  • Tác vụ lặp lại lưu lượng lớn

Một chiến lược định tuyến thực tiễn có thể như sau:

Khối lượngĐịnh tuyến đầu tiênLeo thang
Phân loại hoặc định tuyếnGemini 3.5 Flash-Lite3.6 Flash sau khi xác thực thất bại
Trích xuất có cấu trúcGemini 3.5 Flash-Lite3.6 Flash cho tài liệu phức tạp
Tiểu tác nhân nhẹGemini 3.5 Flash-LiteTăng mức tư duy hoặc dùng 3.6 Flash
Lập trình nhiều tệpGemini 3.6 FlashFallback mạnh hơn nếu chưa giải quyết
Quy trình công cụ phức tạpGemini 3.6 FlashFallback sau khi công cụ hoặc xác thực lỗi
Suy luận đa phương thứcGemini 3.6 FlashFallback theo tác vụ cụ thể

Với lưu lượng sản xuất hỗn hợp, chỉ số hữu ích hơn là:

Cost per successful task =
(model calls + retries + tools + fallbacks) / accepted tasks

Một lần gọi rẻ ban đầu bớt hấp dẫn nếu nó thất bại nhiều lần và cuối cùng vẫn cần model mạnh hơn.

Chiều ngược lại cũng quan trọng. Không có nhiều lý do để gửi hàng triệu yêu cầu phân loại có thể dự đoán được đến Gemini 3.6 Flash nếu Flash-Lite đã đáp ứng độ chính xác yêu cầu.

Với các ứng dụng cần định tuyến kiểu này, xem hướng dẫn gọi nhiều model AI qua một base URL tương thích OpenAI.

Có gì thay đổi khi di chuyển sang Gemini 3.6 Flash?

Chuyển từ Gemini 3.5 Flash sang Gemini 3.6 Flash không chỉ là đổi model ID.

Nhà phát triển nên xem lại năm khu vực trước khi chuyển lưu lượng sản xuất: tham số sampling bị loại bỏ, điều khiển tư duy (thinking), candidate_count, điền trước lượt của mô hình, và trạng thái gọi hàm.

1. Gỡ bỏ temperature, top_ptop_k

Google đã loại bỏ các điều khiển sampling này cho Gemini 3.6 Flash và Gemini 3.5 Flash-Lite:

generation_config = {
    "temperature": 0.7,
    "top_p": 0.9,
    "top_k": 40,
}

Các model mới hiện bỏ qua những tham số này. Google cho biết các thế hệ Gemini tương lai có thể trả HTTP 400 khi chúng được cung cấp.

Với các định dạng đầu ra có thể dự đoán, hãy dùng hướng dẫn hệ thống rõ ràng hơn và đầu ra có cấu trúc.

2. Thay thinking_budget bằng thinking_level

Gemini 3.6 Flash mặc định medium cho tư duy.

Hướng dẫn di chuyển của Google khuyến nghị chuyển từ cấu hình số thinking_budget sang thinking_level.

Gemini 3.5 Flash-Lite mặc định minimal, phù hợp cho nhiều khối lượng trích xuất, phân loại và định tuyến lưu lượng lớn.

Nên thử mức tư duy cao hơn khi tác vụ liên quan đến suy luận nhiều bước, thực thi mã, hoặc sử dụng công cụ.

3. Gỡ bỏ candidate_count

Google liệt kê candidate_count là không được hỗ trợ trong Gemini 3.x.

Điều này dễ bị bỏ qua khi nhiều model dùng chung cấu hình sinh. Hãy gỡ bỏ trước khi di chuyển yêu cầu sản xuất.

4. Dừng điền trước lượt của mô hình

Yêu cầu không còn được phép kết thúc bằng lượt model không rỗng.

Ứng dụng cũ có thể dùng payload như:

{
  "contents": [
    {
      "role": "user",
      "parts": [{"text": "Translate 'Hello world' to Spanish."}]
    },
    {
      "role": "model",
      "parts": [{"text": "Translation:"}]
    }
  ]
}

Mẫu đó giờ có thể trả HTTP 400.

Nếu trước đây bạn dùng điền trước để ép định dạng câu trả lời, hãy chuyển yêu cầu đó vào system_instruction hoặc dùng đầu ra có cấu trúc.

5. Kiểm thử lại gọi hàm và trạng thái đa lượt

Tác nhân sử dụng công cụ cần kiểm thử di chuyển riêng.

Google khuyến nghị dùng previous_interaction_id cho trạng thái đa lượt phía máy chủ trong Interactions API.

Khi trả về kết quả hàm, hãy giữ cả tên hàm và ID lệnh gọi ban đầu:

final_interaction = client.interactions.create(
    model="gemini-3.6-flash",
    previous_interaction_id=interaction.id,
    tools=tools,
    input=[
        {
            "type": "function_result",
            "name": step.name,
            "call_id": step.id,
            "result": [
                {
                    "type": "text",
                    "text": json.dumps(result),
                }
            ],
        }
    ],
)

Ứng dụng dùng generateContent cũng nên xác minh payload FunctionResponse và theo dõi lỗi gọi công cụ sau khi di chuyển.

Xem hướng dẫn di chuyển model mới nhấttài liệu function calling của Google để biết chi tiết triển khai hiện tại.

Gọi Gemini 3.6 Flash trong Python như thế nào?

Cài đặt hoặc cập nhật SDK GenAI của Google:

pip install -U google-genai

Đặt API key:

export GEMINI_API_KEY="your-api-key"

Sau đó gọi Gemini 3.6 Flash:

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    model="gemini-3.6-flash",
    input=(
        "Review this migration plan and list the three "
        "highest-risk compatibility issues."
    ),
)

print(interaction.output_text)

Với tác vụ cần nhiều suy luận hơn, cấu hình mức tư duy:

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    model="gemini-3.6-flash",
    input="Analyze this multi-step debugging problem.",
    generation_config={
        "thinking_level": "medium",
    },
)

print(interaction.output_text)

Khác biệt di chuyển chính có thể tóm tắt như:

# Older shared configuration
old_config = {
    "temperature": 0.2,
    "top_p": 0.9,
    "top_k": 40,
    "candidate_count": 1,
    "thinking_budget": 4096,
}

# Gemini 3.6 Flash
new_config = {
    "thinking_level": "medium",
}

Đừng cho rằng mức tư duy cao hơn luôn tốt hơn. Hãy đo độ trễ, mức tiêu thụ token và tỷ lệ hoàn thành trên tác vụ của bạn.

Nên kiểm thử Gemini 3.6 Flash như thế nào trước khi đưa vào sản xuất?

Bạn không cần một bộ benchmark công khai lớn để quyết định Gemini 3.6 Flash có phù hợp trong ngăn xếp sản xuất của bạn hay không.

Điểm khởi đầu tốt hơn là 30–50 tác vụ gần đây giống lưu lượng thực tế của bạn.

Bao gồm hỗn hợp:

  1. Lập trình và gỡ lỗi
  2. Sử dụng công cụ nhiều bước
  3. Tài liệu đa phương thức
  4. Trích xuất dữ liệu
  5. Phân loại và định tuyến

Chạy cùng đầu vào qua:

  • Model sản xuất hiện tại của bạn
  • Gemini 3.6 Flash
  • Gemini 3.5 Flash-Lite

Giữ nguyên prompt, công cụ, bộ kiểm định và tiêu chí chấp nhận.

Theo dõi:

  • Token đầu vào
  • Token đầu ra và token tư duy
  • Độ trễ
  • Lần gọi công cụ
  • Lần thử lại (retries)
  • Lỗi gọi hàm
  • Tỷ lệ vượt qua validator
  • Thời gian chỉnh sửa của con người
  • Thành công cuối cùng của tác vụ

Sau đó so sánh tổng chi phí cần để tạo ra kết quả được chấp nhận.

Một yêu cầu lập trình tốn $0.08 và thành công ngay lần đầu có thể rẻ hơn yêu cầu $0.02 thất bại hai lần và cuối cùng phải leo thang.

Đồng thời, trả giá Gemini 3.6 Flash cho một tác vụ phân loại đơn giản là vô nghĩa nếu Flash-Lite xử lý ổn định.

Mục tiêu không phải tìm một model cho mọi yêu cầu. Đó là dùng model mạnh hơn chỉ ở nơi năng lực bổ sung thực sự thay đổi kết quả.

Nhà phát triển có thể so sánh Gemini 3.6 FlashGemini 3.5 Flash-Lite qua CometAPI bằng cùng một bộ đánh giá.

FAQ

API Gemini 3.6 Flash có giá bao nhiêu?

Mức trả phí Standard của Google là $1.50 mỗi triệu token đầu vào và $7.50 mỗi triệu token đầu ra. Đầu vào cached Standard có giá $0.15/M. Batch và Flex có giá $0.75/M đầu vào và $3.75/M đầu ra.

Gemini 3.6 Flash có miễn phí không?

Có. Bảng giá Gemini Developer API hiện tại của Google liệt kê Free Tier cho mức sử dụng Standard của Gemini 3.6 Flash. Quyền truy cập miễn phí vẫn chịu giới hạn tốc độ theo dự án và tầng sử dụng.

Gemini 3.6 Flash đã sẵn sàng chung (GA) chưa?

Có. Google phát hành gemini-3.6-flash ngày 21 tháng 7 năm 2026 và liệt kê nó là model sản xuất trong tài liệu Gemini API.

Cửa sổ ngữ cảnh của Gemini 3.6 Flash là gì?

Gemini 3.6 Flash hỗ trợ tối đa 1,048,576 token đầu vào và 65,536 token đầu ra. Model nhận văn bản, hình ảnh, video, âm thanh và PDF đầu vào, và xuất văn bản.

Gemini 3.6 Flash có rẻ hơn Gemini 3.5 Flash không?

Rẻ hơn cho token đầu ra. Cả hai model đều có giá $1.50/M token đầu vào chuẩn, trong khi Gemini 3.6 Flash giảm giá đầu ra từ $9.00/M xuống $7.50/M.

Tôi nên dùng Gemini 3.6 Flash hay Gemini 3.5 Flash-Lite?

Dùng Gemini 3.6 Flash khi chất lượng lập trình, suy luận đa phương thức, hoặc thực thi tác nhân phức tạp có thể giảm lỗi và lần thử lại. Bắt đầu với Flash-Lite cho trích xuất, phân loại, định tuyến lưu lượng lớn và các khối lượng dự đoán được nơi chi phí thấp quan trọng hơn.

Tôi nên thay đổi gì trước khi di chuyển sang Gemini 3.6 Flash?

Gỡ temperature, top_p, top_kcandidate_count; thay thinking_budget bằng thinking_level; bỏ điền trước lượt của mô hình; và kiểm thử lại gọi hàm cùng quản lý trạng thái đa lượt.

Kết luận

Gemini 3.6 Flash đáng để benchmark nếu bạn đã dùng Gemini 3.5 Flash cho lập trình, công việc đa phương thức, hoặc quy trình tác nhân.

Giá đầu ra thấp hơn, và kết quả ban đầu của Google cho thấy một số khối lượng có thể cần ít token và ít bước thực thi hơn. Với tác nhân thường xuyên suy luận, gọi công cụ và thử lại thao tác thất bại, những khoản tiết kiệm đó có thể quan trọng hơn chênh lệch giá tiêu đề.

Nhưng điều đó không có nghĩa mọi yêu cầu đều nên chuyển sang 3.6 Flash.

Gemini 3.5 Flash-Lite rẻ hơn đáng kể và có thể là tất cả những gì bạn cần cho công việc có thể dự đoán như trích xuất, phân loại và định tuyến.

Chiến lược sản xuất tốt hơn là dùng mỗi model ở nơi có ý nghĩa kinh tế: Flash-Lite cho tác vụ đơn giản, lưu lượng lớn; 3.6 Flash ở nơi khả năng suy luận mạnh hơn có thể tăng cơ hội hoàn thành đúng ngay lần đầu.

Sau đó đo chỉ số thực sự quan trọng - tổng chi phí để có một câu trả lời được chấp nhận.

Để so sánh cả hai model qua cùng quy trình, xem trang model Gemini 3.6 Flashtrang model Gemini 3.5 Flash-Lite trên CometAPI, hoặc xem các tuyến model hiện tại trên trang giá CometAPI.

Tiếp tục học

Kết nối bài viết này với quyết định tiếp theo.

Xem tất cả chủ đề
Được xuất bản Jul 22, 2026
Cập nhật lần cuối Sep 3, 2026
429 lượt xem
Đã được xem xét về độ rõ ràng, ghi nguồn và thuật ngữ API hiện tại.

Sẵn sàng giảm 20% chi phí phát triển AI?

Bắt đầu miễn phí trong vài phút. Bao gồm tín dụng dùng thử miễn phí. Không cần thẻ tín dụng.

Đọc thêm