Chọn Auto, TokenLab Verified hoặc Official cho mỗi yêu cầu, với giá được hiển thị ngay từ đầu.Xem có gì mới

StepFun: Step 3.7 Flash

Mô hình StepFun flash mới hơn dành cho các tác nhân nhanh hơn, lập trình và các câu lệnh đa phương thức.
So sánh mô hình
step-3.7-flash
Sẵn sàngStepFunTrò chuyện
Đầu vào / Đầu ra
$0.20 / $1.15
Ngữ cảnh
256K
Độ dài đầu ra tối đa
256K
Phương thức
Trò chuyện
Khả năng
Sử dụng công cụBộ nhớ đệm Prompt

Về Step 3.7 Flash

Step 3.7 Flash là mô hình sparse mixture-of-experts của StepFun dành cho các đại lý lập trình, quy trình tìm kiếm và công việc năng suất với ngữ cảnh dài. Thẻ mô hình mô tả thiết kế 198 tỷ tham số với khoảng 11 tỷ tham số hoạt động mỗi token, và ba cấp độ suy luận có thể lựa chọn. Nó kế thừa Step 3.5 Flash, bổ sung hỗ trợ đầu ra có cấu trúc và được phát hành theo giấy phép Apache 2.0.

Ưu điểm

  • Tìm kiếm và xác minh: thẻ mô hình mô tả một đại lý kiểm tra các tuyên bố dựa trên các nguồn được truy xuất và chống lại các trang web gây nhiễu (adversarial).
  • Độ tin cậy của đại lý: thẻ mô hình báo cáo đạt 67,1 trên ClawEval-1.1, một bài kiểm tra các quy trình đa lượt với các bẫy gây nhiễu.
  • Công việc kho lưu trữ: nó đạt 56,3 điểm trên SWE-Bench Pro, đứng thứ hai trong bảng so sánh của thẻ mô hình.
  • Độ sâu suy luận có thể được đặt ở mức thấp, trung bình hoặc cao, đánh đổi giữa độ trễ và độ chính xác cho mỗi yêu cầu.
  • Chế độ JSON, đầu ra theo lược đồ phản hồi (response-schema), gọi công cụ và lưu trữ bộ nhớ đệm prompt đều được hỗ trợ.

Khi nào nên chọn model khác

  • Bản thân StepFun đánh dấu Terminal-Bench ở mức 59,5 và GDPVal-AA ở mức 45,8 là những lĩnh vực cần cải thiện.
  • Đây là mô hình văn bản không hỗ trợ đầu vào hình ảnh, vì vậy ảnh chụp màn hình và các trang quét cần một mô hình có khả năng thị giác trước.
  • Trọng số đầy đủ 198 tỷ tham số rất nặng để tự lưu trữ, vì vậy hầu hết các nhóm sử dụng nó thông qua API.

Bắt đầu

  1. Tạo API key

    Tạo API key trong Console để dùng cho mọi mô hình trên nền tảng.

  2. Gửi yêu cầu đầu tiên của bạn

    Sao chép ví dụ cho ngôn ngữ của bạn và chạy nó với endpoint.

    Văn bản sang văn bảnMessages API
    POST/v1/messages
    Định dạng API:
    curl https://api.tokenlab.sh/v1/messages \
      -H "Content-Type: application/json" \
      -H "x-api-key: sk-xxx" \
      -H "anthropic-version: 2023-06-01" \
      -d '{
        "model": "step-3.7-flash",
        "max_tokens": 1024,
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

Giá

Giá Official là mức giá công khai của nhà phát triển. Giá TokenLab là số tiền bạn trả cho mô hình này trên TokenLab.

Default

mỗi 1M token
Giá niêm yết
Đầu vào $0.20 / Đầu ra $1.15 / Đọc bộ nhớ đệm $0.04 / Văn bản Đầu vào $0.20 / Văn bản Đầu ra $1.15
Official
Đầu vào $0.20 / Đầu ra $1.15 / Đọc bộ nhớ đệm $0.04 / Văn bản Đầu vào $0.20 / Văn bản Đầu ra $1.15
Giảm giá
—
Giá cache của prompt

Đọc bộ nhớ đệm

Giá niêm yết
$0.04
Official
$0.04
Giảm giá
—

Sử dụng & hoạt động

Tỷ lệ thành công là tỷ lệ yêu cầu hoàn tất. Độ trễ là thời gian của một phản hồi đầy đủ; P95 nghĩa là 95% yêu cầu hoàn thành trong khoảng thời gian đó.

Mức sử dụng & tình trạng

24 giờ qua
Yêu cầu
Tỷ lệ thành công
Độ trễ P95
Tổng token
Hiệu năng mô hình
Các chỉ số sẽ xuất hiện sau khi đạt ngưỡng về quyền riêng tư và khối lượng dữ liệu.

Dữ liệu dựa trên các yêu cầu tổng hợp của người dùng, không bao gồm các kiểm tra trạng thái.

Mở trong Console

Mở Step 3.7 Flash trong Console để chỉnh sửa và gửi prompt ngay.

Giúp tôi thử step-3.7-flash với tin nhắn ngắn tại /v1/messages. Hiển thị phản hồi, độ trễ và chi phí.

Tình huống sử dụng

  • Đại lý lập trình đồng thời

    Chạy nhiều đại lý trên cùng một kho lưu trữ, mỗi đại lý theo dõi các đường dẫn mã và tạo ra các bản vá, với cấp độ suy luận thấp hơn cho các chỉnh sửa thông thường.

  • Vòng lặp tìm kiếm và xác minh

    Để một đại lý tìm kiếm, đọc các nguồn và kiểm tra các tuyên bố của chính nó trước khi trả lời, sử dụng khả năng chống lại các trang web gây nhiễu của mô hình.

  • Trích xuất có cấu trúc

    Trả về JSON có kiểu dữ liệu từ hóa đơn, vé hoặc hồ sơ với việc thực thi lược đồ phản hồi thay vì phân tích văn bản tự do.

  • Tóm tắt ngữ cảnh dài

    Tóm tắt các báo cáo dài, bản ghi chép và lịch sử vé thành các bản tóm tắt, sử dụng cấp độ suy luận thấp hơn cho các tóm tắt thông thường và cấp độ cao hơn cho phân tích.

Ví dụ prompt

Tìm kiếm trong kho lưu trữ mọi nơi gọi billing.charge(), liệt kê những nơi bỏ qua giá trị trả về và đề xuất bản vá cho từng nơi.

Trích xuất nhà cung cấp, số hóa đơn, các mục hàng và tổng cộng từ văn bản này dưới dạng JSON khớp với lược đồ tôi đã cung cấp cho bạn.

Kiểm tra từng tuyên bố trong bản nháp này dựa trên các nguồn bạn có thể truy xuất và đánh dấu mọi câu lệnh bạn không thể xác nhận.

Mô hình này có giá theo điều kiện. Chỉ tổng token hàng tháng không thể tạo ước tính đáng tin cậy; hãy dùng bảng giá chi tiết theo thông số yêu cầu, bộ nhớ đệm và khung giờ áp dụng.

FAQ

Step 3.7 Flash là gì?

Đây là mô hình sparse mixture-of-experts của StepFun nhắm vào lập trình đại lý, tìm kiếm và công việc với ngữ cảnh dài. Thẻ mô hình liệt kê tổng cộng 198 tỷ tham số, khoảng 11 tỷ tham số hoạt động mỗi token và giấy phép Apache 2.0. StepFun định vị nó cho các nhà phát triển đang mở rộng quy mô các quy trình đại lý.

Các cấp độ suy luận là gì?

StepFun cung cấp ba cấp độ có thể lựa chọn: thấp, trung bình và cao. Sử dụng mức thấp cho các lệnh gọi công cụ thông thường và câu trả lời ngắn, và mức cao cho việc gỡ lỗi, lập kế hoạch hoặc xác minh nhiều bước nơi độ chính xác quan trọng hơn thời gian phản hồi.

Step 3.7 Flash có hỗ trợ đầu ra có cấu trúc không?

Có. Nó hỗ trợ các lược đồ phản hồi cùng với chế độ JSON và gọi công cụ, vì vậy bạn có thể giới hạn các câu trả lời theo một lược đồ. Điều đó tạo nên sự khác biệt so với Step 3.5 Flash, vốn không có hỗ trợ lược đồ phản hồi.

Nó có thể đọc hình ảnh không?

Không. Đây là mô hình văn bản, vì vậy đầu vào hình ảnh không được hỗ trợ. Đối với ảnh chụp màn hình hoặc các trang quét, hãy sử dụng Step 5 Preview, vốn chấp nhận hình ảnh và video, hoặc trích xuất văn bản trước.

Khi nào tôi nên chọn Step 5 Preview thay thế?

Chọn Step 5 Preview khi bạn cần mô hình hàng đầu của StepFun, cửa sổ ngữ cảnh trong phạm vi triệu token hoặc đầu vào video. Step 3.7 Flash là tùy chọn nhanh hơn, nhỏ hơn cho các vòng lặp đại lý có khối lượng lớn.

Step 3.7 Flash có giá bao nhiêu?

Trên TokenLab, Step 3.7 Flash có giá Đầu vào $0.20 / Đầu ra $1.15 mỗi 1M token. Bảng giá phía trên cho thấy chi tiết đầy đủ. Giá phụ thuộc vào đơn vị tính phí, thông số và mức sử dụng. Hãy so sánh các điều kiện tương đương trong bảng giá chi tiết của mô hình; một mức giá đơn lẻ không quyết định tổng chi phí.

Giới hạn ngữ cảnh và đầu ra của Step 3.7 Flash là bao nhiêu?

Step 3.7 Flash hỗ trợ tối đa 262.144 token ngữ cảnh và trả về tối đa 262.144 token mỗi phản hồi.

Step 3.7 Flash nên dùng endpoint nào?

Dùng https://api.tokenlab.sh/v1/messages làm mặc định cho Step 3.7 Flash. Nếu mô hình hỗ trợ định dạng native của nhà cung cấp, API workbench cũng hiển thị endpoint đó.

Step 3.7 Flash hỗ trợ những thao tác nào?

Step 3.7 Flash hỗ trợ Văn bản sang văn bản. Chọn một thao tác trong API workbench phía trên để xem endpoint và mã ví dụ tương ứng.

So sánh Step 3.7 Flash

Nguồn

Đánh giá ngày 2 thg 10, 2026

Mô hình liên quan