StepFun: Step 3.7 Flash
step-3.7-flash- Đầu vào / Đầu ra
- $0.20 / $1.15
- Ngữ cảnh
- 256K
- Độ dài đầu ra tối đa
- 256K
- Phương thức
- Trò chuyện
- Khả năng
- Sử dụng công cụBộ nhớ đệm Prompt
Về Step 3.7 Flash
Step 3.7 Flash là mô hình sparse mixture-of-experts của StepFun dành cho các đại lý lập trình, quy trình tìm kiếm và công việc năng suất với ngữ cảnh dài. Thẻ mô hình mô tả thiết kế 198 tỷ tham số với khoảng 11 tỷ tham số hoạt động mỗi token, và ba cấp độ suy luận có thể lựa chọn. Nó kế thừa Step 3.5 Flash, bổ sung hỗ trợ đầu ra có cấu trúc và được phát hành theo giấy phép Apache 2.0.
Ưu điểm
- Tìm kiếm và xác minh: thẻ mô hình mô tả một đại lý kiểm tra các tuyên bố dựa trên các nguồn được truy xuất và chống lại các trang web gây nhiễu (adversarial).
- Độ tin cậy của đại lý: thẻ mô hình báo cáo đạt 67,1 trên ClawEval-1.1, một bài kiểm tra các quy trình đa lượt với các bẫy gây nhiễu.
- Công việc kho lưu trữ: nó đạt 56,3 điểm trên SWE-Bench Pro, đứng thứ hai trong bảng so sánh của thẻ mô hình.
- Độ sâu suy luận có thể được đặt ở mức thấp, trung bình hoặc cao, đánh đổi giữa độ trễ và độ chính xác cho mỗi yêu cầu.
- Chế độ JSON, đầu ra theo lược đồ phản hồi (response-schema), gọi công cụ và lưu trữ bộ nhớ đệm prompt đều được hỗ trợ.
Khi nào nên chọn model khác
- Bản thân StepFun đánh dấu Terminal-Bench ở mức 59,5 và GDPVal-AA ở mức 45,8 là những lĩnh vực cần cải thiện.
- Đây là mô hình văn bản không hỗ trợ đầu vào hình ảnh, vì vậy ảnh chụp màn hình và các trang quét cần một mô hình có khả năng thị giác trước.
- Trọng số đầy đủ 198 tỷ tham số rất nặng để tự lưu trữ, vì vậy hầu hết các nhóm sử dụng nó thông qua API.
Bắt đầu
Tạo API key
Tạo API key trong Console để dùng cho mọi mô hình trên nền tảng.
Gửi yêu cầu đầu tiên của bạn
Sao chép ví dụ cho ngôn ngữ của bạn và chạy nó với endpoint.
Văn bản sang văn bảnMessages APIPOST/v1/messagesĐịnh dạng API:curl https://api.tokenlab.sh/v1/messages \ -H "Content-Type: application/json" \ -H "x-api-key: sk-xxx" \ -H "anthropic-version: 2023-06-01" \ -d '{ "model": "step-3.7-flash", "max_tokens": 1024, "messages": [ {"role": "user", "content": "Hello!"} ] }'
Giá
Giá Official là mức giá công khai của nhà phát triển. Giá TokenLab là số tiền bạn trả cho mô hình này trên TokenLab.
Default
mỗi 1M token- Giá niêm yết
- Đầu vào $0.20 / Đầu ra $1.15 / Đọc bộ nhớ đệm $0.04 / Văn bản Đầu vào $0.20 / Văn bản Đầu ra $1.15
- Official
- Đầu vào $0.20 / Đầu ra $1.15 / Đọc bộ nhớ đệm $0.04 / Văn bản Đầu vào $0.20 / Văn bản Đầu ra $1.15
- Giảm giá
- —
Đọc bộ nhớ đệm
- Giá niêm yết
- $0.04
- Official
- $0.04
- Giảm giá
- —
| Giá niêm yếtmỗi 1M token | Officialmỗi 1M token | Giảm giá | |
|---|---|---|---|
| Default | Đầu vào $0.20 / Đầu ra $1.15 / Đọc bộ nhớ đệm $0.04 / Văn bản Đầu vào $0.20 / Văn bản Đầu ra $1.15 | Đầu vào $0.20 / Đầu ra $1.15 / Đọc bộ nhớ đệm $0.04 / Văn bản Đầu vào $0.20 / Văn bản Đầu ra $1.15 | — |
| Giá cache của prompt | |||
| Đọc bộ nhớ đệm | $0.04 | $0.04 | — |
Sử dụng & hoạt động
Tỷ lệ thành công là tỷ lệ yêu cầu hoàn tất. Độ trễ là thời gian của một phản hồi đầy đủ; P95 nghĩa là 95% yêu cầu hoàn thành trong khoảng thời gian đó.
Mức sử dụng & tình trạng
24 giờ qua- Yêu cầu
- Tỷ lệ thành công
- Độ trễ P95
- Tổng token
Dữ liệu dựa trên các yêu cầu tổng hợp của người dùng, không bao gồm các kiểm tra trạng thái.
Mở trong Console
Mở Step 3.7 Flash trong Console để chỉnh sửa và gửi prompt ngay.
Giúp tôi thử step-3.7-flash với tin nhắn ngắn tại /v1/messages. Hiển thị phản hồi, độ trễ và chi phí.
Tình huống sử dụng
Đại lý lập trình đồng thời
Chạy nhiều đại lý trên cùng một kho lưu trữ, mỗi đại lý theo dõi các đường dẫn mã và tạo ra các bản vá, với cấp độ suy luận thấp hơn cho các chỉnh sửa thông thường.
Vòng lặp tìm kiếm và xác minh
Để một đại lý tìm kiếm, đọc các nguồn và kiểm tra các tuyên bố của chính nó trước khi trả lời, sử dụng khả năng chống lại các trang web gây nhiễu của mô hình.
Trích xuất có cấu trúc
Trả về JSON có kiểu dữ liệu từ hóa đơn, vé hoặc hồ sơ với việc thực thi lược đồ phản hồi thay vì phân tích văn bản tự do.
Tóm tắt ngữ cảnh dài
Tóm tắt các báo cáo dài, bản ghi chép và lịch sử vé thành các bản tóm tắt, sử dụng cấp độ suy luận thấp hơn cho các tóm tắt thông thường và cấp độ cao hơn cho phân tích.
Ví dụ prompt
Tìm kiếm trong kho lưu trữ mọi nơi gọi billing.charge(), liệt kê những nơi bỏ qua giá trị trả về và đề xuất bản vá cho từng nơi.
Trích xuất nhà cung cấp, số hóa đơn, các mục hàng và tổng cộng từ văn bản này dưới dạng JSON khớp với lược đồ tôi đã cung cấp cho bạn.
Kiểm tra từng tuyên bố trong bản nháp này dựa trên các nguồn bạn có thể truy xuất và đánh dấu mọi câu lệnh bạn không thể xác nhận.
Mô hình này có giá theo điều kiện. Chỉ tổng token hàng tháng không thể tạo ước tính đáng tin cậy; hãy dùng bảng giá chi tiết theo thông số yêu cầu, bộ nhớ đệm và khung giờ áp dụng.
FAQ
Step 3.7 Flash là gì?
Đây là mô hình sparse mixture-of-experts của StepFun nhắm vào lập trình đại lý, tìm kiếm và công việc với ngữ cảnh dài. Thẻ mô hình liệt kê tổng cộng 198 tỷ tham số, khoảng 11 tỷ tham số hoạt động mỗi token và giấy phép Apache 2.0. StepFun định vị nó cho các nhà phát triển đang mở rộng quy mô các quy trình đại lý.
Các cấp độ suy luận là gì?
StepFun cung cấp ba cấp độ có thể lựa chọn: thấp, trung bình và cao. Sử dụng mức thấp cho các lệnh gọi công cụ thông thường và câu trả lời ngắn, và mức cao cho việc gỡ lỗi, lập kế hoạch hoặc xác minh nhiều bước nơi độ chính xác quan trọng hơn thời gian phản hồi.
Step 3.7 Flash có hỗ trợ đầu ra có cấu trúc không?
Có. Nó hỗ trợ các lược đồ phản hồi cùng với chế độ JSON và gọi công cụ, vì vậy bạn có thể giới hạn các câu trả lời theo một lược đồ. Điều đó tạo nên sự khác biệt so với Step 3.5 Flash, vốn không có hỗ trợ lược đồ phản hồi.
Nó có thể đọc hình ảnh không?
Không. Đây là mô hình văn bản, vì vậy đầu vào hình ảnh không được hỗ trợ. Đối với ảnh chụp màn hình hoặc các trang quét, hãy sử dụng Step 5 Preview, vốn chấp nhận hình ảnh và video, hoặc trích xuất văn bản trước.
Khi nào tôi nên chọn Step 5 Preview thay thế?
Chọn Step 5 Preview khi bạn cần mô hình hàng đầu của StepFun, cửa sổ ngữ cảnh trong phạm vi triệu token hoặc đầu vào video. Step 3.7 Flash là tùy chọn nhanh hơn, nhỏ hơn cho các vòng lặp đại lý có khối lượng lớn.
Step 3.7 Flash có giá bao nhiêu?
Trên TokenLab, Step 3.7 Flash có giá Đầu vào $0.20 / Đầu ra $1.15 mỗi 1M token. Bảng giá phía trên cho thấy chi tiết đầy đủ. Giá phụ thuộc vào đơn vị tính phí, thông số và mức sử dụng. Hãy so sánh các điều kiện tương đương trong bảng giá chi tiết của mô hình; một mức giá đơn lẻ không quyết định tổng chi phí.
Giới hạn ngữ cảnh và đầu ra của Step 3.7 Flash là bao nhiêu?
Step 3.7 Flash hỗ trợ tối đa 262.144 token ngữ cảnh và trả về tối đa 262.144 token mỗi phản hồi.
Step 3.7 Flash nên dùng endpoint nào?
Dùng https://api.tokenlab.sh/v1/messages làm mặc định cho Step 3.7 Flash. Nếu mô hình hỗ trợ định dạng native của nhà cung cấp, API workbench cũng hiển thị endpoint đó.
Step 3.7 Flash hỗ trợ những thao tác nào?
Step 3.7 Flash hỗ trợ Văn bản sang văn bản. Chọn một thao tác trong API workbench phía trên để xem endpoint và mã ví dụ tương ứng.
So sánh Step 3.7 Flash
Nguồn
Đánh giá ngày 2 thg 10, 2026