---
format: "aidr-story-markdown/v1"
id: "5a577b50ff19fb234b5e4ae609cf043eb7c39f6b2b860de8163bfd9541da706a"
canonical_url: "https://aidr.today/5a577b50?lang=vi"
title: "Perplexity và Baseten đưa DeepSeek V4 Pro lên hạ tầng tại Mỹ, giúp giảm 62% chi phí"
lang: "vi"
requested_lang: "vi"
available_langs: ["en","vi"]
translation_fallback: null
fallback_fields: []
published_at: "2026-08-19T02:48:10.000Z"
category: "Infra"
topics: ["deepseek","inference","llm-pricing"]
source_urls: ["https://huggingnews.com/ai/perplexity-and-baseten-host-deepseek-v4-pro-in-us-cutting-frontier-costs-318ec25a"]
summary: "Trong các thử nghiệm của Artificial Analysis, phiên bản 0813 của DeepSeek V4 Pro đạt tốc độ 147 token mỗi giây, mức cao nhất trong số các nhà cung cấp inference hiện nay."
---

# Perplexity và Baseten đưa DeepSeek V4 Pro lên hạ tầng tại Mỹ, giúp giảm 62% chi phí

> [Open the canonical story](<https://aidr.today/5a577b50?lang=vi>)

**Published:** 2026-08-19T02:48:10.000Z
**Category:** Infra
**Topics:** deepseek, inference, llm\-pricing

## Summary

Trong các thử nghiệm của Artificial Analysis, phiên bản 0813 của DeepSeek V4 Pro đạt tốc độ 147 token mỗi giây, mức cao nhất trong số các nhà cung cấp inference hiện nay\.

## Sources

- [Story source](<https://huggingnews.com/ai/perplexity-and-baseten-host-deepseek-v4-pro-in-us-cutting-frontier-costs-318ec25a>)

