DeepSeek mở rộng công nghệ AI tác vụ với phần mềm 'harness'
Công ty AI DeepSeek có trụ sở tại Hàng Châu, Trung Quốc, vừa phát động chương trình thử nghiệm beta dành cho DeepSeek Harness – một phần mềm được phát triển nhằm chuyển các mô hình ngôn ngữ lớn (LLM) thành các tác nhân AI tự động thực hiện nhiều bước xử lý phức tạp.
Thông tin trên được công bố qua bài đăng trên mạng xã hội vào ngày thứ Bảy bởi ông Cui Tianyi, trưởng nhóm phát triển phần mềm harness. DeepSeek đang tấp nập kêu gọi các nhà phát triển dự án mã nguồn mở tham gia thử nghiệm nhằm đẩy nhanh tiến trình ứng dụng công nghệ AI tác vụ.
Xu hướng phát triển khung làm việc AI tác vụ
Phần mềm harness hướng tới việc điều phối các LLM để tự động hóa các tác vụ đa bước, có khả năng suy luận qua các quy trình phức tạp, đây là hướng đi được nhiều phòng thí nghiệm AI ưu tiên phát triển sau thành công thương mại của Anthropic với sản phẩm Claude Code.
Ông Cui gia nhập DeepSeek từ tháng 3, trước đó từng đồng sáng lập công ty giao dịch định lượng TSY Capital tại Hong Kong và làm kỹ sư phần mềm cho Jane Street. Ông chưa công bố lịch trình chính xác ra mắt DeepSeek Harness, tuy nhiên đầu tháng 6 đã cho biết nhóm vẫn thiếu nhân sự trầm trọng và đang tuyển dụng rộng rãi.
Tăng tốc phát triển mô hình AI với chi phí thấp
Giám đốc điều hành kiêm đồng sáng lập Liang Wenfeng xác định chiến lược cốt lõi là tập trung vào các mô hình AI có hiệu năng cao nhưng chi phí rẻ, hướng tới mục tiêu dài hạn đạt trí tuệ nhân tạo tổng quát (AGI) – nơi AI có thể sánh ngang hoặc vượt qua khả năng nhận thức của con người.
Vào ngày thứ Sáu, DeepSeek phát hành “V4 Flash 0731”, phiên bản nhẹ của dòng mô hình V4 gồm 284 tỷ tham số, lần đầu được giới thiệu vào tháng 4.
Mô hình này nhanh chóng được ghi nhận về hiệu suất gần bằng chuẩn mực hiện đại trong khi chi phí sử dụng thấp nhất trên thị trường, làm dấy lên mối quan ngại gia tăng tại Washington và Silicon Valley về việc mô hình AI từ Trung Quốc đang được ứng dụng rộng rãi trên toàn cầu.
Hiệu năng và chi phí vượt trội so với đối thủ
Theo benchmark của nền tảng Artificial Analysis, V4 Flash 0731 có hiệu năng tương đương GPT-5.6 Luna của OpenAI. Tuy nhiên, giá lập trình API của DeepSeek chỉ bằng 40% so với đối thủ, ngay cả sau đợt giảm giá 80% của OpenAI tuần trước.
Trung bình, mỗi tác vụ trên mô hình DeepSeek chỉ tiêu tốn 0,03 USD, trong khi Anthropic Claude Fable 5 mất tới 3,15 USD cho cùng một tác vụ, tương đương chi phí rẻ hơn khoảng 105 lần, theo Artificial Analysis.
Nhà đầu tư mạo hiểm Mỹ Chamath Palihapitiya đã hài hước nhận xét trên mạng xã hội: "Sao phải trả 1 USD khi tôi có thể trả 105 USD? - Đây không phải điều CFO, CEO hay thành viên hội đồng quản trị nào nói".
Mở rộng quy mô và huy động vốn
Song song với việc phát triển sản phẩm, DeepSeek cũng công bố kế hoạch tăng gấp đôi quy mô các phòng ban trong công ty và đẩy mạnh quá trình gọi vốn.
Theo SCMP, hãng đang thương lượng vòng tài trợ mới với định giá sơ bộ khoảng 70 tỷ USD, tăng so với mức gần 60 tỷ USD sau vòng gọi vốn Series A trị giá 7 tỷ USD hồi trước.
Động thái này thể hiện quyết tâm của DeepSeek trong việc củng cố vị thế trên thị trường AI toàn cầu, đặc biệt khi các công ty Trung Quốc đang ngày càng có ảnh hưởng mạnh mẽ trong lĩnh vực trí tuệ nhân tạo.












