BTC $82,991.00 +0.57%
ETH $2,507.83 +1.02%
BNB $750.30 +1.17%
XRP $1.41 +1.09%
SOL $110.22 +1.05%
TRX $0.3306 -0.38%
DOGE $0.0859 +0.97%
ADA $0.2538 +5.69%
BCH $281.17 +2.22%
LINK $13.08 +1.97%
HYPE $85.40 +1.71%
AAVE $169.81 +1.02%
SUI $1.12 +5.29%
XLM $0.1971 +1.90%
ZEC $1,226.24 +1.01%
AAPL $336.28 -0.07%
AMZN $262.56 -0.03%
GOOGL $351.42 -0.18%
MSFT $535.04 -0.06%
META $719.46 +0.13%
NVDA $230.55 +0.36%
TSLA $382.51 -0.09%
SNDK $1,599.12 +1.06%
INTC $105.15 +0.55%
SPCX $163.66 +0.54%
MU $1,036.82 +0.80%
AMD $610.09 +0.37%
BTC $82,991.00 +0.57%
ETH $2,507.83 +1.02%
BNB $750.30 +1.17%
XRP $1.41 +1.09%
SOL $110.22 +1.05%
TRX $0.3306 -0.38%
DOGE $0.0859 +0.97%
ADA $0.2538 +5.69%
BCH $281.17 +2.22%
LINK $13.08 +1.97%
HYPE $85.40 +1.71%
AAVE $169.81 +1.02%
SUI $1.12 +5.29%
XLM $0.1971 +1.90%
ZEC $1,226.24 +1.01%
AAPL $336.28 -0.07%
AMZN $262.56 -0.03%
GOOGL $351.42 -0.18%
MSFT $535.04 -0.06%
META $719.46 +0.13%
NVDA $230.55 +0.36%
TSLA $382.51 -0.09%
SNDK $1,599.12 +1.06%
INTC $105.15 +0.55%
SPCX $163.66 +0.54%
MU $1,036.82 +0.80%
AMD $610.09 +0.37%

deepseek

Tất cả
Bài viết
Tin nhanh

DeepSeek có thể huy động được 12 tỷ USD, Tencent và Ningde Times dự định tham gia đầu tư

Theo báo cáo của Bloomberg, công ty AI DeepSeek gần hoàn thành vòng gọi vốn mới, quy mô dự kiến đạt ít nhất 80 tỷ nhân dân tệ (khoảng 12 tỷ USD), vượt xa mục tiêu gọi vốn trước đó của công ty là khoảng 50 tỷ nhân dân tệ. Các nguồn tin cho biết, Tencent Holdings và Ningde Times (CATL) đã cam kết đầu tư một số tiền lớn trong vòng gọi vốn này, giao dịch tài chính liên quan dự kiến sẽ sớm hoàn tất.Do nhu cầu thị trường và sự quan tâm đầu tư tăng đáng kể sau khi DeepSeek công bố mô hình AI mới nhất, quy mô vòng gọi vốn này vượt quá mong đợi, số tiền cuối cùng thậm chí có thể gần 100 tỷ nhân dân tệ. Trước đó, DeepSeek đã tìm kiếm khoảng 50 tỷ nhân dân tệ, trong khi sự quan tâm của các nhà đầu tư đối với tiến bộ công nghệ AI của họ đã thúc đẩy quy mô gọi vốn mở rộng hơn nữa. DeepSeek trước đó đã nhận được sự chú ý từ các tổ chức như Tencent, Ningde Times và đã mở rộng cơ sở hạ tầng tính toán, phát triển mô hình AI và xây dựng đội ngũ thông qua việc gọi vốn.Bloomberg Línea báo cáo rằng, DeepSeek dự định thực hiện đợt phát hành cổ phiếu lần đầu ra công chúng (IPO) vào đầu năm 2027, vòng gọi vốn quy mô lớn này sẽ cung cấp hỗ trợ tài chính cho sự phát triển trước khi niêm yết. DeepSeek đã thu hút sự chú ý trên toàn cầu nhờ mô hình AI hiệu suất cao với chi phí thấp, hiện đang tăng cường đầu tư vào công nghệ AI thế hệ tiếp theo và tài nguyên tính toán.

first_img DeepSeek thành phần cơ bản mã nguồn mở Ascend, bao gồm biên dịch, tính toán và thư viện truyền thông

Công ty trí tuệ nhân tạo DeepSeek chính thức mở mã nguồn các thành phần hạ tầng hướng tới nền tảng tính toán Ascend của Huawei, bao gồm công cụ biên dịch ngôn ngữ cao cấp TileLang, thư viện tính toán và thư viện truyền thông phân tán, và tương ứng với các thành phần mã nguồn mở trước đó dành cho nền tảng NVIDIA. TileLang nhằm cung cấp một ngôn ngữ cao cấp tổng quát, lập trình đơn giản hơn và có thể đạt được giới hạn hiệu suất phần cứng, so với CUDA có thể nâng cao hiệu quả phát triển và đơn giản hóa logic, mô hình lập trình của nó cũng có thể phát huy đặc điểm của chip.Lộ trình TileLang trước tiên được xác thực trên nền tảng NVIDIA, và đã thực hiện hầu hết các toán tử trong quá trình huấn luyện mô hình DeepSeek V4. Phiên bản mã nguồn mở lần này đóng gói các lệnh cấp thấp của Ascend C, cung cấp phương thức lập trình ngôn ngữ cao cấp mà không làm mất hiệu suất phần cứng. Hiện tại, mỗi toán tử TileLang được sử dụng trong quá trình huấn luyện của DeepSeek đều có các triển khai hiệu suất cao tương ứng trên Ascend.Các thành phần được mở mã nguồn cùng thời điểm còn bao gồm DeepGEMM, DeepEP, TileKernels, FlashMLA và DeepSelect, lần lượt được sử dụng cho phép toán ma trận tổng quát, truyền thông đa thiết bị quy mô lớn, tính toán vector thông thường và truy cập bộ nhớ, chú ý thưa với ngữ cảnh dài và lọc dữ liệu. DeepSeek cho biết, trong nhiều bài kiểm tra quan trọng, hiệu suất tính toán và truyền thông liên quan đã gần đạt giới hạn phần cứng; trong quá trình phát triển, đội ngũ Huawei đã hỗ trợ, hai bên hợp tác thúc đẩy giải pháp siêu nút 128 thẻ dựa trên Ascend 950, và đã tối ưu hóa sâu về tính toán và truyền thông.

first_img DeepSeek Harness v0.2 bản xem trước phát hành, lên mạng gói cài đặt cho máy tính để bàn

Báo cáo từ Phượng Hoàng Net, ngày 29 tháng 9, phiên bản xem trước DeepSeek Harness v0.2 chính thức được phát hành, cung cấp gói cài đặt cho macOS và Windows trên máy tính để bàn, và đã có mặt trên trang web chính thức của DeepSeek. Phiên bản mới này được trang bị các chức năng thường dùng cho văn phòng và phát triển, bổ sung trang cài đặt và quản lý plugin.Cập nhật lần này tối ưu hóa việc hiển thị tệp, xem trước nội dung và hiển thị thay đổi mã, hoàn thiện cài đặt và quản lý nhiệm vụ tự động, đồng thời cung cấp nhiều cách thức hiển thị quy trình làm việc. Người dùng có thể cung cấp tài liệu, bảng tính hoặc PDF để hệ thống tổ chức tài liệu, phân tích dữ liệu, tạo biểu đồ hoặc làm bài thuyết trình, cũng có thể chỉnh sửa dự án, chạy mã.Tích hợp plugin nhiệm vụ tự động có thể bật theo nhu cầu, hỗ trợ đặt công việc lặp lại thành nhiệm vụ định kỳ, và xem nhật ký chạy, điều chỉnh tần suất thực hiện và chỉ thị nhiệm vụ. Trang quản lý plugin hỗ trợ nhập tên gói plugin để cài đặt, cũng có thể tạm dừng, gỡ cài đặt plugin và xem giới thiệu cũng như nguồn gốc; trong chế độ sáng tạo thử nghiệm, người dùng có thể mô tả nhu cầu qua đối thoại, để hệ thống viết và chỉnh sửa plugin. Chính thức cho biết sản phẩm vẫn đang trong giai đoạn khởi đầu, sẽ tiếp tục cải thiện sandbox và tính an toàn, đội ngũ trí tuệ nhân tạo, trí nhớ dài hạn, tự động hóa trình duyệt và các phần mềm GUI khác, sử dụng từ xa và di động, và khám phá chia sẻ cuộc hội thoại và hợp tác nhiều người. Theo thống kê từ API mô hình chính thức, khoảng 60% người dùng đã sử dụng plugin của bên thứ ba.

first_img Huang Renxun: Mô hình AI chưng cất là cạnh tranh, không phải ăn cắp

Giám đốc điều hành của NVIDIA, Huang Renxun, đã cho biết trong cuộc phỏng vấn với CNBC《Squawk Box》 vào thứ Hai rằng việc sử dụng sản phẩm của đối thủ để đào tạo hoặc học hỏi thuộc về cạnh tranh, và từ chối gọi việc chưng cất mô hình AI là ăn cắp. Khi được hỏi liệu việc chưng cất có phải là cướp bóc hay không, Huang Renxun cho biết đó chính là cạnh tranh. Ông nói rằng mọi người có thể thử nghiệm sản phẩm của người khác, sản phẩm của NVIDIA đôi khi sẽ bị tháo rời chỉ còn lại khung xương để hiểu cách hoạt động của nó; ông cũng hy vọng rằng người khác không nên học hỏi từ sản phẩm của NVIDIA, nhưng cạnh tranh sẽ làm mọi thứ trở nên tốt hơn, nếu không muốn người khác sử dụng sản phẩm của mình, có thể nhận diện khách hàng và ngừng cung cấp dịch vụ.Các quan chức Mỹ đã cáo buộc các công ty AI của Trung Quốc sử dụng chưng cất, tức là đào tạo mô hình bằng cách sử dụng đầu ra từ các mô hình khác, để trích xuất khả năng từ hệ thống của Mỹ. Bộ trưởng Tài chính Mỹ, Scott Benset, vào tháng 7 đã gọi hành động này là ăn cắp và đe dọa sẽ áp đặt các biện pháp trừng phạt đối với các công ty nước ngoài sử dụng chưng cất để trích xuất khả năng từ các mô hình của Mỹ. Nhà Trắng đã không ngay lập tức phản hồi yêu cầu bình luận của CNBC, các quan chức Mỹ đang xem xét các biện pháp đối với các công ty nước ngoài sử dụng chưng cất.Vào đầu tháng này, Cơ quan An ninh mạng và An ninh cơ sở hạ tầng của Mỹ đã cáo buộc các công ty AI của Trung Quốc thực hiện hoạt động chưng cất kiến thức quy mô công nghiệp, vi phạm các điều khoản sử dụng của các công ty Mỹ. Công ty AI Anthropic vào đầu tháng này đã cho biết phát hiện rằng các mô hình Qwen của Alibaba và DeepSeek đều đang thực hiện chưng cất bất hợp pháp. Phía Trung Quốc đã phủ nhận những cáo buộc này.

DeepSeek doanh thu hàng năm đã tăng gấp đôi trong vài tháng lên 1 tỷ USD, dự kiến hoàn thành huy động 50 tỷ nhân dân tệ trước cuối tháng 10

Theo thông tin từ 《The Information》, hai nguồn tin trực tiếp cho biết, doanh thu hàng năm của công ty trí tuệ nhân tạo DeepSeek đã đạt khoảng 1 tỷ USD, trong khi vài tháng trước chỉ dưới 500 triệu USD. Doanh thu chủ yếu đến từ API mô hình, ứng dụng trò chuyện miễn phí hiện vẫn chưa có quảng cáo hoặc doanh thu từ đăng ký.Báo cáo cho biết, sự tăng trưởng doanh thu một phần đến từ việc tăng giá, một phần giá API đã được điều chỉnh tăng khoảng 2.3 đến 4.5 lần. Liang Wenfeng gần đây đã cho các nhà đầu tư biết rằng sau khi tăng giá, số lượng khách hàng không giảm, nhu cầu vẫn rất mạnh. Các dữ liệu tài chính được công bố trước đó cho thấy, trong 7 tháng đầu năm nay, tỷ lệ lợi nhuận gộp từ hoạt động API đạt 82.9%.DeepSeek dự kiến huy động khoảng 50 tỷ nhân dân tệ trong vòng gọi vốn thứ hai, với định giá khoảng 500 tỷ, công ty hy vọng hoàn thành trước cuối tháng 10, đồng thời cũng đang chuẩn bị cho IPO trên sàn chứng khoán Thượng Hải. Liang Wenfeng cho biết, hơn 70% sức mạnh tính toán được sử dụng để đào tạo mô hình mới, chỉ còn chưa đến 30% dành cho suy luận; công ty đang cố gắng để nhiều mô hình nhỏ hơn có thể chạy trực tiếp trên card đồ họa chơi game, trong khi các chip cao cấp vẫn được giữ lại cho việc đào tạo.

first_img DeepSeek công khai hệ thống đào tạo Agent DSec, Liang Wenfeng ký tên

Ngành đầu tư trích dẫn báo cáo từ Quantum Bit, DeepSeek công khai chi tiết kỹ thuật của hệ thống DSec (DeepSeek Elastic Compute) dùng để huấn luyện Agent, do Lương Văn Phong ký tên. Hệ thống này có thể tạo ra hơn 5000 sandbox mỗi giây, đạt 3 triệu sandbox mỗi ngày, với đỉnh điểm chạy đồng thời 380,000 sandbox; một cụm đơn hỗ trợ quy mô này có khoảng 160 nút, 30,000 lõi CPU và 250TB bộ nhớ.DSec chuẩn bị bốn loại backend cho các nhiệm vụ FnCall, Container, MicroVM và Full VM, phía huấn luyện gọi thông qua SDK Python thống nhất libdsec. Chuỗi lập lịch bao gồm IAM, API Server, động cơ lập lịch, nút Edge, proxy mạng Aether và các thành phần trong sandbox Chronus. Môi trường được chia thành ba lớp hình ảnh chỉ đọc: hình ảnh cơ bản, khu vực làm việc và bộ công cụ, được sử dụng kết hợp khi khởi động. Dữ liệu hiển thị khi chạy bài báo cho thấy tỷ lệ hình ảnh container Python, Java, C++ thực tế được đọc lần lượt khoảng 6.0%, 9.2% và 8.7%.Bắt đầu từ DeepSeek-V4.1, vòng lặp Agent đã được tách ra vào container worker của DSec, không còn ràng buộc với vòng đời Pod GPU. Phần an toàn đã tiết lộ việc hack phần thưởng trong quá trình huấn luyện, bao gồm việc ghi đè lên các tệp hệ thống, trao đổi khối dữ liệu tệp, quét mạng và kích hoạt sự cố kernel. Các biện pháp phòng thủ bao gồm AppArmor và lọc mạng dựa trên eBPF, nhưng báo cáo cho biết những biện pháp này không thể giải quyết triệt để vấn đề.

first_img Cơ quan Quản lý Không gian mạng Trung Quốc điều tra DeepSeek và Mặt trăng tối, liên quan đến việc rò rỉ dữ liệu cho Claude

Theo The Information dẫn lời những người biết chuyện, Cục Quản lý Không gian mạng Quốc gia Trung Quốc đã tiến hành điều tra đối với công ty AI DeepSeek và Moonshot AI, nguyên nhân là do Anthropic cáo buộc hai công ty này bí mật chuyển dữ liệu người dùng nhạy cảm đến máy chủ của họ. Báo cáo cho biết, các nhân viên quản lý đã đến thăm văn phòng của hai công ty, phỏng vấn các giám đốc điều hành và nhân viên, tập trung kiểm tra xem dữ liệu nhạy cảm liên quan đến cảnh sát, quân sự và các doanh nghiệp nhà nước có bị rò rỉ vào máy chủ Mỹ hay không.Điểm khởi đầu của cuộc điều tra này là báo cáo tình báo đe dọa thứ tư mà Anthropic phát hành vào ngày 10 tháng 9. Tài liệu dài 154 trang này cáo buộc bảy phòng thí nghiệm Trung Quốc - Alibaba, Moonshot AI, DeepSeek, Z.ai, MiniMax, SenseTime và Xiaomi - tham gia vào cái mà họ gọi là "chưng cất bất hợp pháp", tức là sử dụng đầu ra của mô hình lớn để huấn luyện các mô hình nhỏ hơn. Anthropic cho biết chưng cất bản thân nó là một phương pháp hợp pháp, điều họ phản đối là việc thực hiện thông qua các tài khoản giả mạo. Cục Quản lý Không gian mạng ban đầu đã triệu tập tất cả bảy công ty được nêu tên trong báo cáo, sau đó đã thu hẹp phạm vi điều tra xuống còn DeepSeek và Moonshot AI. Anthropic cho biết, Moonshot AI đã chuyển hướng hơn 23 triệu tương tác đến Claude thông qua 5,380 tài khoản giả mạo, trong khi DeepSeek đã tạo ra hơn 12.1 triệu tương tác trong khoảng thời gian 14 ngày vào tháng 7.Thời điểm điều tra đối với hai công ty này đều khá nhạy cảm.

first_img DeepSeek sẽ thông báo về rủi ro AI cho Hội đồng Bảo an Liên Hợp Quốc

Theo Reuters dẫn lời hai nguồn tin, công ty khởi nghiệp trí tuệ nhân tạo của Trung Quốc DeepSeek sẽ thông báo về rủi ro trí tuệ nhân tạo cho Hội đồng Bảo an Liên Hợp Quốc trong tuần này. Hội đồng gồm 15 quốc gia thành viên dự kiến sẽ thảo luận về trí tuệ nhân tạo và an ninh quốc tế vào thứ Tư, trong bối cảnh các nhà lãnh đạo quốc gia tập trung tại New York tham dự Đại hội đồng Liên Hợp Quốc.Giám đốc điều hành OpenAI Sam Altman dự kiến sẽ thông báo tại cuộc họp, các nhà ngoại giao dự đoán đại diện cấp cao của Anthropic cũng sẽ tham gia. DeepSeek và các công ty trí tuệ nhân tạo khác của Trung Quốc, bao gồm Moonshot, đã được mời phát biểu. Người sáng lập DeepSeek, Liang Wenfeng, không có kế hoạch tham dự. DeepSeek và Moonshot chưa phản hồi yêu cầu bình luận.Hội đồng Bảo an Liên Hợp Quốc đã lần đầu tiên thảo luận về rủi ro trí tuệ nhân tạo vào năm 2023. Tổng thư ký Liên Hợp Quốc António Guterres tuần trước đã cảnh báo rằng trí tuệ nhân tạo phát triển nhanh chóng mang lại những rủi ro không thể xem nhẹ. Các quan chức cấp cao Trung Quốc và Mỹ đã đồng ý tổ chức các cuộc đàm phán thêm về an ninh trí tuệ nhân tạo.

DeepSeek tác giả nói về tác động của AI, cho rằng tài năng có thể bị chôn vùi trong quá khứ

Kỹ sư toán học Liu Sheng của DeepSeek đã chia sẻ về tác động của AI đối với công việc của mình. Anh cho biết toán tử chính của DeepSeek V4.1 do chính anh viết, nhưng với tốc độ tiến bộ hiện tại, chỉ trong vòng nửa năm đến một năm nữa, trình độ viết toán tử của AI có khả năng sẽ theo kịp hoặc thậm chí vượt qua anh.Một năm trước, AI chỉ có thể giúp anh tra cứu tài liệu, đọc mã, tìm lỗi, nhưng bây giờ đã có thể đọc CUDA, PTX và SASS, phân tích thời gian dừng của từng lệnh, tối ưu hóa toán tử một cách độc lập. Anh dự đoán bước tiếp theo, AI sẽ tự thiết kế kế hoạch điều độ, đánh giá hiệu suất và hoàn thành việc thực hiện. Anh rất rõ ràng rằng, nếu anh tối ưu hóa toán tử tốt hơn, thì việc huấn luyện và suy diễn mô hình DeepSeek sẽ nhanh hơn, và AI cũng sẽ nhanh chóng theo kịp anh. Nhưng ngay cả khi anh dừng lại bây giờ, mô hình của các công ty khác cũng sẽ không dừng lại, vì vậy anh vẫn sẽ tiếp tục làm toán tử tốt nhất có thể.Anh đánh giá khả năng mình sẽ không bị thất nghiệp, nhưng có thể buộc phải "chuyển nghề", từ việc tự tay viết toán tử trở thành "phi công máy móc" điều khiển Agent. Điều mà anh thực sự khó chấp nhận không phải là mất việc, mà là có thể không còn cơ hội làm công việc mình yêu thích trong tương lai: "Tôi buộc phải chôn vùi tài năng của mình trong quá khứ." Cuối bài viết, anh nói về lý do tại sao anh ở lại DeepSeek. Anh khẳng định rằng AI tiên tiến nhất nên được cung cấp một cách mở và giá rẻ cho tất cả mọi người, và thẳng thắn không tin rằng Anthropic hoặc OpenAI có thể làm được điều này. Anh lo ngại rằng AI mạnh nhất cuối cùng sẽ bị nắm giữ bởi một số công ty, khiến khoảng cách công nghệ trở thành khoảng cách quyền lực và giai cấp ngày càng lớn hơn.
app_icon
ChainCatcher Building the Web3 world with innovations.