Cerebras
Cerebras
Cerebras phát triển phần cứng AI quy mô wafer cùng phần mềm tích hợp dành cho việc huấn luyện và suy luận mô hình hiệu năng cao. Wafer-Scale Engine của công ty cung cấp sức mạnh cho hệ thống CS-3 và Cerebras Inference Cloud, hỗ trợ các quy trình tương thích với API của OpenAI cũng như triển khai trên môi trường tại chỗ, đám mây và biên. Nền tảng này được thiết kế cho các ứng dụng như cung cấp mô hình, tinh chỉnh, tiền huấn luyện, tác nhân AI thời gian thực, gen học, khám phá thuốc, an ninh mạng và tìm kiếm doanh nghiệp. Cerebras kết hợp các chip, hệ thống và phần mềm chuyên dụng để phục vụ các tổ chức xây dựng và vận hành những khối lượng công việc trí tuệ nhân tạo đòi hỏi cao, với đội ngũ từ 501 đến 1.000 nhân viên.

Kỹ sư Học máy, Đưa mô hình vào vận hành

Đưa các mô hình transformer lên phần cứng tăng tốc AI Cerebras và tối ưu hiệu năng suy luận. Phát triển các đường dẫn trình biên dịch MLIR, đồng thời cải thiện độ chính xác, độ trễ, thông lượng và hiệu quả bộ nhớ của mô hình.

Mô tả

  • Đưa các mô hình mới vào môi trường sản xuất bằng cách phân tích kiến trúc, chuyển đổi trọng số, triển khai các đường dẫn thực thi và xác thực kết quả với các triển khai tham chiếu.
  • Hạ các mô hình xuống phần cứng Cerebras bằng dialect MLIR, phép biến đổi đồ thị, các pass hạ cấp và ánh xạ dành riêng cho phần cứng.
  • Hỗ trợ attention, phép nhân ma trận, chuẩn hóa, embedding vị trí và các toán tử khác thông qua phát triển trình biên dịch và kernel.
  • Tối ưu việc hợp nhất toán tử, layout tensor, chia tile, phân bổ bộ nhớ, di chuyển dữ liệu và thực thi song song.
  • Cải thiện hiệu năng prefill và decode bằng cách tinh chỉnh quản lý KV-cache, batching và lượng tử hóa để đạt độ trễ, thông lượng và mức sử dụng bộ nhớ tốt hơn.
  • Phân tích sai lệch số học và đánh giá ảnh hưởng của việc thay đổi độ chính xác cũng như các tối ưu hóa trình biên dịch đến độ chính xác của mô hình.
  • Sử dụng profiler, dấu vết thực thi và bộ đếm phần cứng để xác định các nút thắt về tính toán, bộ nhớ, giao tiếp và thời gian chạy.
  • Phối hợp với các nhóm phần cứng, trình biên dịch, kernel và runtime để cung cấp khả năng hỗ trợ mô hình đáng tin cậy cùng các benchmark hiệu năng có thể tái lập.

Yêu cầu

  • Thành thạo lập trình C++ và Python.
  • Có kinh nghiệm thực tế trong việc đưa mô hình học máy vào vận hành và gỡ lỗi bằng PyTorch hoặc framework tương đương.
  • Có kinh nghiệm thực tiễn với MLIR, bao gồm dialect, rewrite pattern, transformation pass và pipeline hạ cấp.
  • Nắm vững các nền tảng trình biên dịch, bao gồm biểu diễn trung gian, phân tích luồng dữ liệu và sinh mã.
  • Hiểu về kiến trúc transformer, cơ chế attention, các phép toán tensor và độ chính xác số.
  • Có kinh nghiệm profiling và tối ưu workload trên GPU hoặc các bộ tăng tốc AI khác.
  • Có khả năng chẩn đoán vấn đề về tính đúng đắn và hiệu năng xuyên suốt mã mô hình, đầu ra trình biên dịch, kernel và quá trình thực thi runtime.
  • Có kinh nghiệm với suy luận mô hình ngôn ngữ lớn, bao gồm GQA, attention cửa sổ trượt, mixture-of-experts, KV caching và speculative decoding.
  • Có kinh nghiệm với FP16, BF16, FP8 hoặc lượng tử hóa số bit thấp, cùng các đánh đổi về độ chính xác và hiệu năng.
  • Có nền tảng phát triển kernel cho bộ tăng tốc hoặc backend trình biên dịch dành riêng cho phần cứng.
  • Quen thuộc với thực thi phân tán, song song hóa mô hình và hệ thống phân cấp bộ nhớ của bộ tăng tốc.
  • Có đóng góp cho MLIR, LLVM, framework suy luận hoặc các dự án mã nguồn mở liên quan.

Phúc lợi

  • Việc làm ổn định trong môi trường có tốc độ như startup.
  • Cơ hội công bố và phát hành mã nguồn mở các nghiên cứu AI tiên tiến.
  • Làm việc với một trong những siêu máy tính AI nhanh nhất thế giới.
  • Văn hóa thẳng thắn, không mang tính tập đoàn, tôn trọng niềm tin cá nhân.
  • Cơ hội học hỏi liên tục, phát triển chuyên môn và nhận được sự hỗ trợ.
  • Môi trường làm việc công bằng và đa dạng.

Việc làm liên quan

coni+partner AG

Chuyên viên Tài chính Định lượng, UCITS và AIF

coni+partner AG

Giám sát việc đo lường hiệu quả, phân tích đóng góp và rủi ro của các danh mục UCITS và AIF. Hỗ trợ báo cáo khách hàng, quản lý chỉ số tham chiếu, kiểm soát vận hành và các dự án công nghệ trong lĩnh vực dịch vụ tài chính tại Thụy Sĩ.

Mở
DATAGROUP

Kỹ sư dịch vụ CNTT tại chỗ

DATAGROUP
1.001 – 5.000 Nhân viên
SaaSTiếp thịTư vấn

Hỗ trợ CNTT tại chỗ cho nơi làm việc và phòng họp của khách hàng DATAGROUP. Lắp đặt, sửa chữa và bảo trì máy tính, thiết bị mạng, viễn thông và thiết bị chuyên dụng.

Mở
InTTrust S.A.

Chuyên viên phân tích dữ liệu, SQL và Oracle Analytics Cloud

InTTrust S.A.
51 – 200 Nhân viên
Trí tuệ nhân tạoTư vấn

InTTrust đang tuyển Chuyên viên phân tích dữ liệu tại Hy Lạp để làm việc với SQL, Oracle Analytics Cloud và học máy. Vai trò tập trung vào bảng điều khiển, mô hình ngữ nghĩa và chuyển đổi dữ liệu thành thông tin hữu ích cho doanh nghiệp.

Mở
AtkinsRéalis

Kỹ sư cấp cao về lập kế hoạch và kiểm soát dự án – AtkinsRéalis, Gurugram

AtkinsRéalis

Dẫn dắt công tác lập kế hoạch và kiểm soát dự án trong các dự án hạ tầng và EPC của AtkinsRéalis, quản lý tiến độ, chi phí, rủi ro và báo cáo hiệu suất. Xây dựng thông tin phân tích bằng Power BI và hỗ trợ các nhóm triển khai dự án toàn cầu.

Mở
ICT Digital Solutions GmbH

Lập trình viên Full-Stack (Hybrid, Đức)

ICT Digital Solutions GmbH

Phát triển ứng dụng web, API và tích hợp đám mây tại ICT Digital Solutions. Xây dựng phần mềm cho IoT, Công nghiệp 4.0 và quy trình kinh doanh số.

Mở
IQ Plus AG

Kiến trúc sư phần mềm, Microservices

IQ Plus AG
51 – 200 Nhân viên
B2BSaaSTuyển dụng

Dẫn dắt kiến trúc các giải pháp thuế mới xây dựng trên nền tảng microservices. Thiết lập tiêu chuẩn phát triển, điều phối cải tiến kỹ thuật và phối hợp với bộ phận sản phẩm, kỹ thuật, phân tích nghiệp vụ cùng khách hàng.

Mở
Evident Scientific

Lập trình viên phần mềm C++/Rust

Evident Scientific

Phát triển phần mềm nền tảng có hỗ trợ AI cho các sản phẩm kính hiển vi tiên tiến của Evident, xây dựng các thành phần bảo mật và hiệu năng cao. Tham gia đội ngũ kỹ thuật linh hoạt, tập trung vào tích hợp và phân phối liên tục.

Mở
Anyone AI

Kỹ sư phần mềm cấp cao, đánh giá SWE-Bench

Anyone AI

Đánh giá các tác vụ phần mềm mã nguồn mở từ issue và pull request trên GitHub cho Anyone AI. Xem xét độ rõ ràng, chất lượng kiểm thử, khả năng tái lập, độ phức tạp và mức độ phù hợp để làm chuẩn đánh giá.

Mở
Cisco

Kỹ sư phần mềm cấp cao, Cisco IOS-XE

Cisco

Phát triển phần mềm hệ thống bằng C/C++ và Linux cho quy trình cài đặt ảnh Cisco IOS-XE. Xây dựng giải pháp nâng cấp bền bỉ, hỗ trợ mạng doanh nghiệp có tính sẵn sàng cao hoạt động ổn định.

Mở
K-tronik GmbH

Lập trình viên phần mềm C++/Qt, giao diện người dùng

K-tronik GmbH

Phát triển giao diện cho hệ thống mô phỏng và kết nối giao diện với các chức năng điều khiển, mô hình ở backend bằng C++ và Qt. Tham gia phát triển linh hoạt, kiểm thử và tích hợp hệ thống tại K-tronik GmbH.

Mở