Mô tả công việc
Chúng tôi đang tìm kiếm Kỹ sư Phần mềm để tích hợp các công nghệ AI chúng tôi phát triển vào sản phẩm và hệ thống hiện có của khách hàng. Bạn sẽ làm việc cùng đội ngũ kỹ sư đào tạo mô hình (kỹ sư học máy) và khách hàng để xây dựng, tích hợp, triển khai và vận hành các giải pháp AI thực tế.
Công việc
- Phát triển và tích hợp các tính năng sử dụng AI/mô hình AI vào sản phẩm và hệ thống của khách hàng.
- Xây dựng backend service và API bằng Python.
- Đấu nối các APIs trên giải pháp AI của công ty vào hạ tầng của khách hàng
- Phối hợp với đội ngũ đào tạo mô hình để hiểu cách hoạt động của các mô hình AI
- Làm việc cùng Chuyên viên Phân tích Nghiệp vụ (BA) và khách hàng để tìm hiểu nghiệp vụ.
- Xử lý dữ liệu, prompt, input/output của model, structured output và các tình huống lỗi.
- Hỗ trợ triển khai, monitoring, troubleshooting và tối ưu các hệ thống tích hợp AI.
Yêu cầu công việc
Bạn là ứng viên phù hợp nếu:
- Có từ 1 năm kinh nghiệm trong Software Engineering, Backend Development hoặc vị trí tương đương.
- Có kinh nghiệm tốt với Python.
- Có tư duy thuật toán/giải quyết vấn đề tốt.
- Có kinh nghiệm làm việc và tích hợp RESTful API và các dịch vụ bên thứ ba.
- Có kinh nghiệm xây dựng backend service với FastAPI, Flask hoặc framework tương đương.
- Có hiểu biết tốt về quy trình phát triển phần mềm, backend và tích hợp hệ thống.
- Có kiến thức cơ bản đến khá về Generative AI, LLM và AI API.
- Có khả năng giải quyết vấn đề, tự học và giao tiếp tốt.
- Am hiểu về đầu vào và đầu ra của các mô hình Ai hiện đại như LLM, VLM, Speech-to-text, Text-to-speech.
Bạn sẽ có lợi thế nếu:
- Có kinh nghiệm tích hợp OpenAI, Qwen, Llama, DeepSeek hoặc các LLM/AI model khác vào ứng dụng hoặc hệ thống production.
- Có kinh nghiệm xây dựng AI Agent / Agentic Workflow với LangGraph, LangChain, LlamaIndex, CrewAI hoặc framework tương đương.
- Có kinh nghiệm với AgentOps / AI Observability, như Prometheus, Grafana, OpenTelemetry, Langfuse hoặc các công cụ tương đương.
- Có kinh nghiệm với RAG, Embedding, Vector Database, Tool Calling hoặc Prompt Engineering.
- Có kiến thức về model quantization và tối ưu inference, như INT8/INT4, AWQ, GPTQ, batching, KV Cache hoặc tối ưu GPU/VRAM.
- Có kinh nghiệm với vLLM, Ollama, Triton, TensorRT-LLM hoặc các công nghệ model serving tương đương.
- Có kinh nghiệm với Docker, CI/CD, Linux hoặc cloud platforms.
- Có kinh nghiệm với database như PostgreSQL, MySQL, MongoDB hoặc Redis.
- Có kinh nghiệm làm việc trực tiếp với khách hàng hoặc trong các dự án outsourcing/tích hợp hệ thống.