Thiết kế kiến trúc hệ thống AI Agent sử dụng state machine, orchestrator, delegation patterns.
Quyết định tech stack, design patterns, API contracts cho dự án
Viết ADR (Architecture Decision Records) cho các quyết định công nghệ chính
Đánh giá & adopt công nghệ mới: LLM models, frameworks, tools.
Chịu trách nhiệm chất lượng toàn bộ AI output.
Review toàn bộ Pull Requests để đảm bảo chất lượng, security và performance
Hands-on coding các module core phức tạp, xây dựng coding standards và technical guidelines.
Phối hợp với PO để estimate effort, phân rã epics thành tasks kỹ thuật cụ thể. Đại diện kỹ thuật với stakeholders
Trực tiếp tham gia troubleshoot, on-call escalation, root cause analysis cho sự cố production nghiêm trọng.
Giám sát, báo cáo và lên ngân sách kỹ thuật & LLMOps
Chịu trách nhiệm về bảo mật, giám sát hoạt động tấn công giả lập AI và kiểm tra trước mỗi lần phát hành.
Nghiên cứu áp dụng công nghệ AI mới nhất, đào tạo và phát triển năng lực chuyên môn đội ngũ.
Yêu cầu công việc
Tốt nghiệp Đại học chuyên ngành Khoa học Máy tính, CNTT hoặc tương đương.
Từ 7 năm kinh nghiệm software engineering và từ 3 năm ở vai trò Tech Lead hoặc tương đương.
Ưu tiên có kinh nghiệm xây dựng sản phẩm AI/LLM thực tế, có portfolio/GitHub thể hiện dự án AI đã lead hoặc đóng góp.
Ưu tiên ứng viên từng làm lĩnh vực Blockchain, E-commerce, B2C, B2B2C trên môi trường Production.
Nắm rõ về kiến trúc AI Agent (ReAct, Plan-and-Execute, Multi-Agent).
Thành thạo thiết kế hệ thống Backend quy mô lớn. Kinh nghiệm chuyên sâu về Node.js/TypeScript và Python. Có kinh nghiệm xây dựng Microservices, Event-Driven Architecture, Distributed Systems.
Có kinh nghiệm thực tế với Cloud Platforms (AWS, Azure, GCP, Cloudflare)
Có kiến thức chuyên môn về RAG pipelines nâng cao, Vector Databases (Cloudflare Vectorize), retrieval optimization, LLM APIs (OpenAI, Anthropic), bảo mật AI, hệ thống phân tán, microservices.
Có kiến thức chuyên sâu về metrics đánh giá AI, CI/CD pipelines, Docker, monitoring chuyên sâu, observability, quản trị rủi ro kỹ thuật, ADR documentation, LLMOps tooling, AI governance
Có kinh nghiệm phản ứng sự cố: phân loại mức độ nghiêm trọng, hỗ trợ phân tích sau sự cố