Đếm số từ trong câu
Đếm từ là bước đầu của phân tích văn bản, thống kê độ dài bình luận và kiểm tra giới hạn nội dung. Văn bản thật thường có nhiều khoảng trắng liên tiếp và khoảng trắng ở hai đầu, nê…

Chuỗi ký tự là kiểu dữ liệu cốt lõi trong xử lý văn bản, NLP và trích xuất dữ liệu. Luyện tập các kỹ thuật slicing, phương thức built-in và thuật toán xâu tối ưu.
bài tập có chấm code
Bài tập theo chuyên đề, có đề bài, ví dụ và starter code riêng.
cơ bản
Củng cố nền tảng và làm quen với kỹ thuật cốt lõi.
trung bình
Kết hợp nhiều bước suy luận để vận dụng kiến thức.
nâng cao
Thử thách tối ưu, cấu trúc dữ liệu và thuật toán chuyên sâu.
Index âm, slicing [start:stop:step] và đảo ngược chuỗi.
Sử dụng split, join, strip, replace, lower, upper linh hoạt.
Kiểm tra palindrome, đếm nguyên âm, phụ âm và chuẩn hóa họ tên.
So khớp chuỗi con, rolling hash và tối ưu hóa thời gian xử lý.
Chuỗi trong Python là bất biến (immutable), gán s[0] = 'a' sẽ gây lỗi TypeError.
Quên rằng chỉ số kết thúc trong slicing [a:b] là không bao gồm b.
Trong mỗi mức độ, bài tập được xếp từ dễ nhất đến khó nhất — hãy đi theo số bước.
Nhập xuất, biến, rẽ nhánh và các bước suy luận đơn giản.
Đếm từ là bước đầu của phân tích văn bản, thống kê độ dài bình luận và kiểm tra giới hạn nội dung. Văn bản thật thường có nhiều khoảng trắng liên tiếp và khoảng trắng ở hai đầu, nê…
Đếm ký tự là phép phân tích tần suất đơn giản nhất, dùng để kiểm tra mật khẩu, đếm dấu phân cách trong dữ liệu CSV và thống kê văn bản. Chú ý phân biệt chữ hoa và chữ thường.
Bài toán tìm cực trị trên danh sách từ kèm quy tắc hoà giải là dạng rất phổ biến: khi nhiều từ cùng độ dài, phải chọn từ xuất hiện trước. Đây là ví dụ điển hình cho việc dùng dấu s…
Thống kê loại ký tự là bước kiểm tra chất lượng dữ liệu: mật khẩu có đủ chữ hoa không, dữ liệu nhập có bị viết hoa toàn bộ không, trường tên có đúng định dạng không. Điểm cần chú ý…
Viết hàm rle_codec(action: str, data: str) -> str:
In đúng kết quả yêu cầu.
Vòng lặp, mảng một chiều, chuỗi và hàm ở mức cơ bản.
In đúng kết quả yêu cầu.
In đúng kết quả yêu cầu.
In đúng kết quả yêu cầu.
In đúng kết quả yêu cầu.
In đúng kết quả yêu cầu.
Bài tổng hợp nhẹ, sẵn sàng bước sang mức trung bình.
In đúng kết quả yêu cầu.
Mã Caesar dịch mỗi chữ cái đi k vị trí trong bảng chữ cái và quay vòng khi vượt z. Đây là bài nhập môn kinh điển về số học modulo trên ký tự, cũng là bước đệm để hiểu mã hoá thay t…
Hai chuỗi là đảo chữ khi chúng có cùng đa tập ký tự — cùng ký tự với cùng số lần xuất hiện, chỉ khác thứ tự. Kiểm tra này dùng trong trò chơi chữ, phát hiện trùng lặp dữ liệu và ch…
Sắp xếp theo tiêu chí phụ (độ dài) là bài luyện dùng hàm khoá key và hiểu tính ổn định của sắp xếp: khi hai phần tử bằng khoá, thứ tự ban đầu phải được giữ nguyên. Đây là nền tảng…
Viết hàm extract_top_k_words(text: str, k: int, stop_words: set[str] | None = None) -> list[tuple[str, int]]:
Viết hàm roman_numeral_converter(value: int | str) -> str | int:
Khi nạp biến môi trường từ file .env, toàn bộ giá trị đều là chuỗi str. Ta cần chuyển đổi an toàn sang các kiểu dữ liệu thực tế theo schema.
Khi sinh viên đăng ký tài khoản tại AI Empire Academy, dữ liệu họ tên người dùng nhập từ bàn phím thường chứa nhiều khoảng trắng thừa ở đầu, cuối và giữa các từ, cũng như viết hoa…
Trong hệ thống NLP phân tích văn bản của AI Empire Academy, cần kiểm tra xem một cụm từ hoặc mã định danh có phải là chuỗi đối xứng (Palindrome) hay không.
Trong hệ thống quét mẫu dữ liệu độc hại và lọc từ khóa của AI Empire Academy, ta cần tìm kiếm tất cả các vị trí xuất hiện của một chuỗi mẫu pattern trong một đoạn văn bản dài text.