Luận án tiến sĩ về khử nhiễu ảnh CT liều thấp - Nguyễn Thành Trung
Luận án tiến sĩ nghiên cứu phát triển phương pháp khử nhiễu ảnh CT liều thấp, nâng cao chất lượng hình ảnh trong điện tử viễn thông.
Năm xuất bản
Số trang
114
Thời gian đọc
18 phút
Lượt xem
1
Lượt tải
0
Phí lưu trữ
40 Point
Tổng quan nhanh
- Chủ đề:
- Tổng quan về khử nhiễu ảnh CT liều thấp & thách thức
- Số trang:
- 114 trang
- Trường:
- Trường Đại học Công nghệ, Đại học Quốc gia Hà Nội
- Chuyên ngành:
- Kỹ thuật điện tử
- Tác giả:
- Nguyen Thanh Trung
- Năm:
- 2023
Tóm tắt nội dung luận án
I.Tổng quan về khử nhiễu ảnh CT liều thấp thách thức
Nghiên cứu này tập trung vào giải quyết vấn đề nhiễu trong ảnh chụp CT liều thấp (LDCT). Chụp CT liều thấp giúp giảm đáng kể liều bức xạ cho bệnh nhân, nhưng đồng thời làm tăng mức độ nhiễu. Nhiễu này gây khó khăn trong việc chẩn đoán hình ảnh chính xác. Việc cải thiện chất lượng ảnh CT liều thấp là yếu tố then chốt. Điều này đảm bảo an toàn bệnh nhân mà vẫn duy trì hiệu quả chẩn đoán.
1.1. Ảnh hưởng của nhiễu đến chất lượng ảnh CT
Nhiễu trong ảnh CT liều thấp làm mờ các chi tiết quan trọng. Nó cũng có thể tạo ra các hiện vật gây hiểu lầm. Các bác sĩ gặp khó khăn trong việc nhận diện cấu trúc mô bệnh. Chất lượng ảnh CT thấp ảnh hưởng trực tiếp đến độ tin cậy của chẩn đoán. Do đó, các thuật toán khử nhiễu ảnh là cần thiết. Chúng giúp khôi phục thông tin hình ảnh.
1.2. Các phương pháp khử nhiễu ảnh CT truyền thống
Nhiều phương pháp khử nhiễu ảnh truyền thống đã được áp dụng. Chúng bao gồm các bộ lọc tuyến tính và phi tuyến. Tuy nhiên, các phương pháp này thường có nhược điểm. Chúng có thể làm mất đi các chi tiết ảnh nhỏ. Các đường viền quan trọng có thể bị làm mờ. Hiệu quả của chúng hạn chế trong môi trường nhiễu cao. Cần có những giải pháp tiên tiến hơn để bảo toàn chi tiết ảnh.
1.3. Nhu cầu giảm liều bức xạ trong chụp CT
Giảm liều bức xạ là một ưu tiên hàng đầu trong xử lý ảnh y tế. Chụp CT liều thấp (LDCT) đóng vai trò quan trọng trong an toàn bệnh nhân. Nó giảm thiểu nguy cơ phơi nhiễm bức xạ. Tuy nhiên, việc giảm liều đòi hỏi công nghệ xử lý ảnh tiên tiến. Công nghệ này phải bù đắp sự gia tăng nhiễu. Mục tiêu là tạo ra ảnh chất lượng cao. Ảnh phải đảm bảo khả năng chẩn đoán chính xác.
II.Phát triển thuật toán khử nhiễu CT bằng biểu diễn thưa
Nghiên cứu khám phá tiềm năng của biểu diễn thưa trong khử nhiễu ảnh CT liều thấp. Các thuật toán khử nhiễu mới được phát triển dựa trên nguyên lý này. Biểu diễn thưa là một kỹ thuật hiệu quả trong xử lý ảnh. Nó cho phép tái tạo ảnh gốc từ dữ liệu bị nhiễu. Mục tiêu là nâng cao chất lượng ảnh CT. Đồng thời, bảo toàn các chi tiết giải phẫu quan trọng.
2.1. Cơ sở lý thuyết của biểu diễn thưa trong xử lý ảnh
Biểu diễn thưa giả định rằng một tín hiệu có thể được biểu diễn. Nó dùng một tổ hợp tuyến tính ít các thành phần từ một từ điển cơ sở. Trong khử nhiễu ảnh, tín hiệu nhiễu thường không thưa. Tín hiệu ảnh gốc thì thưa. Điều này giúp dễ dàng tách biệt nhiễu và tín hiệu. Phương pháp này rất mạnh mẽ. Nó giúp bảo toàn chi tiết ảnh khi loại bỏ nhiễu.
2.2. Các thuật toán khử nhiễu ảnh CT đề xuất
Nghiên cứu đã đề xuất các thuật toán khử nhiễu ảnh CT mới. Chúng được xây dựng dựa trên biểu diễn thưa. Các phương pháp này tận dụng tính chất thưa của dữ liệu ảnh. Chúng tái tạo ảnh gốc từ ảnh nhiễu. Các thuật toán này loại bỏ các thành phần nhiễu hiệu quả. Mục tiêu là tăng chất lượng ảnh CT. Hai phương pháp cụ thể là FD-SC1 và FD-SC2 đã được phát triển và kiểm chứng.
2.3. Đánh giá thực nghiệm hiệu năng biểu diễn thưa
Các thuật toán đề xuất được đánh giá thông qua thực nghiệm. Dữ liệu ảnh CT liều thấp được sử dụng. Kết quả cho thấy hiệu quả vượt trội. Các phương pháp này giảm nhiễu tốt hơn đáng kể. Chúng bảo toàn chi tiết ảnh tốt hơn các phương pháp truyền thống. Việc này góp phần vào việc giảm liều bức xạ. Đồng thời, vẫn duy trì khả năng chẩn đoán. Ứng dụng biểu diễn thưa mở ra hướng đi mới trong xử lý ảnh y tế.
III.Ứng dụng mạng nơ ron tích chập khử nhiễu ảnh CT
Học sâu (deep learning) đã tạo ra bước đột phá trong khử nhiễu ảnh CT. Đặc biệt, mạng nơ-ron tích chập (CNN) và Generative Adversarial Networks (GANs) cho thấy tiềm năng lớn. Các phương pháp này học cách phân biệt nhiễu và chi tiết ảnh. Chúng trực tiếp từ dữ liệu ảnh. Điều này cải thiện đáng kể chất lượng ảnh CT liều thấp. Các mô hình học sâu vượt trội so với các phương pháp truyền thống.
3.1. Tiềm năng học sâu deep learning trong khử nhiễu CT
Học sâu đã cách mạng hóa lĩnh vực xử lý ảnh y tế. Nó đặc biệt hiệu quả trong khử nhiễu ảnh CT. Các mô hình học sâu có khả năng học các đặc trưng phức tạp. Chúng học trực tiếp từ dữ liệu ảnh khổng lồ. Điều này giúp chúng vượt trội so với các phương pháp truyền thống. Học sâu cung cấp giải pháp mạnh mẽ. Nó nâng cao chất lượng ảnh CT liều thấp.
3.2. Mạng nơ ron tích chập CNN và kiến trúc đề xuất
Nghiên cứu phát triển các kiến trúc mạng nơ-ron tích chập (CNN) tiên tiến. Chúng được tối ưu hóa cho khử nhiễu ảnh CT. Các mô hình như FD-VGG và DRN-LDCT đã được khám phá. Các mạng này sử dụng nhiều lớp tích chập. Chúng học các ánh xạ phức tạp từ ảnh nhiễu sang ảnh gốc. Mục tiêu là loại bỏ nhiễu hiệu quả. Đồng thời, bảo toàn chi tiết ảnh và cấu trúc mô giải phẫu.
3.3. Các mô hình Generative Adversarial Networks GANs
Generative Adversarial Networks (GANs) cũng được nghiên cứu. GANs là một nhánh mạnh mẽ của học sâu. Chúng tạo ra ảnh chất lượng cao. GANs học cách tạo ra ảnh giống ảnh thật nhất có thể. Điều này rất hữu ích trong khử nhiễu ảnh CT liều thấp. Mô hình phát sinh tạo ảnh sạch. Mô hình phân biệt đánh giá ảnh. Sự cạnh tranh này dẫn đến kết quả khử nhiễu vượt trội. GANs hứa hẹn cải thiện đáng kể chất lượng ảnh CT.
IV.Hiệu quả các phương pháp khử nhiễu ảnh CT liều thấp
Các phương pháp khử nhiễu ảnh CT liều thấp đề xuất mang lại hiệu quả cao. Chúng cải thiện chất lượng ảnh CT rõ rệt. Ảnh sau xử lý giảm nhiễu đáng kể. Đồng thời, các chi tiết giải phẫu được bảo toàn nguyên vẹn. Điều này quan trọng cho chẩn đoán chính xác và nâng cao an toàn bệnh nhân. Các thuật toán này góp phần tối ưu hóa quy trình chụp CT.
4.1. Cải thiện chất lượng ảnh CT liều thấp đáng kể
Các phương pháp đã chứng minh khả năng cải thiện chất lượng ảnh CT liều thấp. Ảnh sau khi khử nhiễu có độ rõ nét cao hơn. Chúng giúp bác sĩ dễ dàng nhận diện cấu trúc mô. Các bất thường nhỏ cũng được phát hiện rõ ràng hơn. Điều này nâng cao giá trị y tế của ảnh CT liều thấp. Hiệu quả này góp phần vào việc chẩn đoán chính xác hơn.
4.2. Bảo toàn chi tiết ảnh và an toàn bệnh nhân tối ưu
Mục tiêu chính là bảo toàn chi tiết ảnh. Các phương pháp đã chứng minh khả năng này. Chúng loại bỏ nhiễu mà không làm mờ các cạnh. Các cấu trúc nhỏ không bị biến dạng. Điều này trực tiếp hỗ trợ an toàn bệnh nhân. Giảm liều bức xạ không ảnh hưởng đến chất lượng chẩn đoán. Bệnh nhân nhận được cả liều bức xạ thấp và ảnh chẩn đoán đáng tin cậy.
4.3. Hướng phát triển và kiến nghị mở rộng nghiên cứu
Nghiên cứu mở ra nhiều hướng phát triển tiềm năng. Cần tiếp tục tối ưu hóa các thuật toán khử nhiễu. Việc kết hợp các kỹ thuật học sâu tiên tiến hơn là cần thiết. Khám phá các mô hình Generative Adversarial Networks (GANs) phức tạp hơn. Cần thử nghiệm trên các bộ dữ liệu đa dạng. Mở rộng ứng dụng cho các loại ảnh y tế khác. Mục tiêu là tiếp tục nâng cao chất lượng ảnh CT. Đồng thời, giảm thiểu rủi ro cho bệnh nhân.
Mục lục chi tiết luận án
Tải xuống file đầy đủ để xem toàn bộ nội dung
Tải đầy đủ (114 trang)Nội dung chính
Tổng quan về luận án
Chụp cắt lớp vi tính (Computed Tomography - CT) giữ vai trò then chốt trong chẩn đoán hình ảnh y khoa hiện đại nhờ khả năng tái tạo giải phẫu lát cắt ngang có độ chính xác cao. Tuy nhiên, việc phơi nhiễm phóng xạ tia X liều cao tiềm ẩn rủi ro đột biến gen và phát triển khối u ác tính. Nhằm tuân thủ nguyên lý bảo vệ bức xạ ALARA (As Low As Reasonably Achievable), việc giảm liều lượng phóng xạ (Low-Dose CT - LDCT) là yêu cầu y tế cấp bách. Mặc dù vậy, giảm cường độ dòng bóng phát tia X dẫn đến sự gia tăng mạnh mẽ của nhiễu lượng tử Poát-xông (Poisson quantum noise) và nhiễu điện tử, làm suy giảm nghiêm trọng tỉ số tín hiệu trên nhiễu, làm mờ đường biên giải phẫu và phát sinh các yếu tố giả (artifacts).
Khoảng trống nghiên cứu (research gap) cốt lõi nằm ở sự đánh đổi mang tính hệ thống giữa năng lực triệt tiêu nhiễu và khả năng bảo toàn các chi tiết giải phẫu cực nhỏ (kích thước từ 3 đến 5 điểm ảnh như vi mạch máu, bờ tổn thương, nốt vôi hóa, đường vân phổi). Các phương pháp lọc truyền thống (Gaussian, Bilateral, biến phân toàn phần TV theo Rudin, Osher & Fatemi, 1992) thường gây hiện tượng làm trơn quá mức (over-smoothing), trong khi các mô hình biểu diễn thưa cổ điển (K-SVD theo Elad & Aharon, 2006; MRFD theo Trịnh Đình Hoàn et al., 2014) phụ thuộc chặt chẽ vào ứng viên từ điển ngoại sinh. Đồng thời, các kiến trúc học sâu chuyển giao từ xử lý ảnh tự nhiên như FFDNet (Zhang et al., 2018) hay SAR-DRN (Zhang et al., 2017) bộc lộ hạn chế do giả định sai về nhiễu Gauss đồng nhất và hàm mất mát sai số bình phương trung bình (MSE loss) làm mất mát thông tin cấu trúc vi mô.
Luận án xác lập hai câu hỏi và hai giả thuyết nghiên cứu chính:
- Câu hỏi nghiên cứu 1 (RQ1): Làm thế nào để kết hợp kỹ thuật phân tách dải tần số với lý thuyết biểu diễn thưa nhằm ước lượng chính xác thành phần tần số cao bị che lấp bởi nhiễu mà không làm phát sinh yếu tố giả trong điều kiện tài nguyên tính toán giới hạn?
- Câu hỏi nghiên cứu 2 (RQ2): Cấu trúc mạng nơ-ron tích chập (CNN) và hàm mất mát cần được tái thiết kế như thế nào để loại bỏ sự phụ thuộc vào bản đồ nhiễu nhân tạo, mở rộng trường nhận thức và thích ứng tối ưu với đặc tính phân bố nhiễu phức tạp của ảnh CT liều thấp?
- Giả thuyết 1 (H1): Phương pháp phân tách tần số kết hợp biểu diễn thưa thích nghi (FD-SC1, FD-SC2) cải thiện vượt trội chỉ số tương đồng cấu trúc (SSIM) và chỉ số tương đồng đặc trưng (FSIM) so với các thuật toán lọc không cục bộ (NLM) và khối 3D (BM3D).
- Giả thuyết 2 (H2): Mô hình học sâu tích hợp hàm mất mát thu cảm (FD-VGG) cùng cấu trúc tích chập giãn mở rộng trường nhận thức (DRN-LDCT) cho phép tái tạo ảnh LDCT ở mức liều xạ giảm 25% đạt chất lượng tương đương ảnh liều thường quy (NDCT).
Nghiên cứu được triển khai trên tập dữ liệu chuẩn quốc tế 2016 Low Dose CT Grand Challenge của Mayo Clinic kết hợp dữ liệu giải phẫu phổi, bụng thực tế từ Bệnh viện Trung ương Thái Nguyên. Ý nghĩa đột phá của công trình là thiết lập khung xử lý hậu kỳ hoàn chỉnh, vừa cung cấp giải pháp tính toán nhẹ cho cơ sở y tế hạn chế phần cứng, vừa mang lại các mô hình học sâu hiện đại cho các trung tâm chẩn đoán hình ảnh chuyên sâu.
Literature Review và Positioning
Nghiên cứu hậu xử lý ảnh CT liều thấp phát triển qua ba dòng tiếp cận chính:
- Dòng xử lý không gian và biến phân: Khởi đầu từ các bộ lọc tuyến tính và phi tuyến kinh điển, Rudin, Osher và Fatemi (1992) đề xuất mô hình Total Variation (TV) nhằm tối thiểu hóa gradient năng lượng. Buades, Coll và Morel (2005) mở rộng sang phương pháp lọc trung bình không cục bộ (Non-Local Means - NLM), khai thác tính tự tương đồng trong ảnh. Tiếp đó, Dabov, Foi, Katkovnik và Egiazarian (2007) thiết lập chuẩn mực với thuật toán BM3D (Block Matching and 3D Filtering), phối hợp lọc cộng tác miền biến đổi trực giao DCT và Haar. Tuy nhiên, các kỹ thuật này bộc lộ nhược điểm cố hữu khi xử lý ảnh y tế: làm mờ các bờ tổn thương mềm và xóa nhòa cấu trúc sợi mô kẽ.
- Dòng biểu diễn thưa và khai thác miếng ảnh ngoại sinh: Aharon, Elad và Bruckstein (2006) phát triển thuật toán K-SVD để học từ điển thưa thích nghi. Nhằm bảo tồn chi tiết nhỏ, Trịnh Đình Hoàn et al. (2014) đề xuất mô hình MRFD (Markov Random Field Denoising), phân rã ảnh thành các dải tần số thấp, trung bình, cao và ước lượng miếng ảnh tần số cao thông qua trường ngẫu nhiên Markov từ cơ sở dữ liệu ảnh mẫu NDCT. Mặc dù khắc phục được hiện tượng làm trơn, MRFD vấp phải rào cản tính toán lớn và phụ thuộc nghiêm ngặt vào sự tồn tại của miếng ảnh ứng viên chính xác trong cơ sở dữ liệu mẫu.
- Dòng học sâu và mạng nơ-ron tích chập (CNN): Chen et al. (2017) giới thiệu mạng mã hóa - giải mã phần dư RED-CNN, tạo bước nhảy vọt về chỉ số PSNR. Yang et al. (2018) ứng dụng mạng đối kháng sinh Wasserstein kết hợp mạng VGG (WGAN-VGG) nhằm phục hồi kết cấu thị giác. Zhang et al. (2018) công bố mạng FFDNet với ưu thế tốc độ và bản đồ mức nhiễu khả biến cho ảnh tự nhiên, trong khi Zhang et al. (2017) đề xuất mạng SAR-DRN sử dụng tích chập giãn (dilated convolution) khử nhiễu đốm cho ảnh radar khẩu độ tổng hợp.
┌────────────────────────────────────────────────────────┐
│ CÁC TIẾP CẬN KHỬ NHIỄU ẢNH CT LIỀU THẤP │
└──────────────────────────┬─────────────────────────────┘
│
┌───────────────────────────────────┼──────────────────────────────────┐
▼ ▼ ▼
┌──────────────────┐ ┌──────────────────┐ ┌──────────────────┐
│ Lọc không gian │ │ Biểu diễn thưa & │ │ Học sâu │
│ & Biến phân │ │ Miếng ảnh mẫu │ │ (CNN) │
├──────────────────┤ ├──────────────────┤ ├──────────────────┤
│• TV (1992) │ │• K-SVD (2006) │ │• RED-CNN (2017) │
│• NLM (2005) │ │• MRFD (2014) │ │• WGAN-VGG (2018) │
│• BM3D (2007) │ │ │ │• FFDNet (2018) │
└────────┬─────────┘ └────────┬─────────┘ └────────┬─────────┘
│ │ │
│ (Over-smoothing) │ (Phụ thuộc mẫu) │ (Sai giả định)
└──────────────────────────────────┼──────────────────────────────────┘
▼
┌──────────────────────────────────┐
│ ĐÓNG GÓP CỦA LUẬN ÁN │
├──────────────────────────────────┤
│ 1. Nhánh nhẹ: FD-SC1 & FD-SC2 │
│ 2. Nhánh sâu: FD-VGG & DRN-LDCT │
└──────────────────────────────────┘
Trong y văn tồn tại hai cuộc tranh luận học thuật sâu sắc:
- Tranh luận 1 (Miền xử lý): Giữa tái tạo lặp từ dữ liệu thô sinogram (Wang et al., 2006) và hậu xử lý trên miền ảnh dựng (Chen et al., 2017). Tái tạo lặp cho chất lượng phục hồi cao nhưng đòi hỏi dữ liệu thô độc quyền khó tiếp cận từ các máy chụp thương mại và chi phí thời gian quá lớn. Hậu xử lý trên không gian ảnh dựng có tính tương thích cao và triển khai lâm sàng linh hoạt hơn.
- Tranh luận 2 (Hàm mục tiêu học sâu): Giữa tối ưu hóa sai số khoảng cách pixel (MSE, L2-norm) và tối ưu hóa phân bố thống kê/đặc trưng cảm thụ (Perceptual Loss, GAN). Hàm MSE làm mờ kết cấu giải phẫu cục bộ, trong khi mạng sinh GAN dễ tạo ra các yếu tố giả dạng "ảo giác" (hallucinations), đe dọa trực tiếp đến tính chuẩn xác của chẩn đoán lâm sàng.
Luận án định vị vị trí tiên phong bằng việc bắc nhịp cầu hoàn chỉnh giữa hai miền tri thức: phát triển hệ phương pháp phân rã tần số kết hợp mã hóa thưa (FD-SC1, FD-SC2) giải phóng sự trói buộc của cơ sở dữ liệu mẫu trong MRFD, đồng thời tái cấu trúc các mạng CNN nhẹ (FD-VGG, DRN-LDCT) khắc phục triệt để giả định nhiễu Gauss nhân tạo của FFDNet và tối ưu hóa trường tiếp nhận của SAR-DRN. So sánh trực diện với hai công trình quốc tế tiêu biểu là RED-CNN (Chen et al., 2017) và WGAN-VGG (Yang et al., 2018), các mô hình đề xuất đạt hiệu năng vượt trội về bảo toàn độ tương phản và biên cấu trúc mô bệnh học mà không làm tăng đột biến chi phí tính toán.
Đóng góp lý thuyết và khung phân tích
Đóng góp cho lý thuyết
Luận án mở rộng và làm phong phú ba khung lý thuyết nền tảng trong xử lý tín hiệu và thị giác máy tính:
- Lý thuyết Biểu diễn thưa (Sparse Representation Theory): Kế thừa công trình của Donoho (2006), Candès et al. (2006) và Aharon, Elad & Bruckstein (2006), nghiên cứu chứng minh rằng việc phân rã tín hiệu ảnh đa chiều sang không gian tần số giúp véc-tơ hóa các đặc trưng biên và vân bề mặt thành các biểu diễn thưa trên từ điển quá đủ (over-complete dictionary). Khác với K-SVD truyền thống tối ưu hóa trên toàn bộ ảnh gây mất mát chi tiết, phương pháp đề xuất áp dụng chuẩn $\ell_0$ và $\ell_1$ chuyên biệt cho dải tần số trung bình và cao, xác lập mối quan hệ tuyến tính cục bộ giữa các miếng ảnh thành phần.
- Lý thuyết Phân tích đa độ phân giải tần số (Multiresolution Frequency Analysis): Mở rộng nguyên lý biến đổi không gian - tần số, chứng minh rằng phổ năng lượng của nhiễu trong ảnh LDCT phân bố chủ yếu ở miền tần số cao, trong khi cấu trúc hình học giải phẫu phân bố trải rộng từ tần số thấp đến trung bình. Việc tách biệt các dải phổ cho phép áp dụng các toán tử lọc chọn lọc mà không làm suy hao tín hiệu hữu ích.
- Lý thuyết Học biểu diễn sâu và Cảm thụ thị giác (Deep Representation & Perceptual Learning): Thách thức quan điểm truyền thống dựa trên tối ưu hóa khoảng cách Euclide trong không gian điểm ảnh ($L_2$ Loss). Luận án tích hợp lý thuyết cảm thụ thị giác thông qua không gian đặc trưng ẩn (feature latent space) của mạng VGG, chứng minh rằng việc tối thiểu hóa khoảng cách đặc trưng phi tuyến tính bảo toàn hiệu quả độ tương phản toàn cục và vi cấu trúc giải phẫu.
Mô hình lý thuyết tổng quát xác lập mối quan hệ giữa ảnh nhiễu quan sát $Y$, ảnh sạch $X$ và nhiễu phi đồng nhất $\mathcal{N}$: $$\mathbf{P}_1: Y = X_L + X_M + X_H + \mathcal{N}$$ $$\mathbf{P}_2: \hat{X} = X_L + \mathcal{D}_M \boldsymbol{\alpha}M + \mathcal{D}H \boldsymbol{\alpha}H \quad \text{với} \quad |\boldsymbol{\alpha}k|0 \le T_0$$ $$\mathbf{P}3: \hat{X}{CNN} = \arg\min{\theta} \left[ \mathcal{L}{MSE}(f\theta(Y), X) + \lambda \mathcal{L}{Perceptual}(f\theta(Y), X) \right]$$
Khung phân tích độc đáo
Khung phân tích của luận án tích hợp chặt chẽ:
- Toán tử lọc phân rã phổ tần số 2D;
- Giải thuật tối ưu hóa mã hóa thưa (Orthogonal Matching Pursuit - OMP);
- Mạng tích chập sâu mở rộng trường nhận thức với các lớp tích chập giãn và khối chuẩn hóa theo lô (Batch Normalization).
┌────────────────────────────────────────────────────────────────────────┐
│ KHUNG PHÂN TÍCH TỔNG HỢP CỦA LUẬN ÁN │
└───────────────────────────────────┬────────────────────────────────────┘
│
┌──────────────────────────┴──────────────────────────┐
▼ ▼
┌──────────────────────────────────┐ ┌──────────────────────────────────┐
│ HỆ PHƯƠNG PHÁP BIỂU DIỄN THƯA │ │ HỆ PHƯƠNG PHÁP HỌC SÂU (CNN) │
│ (FD-SC1 & FD-SC2) │ │ (FD-VGG & DRN-LDCT) │
├──────────────────────────────────┤ ├──────────────────────────────────┤
│• Phân tách phổ tần 2D: L, M, H │ │• Loại bỏ bản đồ nhiễu cố định │
│• Bộ lọc thông thấp Gauss/bậc hai │ │• Tích hợp Perceptual Loss (VGG) │
│• Mã hóa thưa OMP qua từ điển D │ │• Tích chập giãn (Dilated Conv) │
│• Tái tạo ảnh không trơn quá mức │ │• Tích hợp Batch Normalization │
└──────────────────────────────────┘ └──────────────────────────────────┘
Đóng góp khái niệm cốt lõi: Khái niệm "chi tiết nhỏ" được định lượng hóa chuẩn xác trong luận án là các cấu trúc giải phẫu lập thể được hình thành từ 3 đến 5 điểm ảnh trở lên, có tính định hướng hình học rõ rệt (khác với nhiễu ngẫu nhiên phân tán) và mang giá trị bệnh học quan trọng.
Điều kiện biên (boundary conditions): Hệ phương pháp biểu diễn thưa phát huy tối đa hiệu quả trong điều kiện tập ảnh mẫu giới hạn và tài nguyên phần cứng thấp; trong khi hệ phương pháp học sâu đòi hỏi tập dữ liệu cặp ảnh lớn (LDCT-NDCT) và nền tảng tính toán đồ họa hiệu năng cao.
Phương pháp nghiên cứu tiên tiến
Thiết kế nghiên cứu
Luận án tuân thủ triết lý Thực chứng (Positivism) kết hợp Thực tế phản biện (Critical Realism), dựa trên thực nghiệm định lượng chính xác, kiểm chứng lặp lại và phân tích so sánh khách quan. Thiết kế nghiên cứu đa tầng (multi-level design) bao gồm:
- Tầng 1 (Cấp độ miếng ảnh - Patch level): Khai thác tính chất tương quan cục bộ thông qua các miếng ảnh kích thước $k \times k$ gối nhau ($k \in {5, 7, 9}$);
- Tầng 2 (Cấp độ không gian tần số - Sub-band level): Phân tích tương tác giữa các dải tần số $X_L, X_M, X_H$;
- Tầng 3 (Cấp độ toàn thể ảnh lát cắt - Global slice level): Tái tạo ma trận ảnh $512 \times 512$ điểm ảnh và đánh giá toàn diện các chỉ số tương quan.
Mẫu nghiên cứu sử dụng tập dữ liệu chuẩn mực quốc tế Mayo Clinic 2016 Low Dose CT Grand Challenge gồm hàng ngàn lát cắt quét CT của 10 bệnh nhân ẩn danh (chụp ở vùng phổi, ngực, bụng và gan), chứa các nốt tổn thương được định vị tọa độ chính xác bởi các chuyên gia y tế. Tiêu chí chọn mẫu: loại bỏ các lát cắt lỗi quang học nặng, chọn lọc các cặp ảnh LDCT (mức liều thấp giảm bức xạ) và NDCT (mức liều thường quy chuẩn) chụp đồng nhất trên cùng tọa độ giải phẫu.
Quy trình nghiên cứu
Quy trình thực nghiệm được chuẩn hóa nghiêm ngặt qua các giai đoạn:
- Tiền xử lý và phân tách dữ liệu: Chuẩn hóa miền giá trị cường độ Hounsfield Unit (HU), trích xuất các tập miếng ảnh huấn luyện có bước trượt xen phủ (overlapping stride);
- Thiết kế bộ lọc và mã hóa thưa (FD-SC1, FD-SC2): Sử dụng các bộ lọc thông thấp 2D để tách dải tần số, áp dụng giải thuật truy đuổi khớp trực giao (OMP) giải bài toán tối ưu hóa ràng buộc: $$\min_{\boldsymbol{\alpha}_i} |\boldsymbol{\alpha}_i|_0 \quad \text{thỏa mãn} \quad |R_i Y_M - \mathcal{D}_M \boldsymbol{\alpha}_i|_2^2 \le \epsilon$$ Từ điển thích nghi được cập nhật thông qua phân giải giá trị riêng trực giao (SVD), sau đó tái tạo các miếng ảnh tần số cao và tổng hợp ảnh đầu ra theo công thức trung bình có trọng số;
- Tái cấu trúc mạng học sâu (FD-VGG, DRN-LDCT):
- Đối với FD-VGG: Loại bỏ hoàn toàn kênh đầu vào bản đồ nhiễu (noise map) của FFDNet do không tương thích với nhiễu phi đồng nhất; xây dựng hàm mất mát kết hợp: $$\mathcal{L}{total} = \mathcal{L}{MSE} + \gamma \mathcal{L}{VGG}$$ với $\mathcal{L}{VGG} = \frac{1}{C_j H_j W_j} |\phi_j(\hat{X}) - \phi_j(X)|_2^2$, trong đó $\phi_j$ là bản đồ đặc trưng trích xuất từ tầng thứ $j$ của mạng pre-trained VGG-19;
- Đối với DRN-LDCT: Bổ sung tầng tích chập tiền xử lý và hậu xử lý ($3 \times 3$), kết hợp các tầng tích chập giãn với tỷ lệ giãn (dilation rate) $r \in {1, 2, 3, 4}$ nhằm mở rộng trường nhận thức từ $7 \times 7$ lên $33 \times 33$ điểm ảnh mà không làm tăng số lượng trọng số; chèn các khối chuẩn hóa theo lô (BN) sau mỗi lớp tích chập nhằm gia tốc hội tụ và ổn định độ lệch gradient;
- Đối soát độ tin cậy và giá trị kiểm định: Sử dụng kỹ thuật kiểm định chéo (cross-validation), đo lường tính bất biến của thuật toán trước các mức nhiễu nhân tạo $\sigma \in {10, 15, 20, 25, 30}$ và dữ liệu thực tế.
┌────────────────────────────────────────────────────────────────────────┐
│ QUY TRÌNH THỰC NGHIỆM CHUẨN HÓA │
└───────────────────────────────────┬────────────────────────────────────┘
│
▼
┌─────────────────────────────────────────────────────────┐
│ Dữ liệu chuẩn Mayo Clinic Grand Challenge (10 ca) │
│ Chuẩn hóa Hounsfield Unit (512x512) │
└────────────────────────────┬────────────────────────────┘
│
┌──────────────────────────┴──────────────────────────┐
▼ ▼
┌──────────────────────────────────┐ ┌──────────────────────────────────┐
│ NHÁNH BIỂU DIỄN THƯA │ │ NHÁNH HỌC SÂU │
├──────────────────────────────────┤ ├──────────────────────────────────┤
│1. Phân tách tần số L, M, H │ │1. FD-VGG: Bỏ noise map, thêm │
│2. Trích xuất Patch kxk │ │ Perceptual Loss │
│3. Khử nhiễu qua OMP/K-SVD │ │2. DRN-LDCT: Tích chập giãn + BN │
│4. Tổng hợp trung bình trọng số │ │3. Tối ưu hóa qua Adam Optimizer │
└────────────────┬─────────────────┘ └────────────────┬─────────────────┘
│ │
└──────────────────────────┬────────────────┘
│
▼
┌─────────────────────────────────────────────────────────┐
│ ĐÁNH GIÁ VÀ ĐỐI SOÁT │
│• Định lượng: PSNR (dB), SSIM, FSIM, MSE, Tốc độ │
│• Định tính: Thẩm định mù đôi Bác sĩ BV TW Thái Nguyên │
└─────────────────────────────────────────────────────────┘
Phân tích dữ liệu
Mô hình được huấn luyện và kiểm thử trên hệ thống GPU hiệu năng cao với framework PyTorch/TensorFlow, sử dụng thuật toán tối ưu hóa Adam với tốc độ học khởi tạo $10^{-4}$, suy giảm theo hàm cosine. Các kiểm tra độ vững chắc (robustness checks) được thực hiện bằng cách thay đổi độ sâu mạng, kích thước miếng ảnh ($5 \times 5$, $7 \times 7$, $9 \times 9$) và tham số chính quy hóa $\lambda$.
Phát hiện đột phá và implications
Những phát hiện then chốt
- Hiệu năng vượt bậc của giải pháp phân rã tần số (FD-SC2): Thực nghiệm chứng minh phương pháp FD-SC2 đạt chỉ số PSNR trung bình cao hơn phương pháp MRFD từ 1.2 dB đến 1.8 dB trên các vùng giải phẫu phức tạp, đồng thời giảm thời gian tính toán hơn 60% nhờ việc loại bỏ thủ tục tìm kiếm ứng viên toàn cục trên cơ sở dữ liệu mẫu.
- Khắc phục triệt để hiện tượng làm trơn quá mức bằng FD-VGG: Bằng việc loại bỏ bản đồ nhiễu và tích hợp hàm mất mát thu cảm $\mathcal{L}_{VGG}$, mạng FD-VGG khôi phục độ tương phản sắc nét tại các vùng chuyển tiếp mô mềm, đạt chỉ số FSIM vượt trội ($> 0.985$) so với FFDNet nguyên bản ($0.962$).
- Mở rộng trường nhận thức tối ưu với DRN-LDCT: Mạng DRN-LDCT với cấu trúc tích chập giãn nhiều tỷ lệ và chuẩn hóa theo lô đạt chất lượng khử nhiễu tương đương với mạng RED-CNN và WGAN-VGG nhưng sở hữu dung lượng mô hình nhỏ hơn 45% và tốc độ xử lý nhanh hơn 2.3 lần trên mỗi lát cắt $512 \times 512$.
- Phục hồi chính xác các tổn thương vi mô: Tại vị trí nốt tổn thương vùng phổi có tọa độ điểm ảnh $(X=190, Y=394)$, các phương pháp đề xuất tái tạo hoàn hảo ranh giới nốt và cấu trúc sợi phế huyết quản, không làm mờ hoặc biến dạng tổn thương như các bộ lọc NLM, BM3D hay K-SVD cổ điển.
- Định lượng hóa khả năng giảm liều xạ: Thực nghiệm lâm sàng chứng minh: "kết quả nghiên cứu cho thấy việc ứng dụng CNN vào khử nhiễu ảnh CT liều thấp có thể giúp giảm liều lượng phóng xạ xuống 25% so với liều lượng tiêu chuẩn mà chất lượng hình ảnh gần như không thay đổi".
Bảng so sánh tổng hợp hiệu năng định lượng giữa các phương pháp:
┌─────────────────┬──────────────┬──────────────┬──────────────┬──────────────────┐
│ Phương pháp │ PSNR (dB) │ SSIM │ FSIM │ Thời gian/ảnh (s)│
├─────────────────┼──────────────┼──────────────┼──────────────┼──────────────────┤
│ Ảnh gốc (LDCT) │ 22.45 │ 0.6823 │ 0.8120 │ - │
│ BM3D [18] │ 27.12 │ 0.8415 │ 0.9102 │ 4.85 │
│ MRFD [73] │ 28.34 │ 0.8650 │ 0.9245 │ 12.60 │
│ FD-SC2 (Đề xuất)│ 29.85 │ 0.8920 │ 0.9410 │ 3.20 │
│ RED-CNN [13] │ 31.20 │ 0.9210 │ 0.9680 │ 0.42 │
│ WGAN-VGG [77] │ 30.85 │ 0.9150 │ 0.9640 │ 0.65 │
│ FD-VGG (Đề xuất)│ 31.95 │ 0.9340 │ 0.9855 │ 0.28 │
│ DRN-LDCT(Đề xuất│ 32.10 │ 0.9385 │ 0.9890 │ 0.18 │
└─────────────────┴──────────────┴──────────────┴──────────────┴──────────────────┘
Implications đa chiều
- Về mặt lý thuyết: Xác lập nguyên lý phân ly miền tần số kết hợp biểu diễn thưa và học sâu như một mô hình chuẩn mực trong giải quyết bài toán ngược phi tuyến tính của ảnh y sinh.
- Về mặt phương pháp luận: Cung cấp phương pháp thiết kế mạng tích chập giãn nhẹ kết hợp chuẩn hóa theo lô, giải quyết xung đột kinh điển giữa kích thước mô hình, tốc độ suy luận và chất lượng phục hồi cấu trúc vi mô.
- Về mặt thực tiễn y khoa: Đưa ra công cụ hậu xử lý trực tiếp tích hợp vào hệ thống lưu trữ và truyền hình ảnh y tế (PACS) tại các bệnh viện, giúp bác sĩ chẩn đoán phát hiện sớm ung thư phổi, tổn thương gan và vi xuất huyết mà không bị đánh lạc hướng bởi nhiễu hay yếu tố giả.
- Về mặt chính sách y tế: Cung cấp căn cứ khoa học vững chắc để các cơ quan quản lý y tế ban hành quy chuẩn giảm liều tia X thường quy trong tầm soát diện rộng, bảo vệ an toàn phóng xạ cho hàng triệu bệnh nhân.
Limitations và Future Research
Luận án thẳng thắn thừa nhận các giới hạn nghiên cứu:
- Giới hạn chiều không gian: Nghiên cứu chủ yếu tập trung xử lý trên từng lát cắt 2D độc lập, chưa khai thác triệt để mối tương quan giải phẫu liên tục 3D giữa các lát cắt liền kề (inter-slice spatial correlation);
- Tính phụ thuộc vào dữ liệu cặp chuẩn: Các mô hình học sâu đề xuất vẫn đòi hỏi tập dữ liệu huấn luyện cặp ảnh song song (LDCT - NDCT) cùng tọa độ, vốn rất khó thu thập trong điều kiện thực hành lâm sàng đa dạng;
- Độ phức tạp tính toán của nhánh biểu diễn thưa: Mặc dù FD-SC2 đã tối ưu hóa tốc độ, thời gian xử lý vẫn chưa đạt mức thời gian thực (real-time processing) dưới 100 mili-giây như các mạng CNN.
Chương trình nghiên cứu 10 năm tới mở ra các hướng phát triển:
- Hướng 1: Phát triển các kiến trúc Vision Transformers (Swin Transformer 3D) kết hợp cơ chế chú ý không gian - thời gian (spatiotemporal attention) để xử lý khối thể tích CT 3D;
- Hướng 2: Nghiên cứu mô hình học tự giám sát (Self-Supervised Learning) và học không ghép cặp (Unpaired Learning / CycleGAN / Noise2Void) cho phép khử nhiễu trực tiếp từ ảnh LDCT độc lập mà không cần ảnh chuẩn NDCT;
- Hướng 3: Tích hợp thuật toán trực tiếp vào phần cứng vi mạch chuyên dụng (FPGA/ASIC) tại đầu dò máy CT để khử nhiễu theo thời gian thực tại nguồn thu nhận tín hiệu.
Tác động và ảnh hưởng
- Học thuật: Công trình đóng góp hệ phương pháp luận hoàn chỉnh với 5 bài báo khoa học chất lượng cao công bố trên các tạp chí và kỷ yếu hội nghị chuyên ngành uy tín; tạo tiền đề cho các nghiên cứu tiếp nối về xử lý bài toán ngược trong ảnh y học hạt nhân (PET, SPECT) và ảnh cộng hưởng từ (MRI).
- Công nghiệp thiết bị y tế: Mở ra cơ hội chuyển giao công nghệ cho các nhà sản xuất máy chụp CT trong và ngoài nước nhằm nâng cấp phần mềm hậu xử lý cho các dòng máy CT thế hệ cũ (16 lát, 32 lát, 64 lát) mà không cần thay thế phần cứng tốn kém.
- Y tế cộng đồng: Cho phép triển khai các chương trình tầm soát ung thư phổi và bệnh lý lồng ngực bằng LDCT diện rộng hàng năm cho cộng đồng với mức phơi nhiễm phóng xạ chỉ bằng 25% liều tiêu chuẩn, triệt tiêu nguy cơ tích lũy phóng xạ gây ung thư thứ phát.
Đối tượng hưởng lợi
- Nghiên cứu sinh và Giới học thuật: Tiếp cận khung phân tích toán học mẫu mực kết hợp giữa giải tích điều hòa (phân tích tần số), tối ưu hóa lồi (biểu diễn thưa) và học máy hiện đại (CNN).
- Kỹ sư R&D và Chuyên gia AI y tế: Sở hữu các kiến trúc mạng tối ưu hóa cao (FD-VGG, DRN-LDCT) có dung lượng nhỏ, tốc độ thực thi nhanh để đóng gói thành các module AI trong phần mềm chẩn đoán CAD (Computer-Aided Diagnosis).
- Bác sĩ Chẩn đoán hình ảnh: Được cung cấp các hình ảnh CT có tỉ số tín hiệu trên nhiễu cao, bờ tổn thương sắc nét, nâng cao độ nhạy và độ đặc hiệu trong phân loại u lành tính và ác tính.
- Bệnh nhân và Xã hội: Hưởng lợi trực tiếp từ việc giảm thiểu tác hại bức xạ ion hóa, nâng cao an toàn sức khỏe và chất lượng dịch vụ y tế.
Câu hỏi chuyên sâu
1. Đóng góp lý thuyết độc đáo nhất của luận án là gì và đã mở rộng lý thuyết nào? Trả lời: Đóng góp độc đáo nhất là việc thiết lập nguyên lý ước lượng thành phần tần số cao dựa trên biểu diễn thưa có hướng dẫn, mở rộng Lý thuyết Biểu diễn thưa thích nghi của Elad & Aharon (2006). Thay vì giải bài toán tối ưu trên toàn bộ ma trận ảnh gây hiện tượng làm trơn, luận án chứng minh việc phân ly không gian tần số cho phép biến đổi bài toán phục hồi biên phức tạp thành bài toán xấp xỉ tuyến tính thưa cục bộ trên từ điển chuyên biệt dải tần cao.
2. Điểm cải tiến phương pháp luận đột phá so với các công trình quốc tế tiền nhiệm? Trả lời: So với FFDNet của Zhang et al. (2018), mô hình FD-VGG đã dũng cảm loại bỏ bản đồ nhiễu giả định sai và tích hợp hàm mất mát cảm thụ VGG để giải quyết bài toán mờ biên. So với SAR-DRN của Zhang et al. (2017), mạng DRN-LDCT bổ sung các tầng tiền - hậu xử lý và khối Batch Normalization, mở rộng trường nhận thức lên $33 \times 33$ điểm ảnh, tối ưu hóa tuyệt đối cho đặc thù giải phẫu y sinh.
3. Phát hiện bất ngờ nhất có dữ liệu thực nghiệm chứng minh là gì? Trả lời: Phát hiện bất ngờ nhất là mạng tích chập giãn có số tầng ít và cấu trúc nhẹ (DRN-LDCT) lại đạt chỉ số FSIM ($0.9890$) và SSIM ($0.9385$) cao hơn các mạng có kiến trúc phức tạp và số lượng tham số khổng lồ như WGAN-VGG và RED-CNN, đồng thời giảm thời gian xử lý xuống chỉ còn 0.18 giây/ảnh.
4. Luận án có cung cấp quy trình tái lập (Replication Protocol) rõ ràng không? Trả lời: Luận án cung cấp chi tiết toàn bộ siêu tham số: kích thước miếng ảnh ($5 \times 5, 7 \times 7$), tỷ lệ giãn tích chập ($r \in {1, 2, 3, 4}$), kiến trúc từng lớp mạng, hàm mất mát và mô tả chính xác tập dữ liệu mở Mayo Clinic 2016 Grand Challenge, đảm bảo khả năng tái lập thực nghiệm 100%.
5. Bản đồ lộ trình nghiên cứu 10 năm tới được phác thảo như thế nào? Trả lời: Lộ trình chuyển dịch từ xử lý lát cắt 2D sang mô hình không gian khối 3D thích nghi; chuyển hóa từ học có giám sát sang học tự giám sát (Self-Supervised/Zero-Shot Denoising) và thương mại hóa thuật toán nhúng trực tiếp trên phần cứng máy chụp CT.
Kết luận
- Xây dựng thành công hệ phương pháp khử nhiễu ảnh CT liều thấp đa nhánh hoàn chỉnh, giải quyết trọn vẹn sự đánh đổi giữa giảm liều bức xạ và bảo toàn chi tiết vi cấu trúc giải phẫu.
- Đề xuất hai phương pháp FD-SC1 và FD-SC2 kết hợp phân rã tần số 2D và biểu diễn thưa, loại bỏ sự phụ thuộc chặt chẽ vào cơ sở dữ liệu mẫu của phương pháp MRFD kinh điển.
- Phát triển mô hình học sâu FD-VGG loại bỏ bản đồ nhiễu không phù hợp, kết hợp hàm mất mát thu cảm VGG triệt tiêu hoàn toàn hiệu ứng làm trơn quá mức.
- Thiết kế mạng nơ-ron tích chập giãn DRN-LDCT với trường nhận thức mở rộng và khối chuẩn hóa theo lô, đạt hiệu năng xử lý vượt trội với chi phí tính toán thấp.
- Chứng minh thực nghiệm khả năng giảm 25% liều xạ tiêu chuẩn mà vẫn duy trì chất lượng ảnh tương đương liều thường quy NDCT, bảo tồn nguyên vẹn các tổn thương từ 3 đến 5 điểm ảnh.
- Đặt nền móng lý thuyết và thực nghiệm vững chắc, mở ra hướng nghiên cứu mới về học sâu nhẹ và xử lý thích nghi cho toàn bộ hệ thống chẩn đoán hình ảnh y khoa tiên tiến.
Trích đoạn nội dung luận án
Tải xuống để đọc toàn bộĐẠI HỌC QUỐC GIA HÀ NỘI TRƯỜNG ĐẠI HỌC CÔNG NGHỆ NGUYEN THÀNH TRUNG NGHIÊN CỨU VÀ PHÁT TRIỂN CÁC PHƯƠNG PHAP KHỬ NHIÊU ANH CT LIEU THAP LUẬN ÁN TIEN SĨ CONG NGHỆ KY THUAT DIEN TU-VIEN THONG Hà Nội - 2023 ĐẠI HỌC QUỐC GIA HÀ NỘI TRƯỜNG ĐẠI HỌC CÔNG NGHỆ NGUYEN THÀNH TRUNG NGHIÊN CỨU VÀ PHÁT TRIỂN CÁC PHƯƠNG PHÁP KHU NHIÊU ANH CT LIEU THAP Ngành: Công nghệ Ky thuật Điện tử - Viễn thông Chuyên ngành: Kỹ thuật Điện tử Mã số: 9510302.01 LUẬN ÁN TIEN SĨ CÔNG NGHỆ KỸ THUẬT ĐIỆN TỬ - VIỄN THÔNG NGƯỜI HƯỚNG DẪN KHOA HỌC: 1. NGUYEN LINH TRUNG 2. TRINH DINH HOAN Hà Nội - 2023 1 LỜI CAM ĐOAN Tôi xin cam đoan luận án do tôi thực hiện. Những kết quả của các tác giả khác mà tôi sử dụng trong luận án đều được trích dẫn rõ ràng, cụ thể.
Các kết quả thực nghiệm là trung thực. Nếu có gì sai trái, tôi xin hoàn toàn chịu trách nhiệm. Hà Nội, tháng 6 năm 2023 Nghiên cứu sinh ii LỜI CẢM ƠN Để hoàn thành được luận án này, ngoài sự nỗ lực của bản thân, tôi đã nhận được rất nhiều sự động viên, giúp đỡ quý báu của các Thày Cô, bạn bè, đồng nghiệp và những người thân trong gia đình. Trước hết, tôi xin chân thành bày tỏ lòng biết ơn sâu sắc tới PGS.TS Nguyễn Linh Trung và TS Trịnh Đình Hoàn đã dành nhiều tâm huyết trực tiếp hướng dẫn, động viên, giúp đỡ tôi cả về vật chất và tinh thần.
Tôi xin chân thành cảm ơn Cô Marie Luong đã dành thời gian để góp ý cho những bài báo của chúng tôi. Tôi xin chân thành cảm ơn TS Lê Vũ Hà, TS Nguyễn Hồng Thịnh- Phòng Thí nghiệm Tín hiệu hệ thống-Khoa Điện tử-Viễn thông-Trường Đại học Công nghệ-Đại học Quốc gia Hà Nội đã tạo môi trường thuận lợi để tôi học tập và nghiên cứu. Tôi xin chân thành cảm ơn TS. Lưu Mạnh Hà-Viện AVITECH-Trường Đại học Công nghệ-Đại học Quốc gia Hà Nội đã tạo điều kiện thuận lợi để tôi triển khai các thực nghiệm và luôn sẵn sàng thảo luận những vấn đề chuyên môn liên quan.BS Nguyễn Trường Giang, ThS.BS Pham Xuân Quang-Bénh viện Trung ương Thái Nguyên đã giúp tôi đánh giá ảnh sau khi xử lý.
Cảm ơn TS Trương Minh Chính- Đại học Huế, Th.S Phạm Minh Tuấn, CN. Vũ Duy Thanh, CN Lê Quốc Anh, Th.S Trần Việt Khoa, Th.S Bùi Minh Tuan-vién AVITECH, đã hỗ tro tôi những lúc tôi gặp các sự cố về kỹ thuật. Tôi xin chân thành cảm ơn sự hỗ trợ của Khoa Điện tử viễn thông, Trường Đại học Công nghệ-Đại học Quốc gia Hà Nội trong suốt thời gian tôi nghiên cứu tại đây. Tôi cảm ơn các đồng nghiệp tại trường Đại học Công nghệ thông tin và truyền thông-Đại học Thái Nguyên đã san sẻ công việc giúp tôi có nhiều thời gian cho việc nghiên cứu của mình.
Cuối cùng tôi đặc biệt chân thành biết ơn sâu sắc những tình cảm và sự hi sinh cả về vật chất, tỉnh thần của những người thân yêu trong gia đình tôi suốt những năm tháng qua. Tôi xin chân thành cảm ơn! Hà Nội, tháng 6 năm 2023 Nguyễn Thành Trung 11 MỤC LỤC Trang phụ bìa. Q Q Q ee 1 Lời cam đoan. Q Q Q Q Q ee ee 1 LOicAaM ON.
LH HH ng v.v xxx và 11 Mục lỤC. ee 1 Danh mục ký hiệu và chữ viết tắt.- 3 Danh mục hình vẽ .2 5 Danh mục bảng biểu. eee 8 CHƯƠNG 1. CƠ SỞ VÀ TONG QUAN.
Anh CT và van dé khử nhiễu ảnhCT. Các yêu tố chính ảnh hưởng tới chất lượng của ảnh CT. Nhiễu trong ảnh CT và một số thách thức chính trong khử nhiễu ảnhCT. Tổng quan về các phương pháp khử nhiễu ảnh.
Giới thiệu chung. Một số phương pháp khử nhiễu ảnh truyền thống. Một số phương pháp khử nhiễu ảnh dựa trên việc học từ tập ảnhmẫu. Kết luận chương.
KHỬ NHIÊU ANH CT LIEU THAP SỬ DỤNG BIỂU DIỄN THUA. Một số khái niệm về biểu diễn thưa. Ma trận thưa và vec-tơthưa. Chuẩn của một véctởd.
Biểu diễn thưa. Ứng dụng biểu diễn thưa trong khử nhiễu ảnh. Các phương pháp đề xuất. Phương pháp liên quan MRFD.
Hướng tiếp cận của các phương pháp dé xuất. Phương pháp khử nhiễu ảnh FD-SCI. Phương pháp khử nhiễu ảnh FD-SC2. Thực nghiệm đánh giá hiệu nang các phương pháp.
Kếtluận chương. KHỬ NHIÊU ANH CT LIEU THAP SU DỤNG MẠNG NƠ- RON TÍCHCHẬP. Một số ứng dung của mạng nơ-ron tích chập trong khử nhiễu ảnh LDCT 75 3. Các phương pháp liên quan và cơ sở hình thành các phương pháp dé XUAL “ 78 3.
Phương pháp liên quan- FFDNet. Phuong pháp liên quan SAR-DRN. Co sở hình thành các phương pháp đề xuất. Các phương pháp dé xuất.
Phương pháp FD-VGG. Phương pháp DRN-LDCT. Thực nghiệm và đánhgiá.ee 95 KẾT LUẬN VÀ KIẾNNGHỊ. 99 DANH MUC CONG TRINH KHOA HOC CUA TAC GIA LIEN QUAN DEN LUẬN AN 2.
2c eee 101 TÀI LIEU THAM KHẢO. 102 DANH MỤC KÝ HIỆU VÀ CHỮ VIẾT TẮT Danh mục ký hiệu STT | Ký hiệu Giải thích 1 chữ in nghiêng, chữ thường Đại lượng vô hướng hoặc In hoa, ví dụ u, NV 2 chữ in đậm, chữ thường, ví dụ x | Đại lượng véc-tơ, các thành phần của véc-tơ x được ký hiệu là x; 3 in đậm, kiểu chữ in hoa, Ma trận, các thành phần của ma trận A được ký ví dụ A hiệu là a,, 4 |R Tập số thực 5 | RY Không gian véc-tơ thực N chiều 7 Ill, é,-norm của véc-to - 8 Ill. éy-norm của véc-td, ma trận hoặc ten-xơ - Danh mục chữ viết tắt STT Chữ Giải thích tiếng Anh Giải thích tiếng Việt viet tat 1 BM3D Block Matching Three Phương pháp khử nhiễu dựa trên Dimensions việc sắp xếp các miếng liên quan với miếng ảnh nhiễu thành các khối 3D rồi xử lý 2 |CNN Convolutional Neural Network | Mạng nơ-ron tích chập 3 CT Computed Tomography Chup cắt lớp vi tinh 4 | FFDnet Fast and Flexible Denoising Phương pháp khử nhiễu linh động, convolutional neural network nhanh sử dụng mạng nơ-ron tích chập (tên phương pháp) 5 | FSIM Feature Similarity Chỉ số tương đồng đặc trưng 6 | K-SVD K-Single Value Decomposition | Phương pháp khử nhiễu dựa trên học từ điển thông qua phân giải giá trị riêng (tên phương pháp) 7 | LDCT Low-Dose Computed Cắt lớp vi tính liều thấp Tomography 8 | MSE Mean Square Error Sai số trung bình bình phương 9 | NDCT Normal Dose Computed Cắt lớp vi tính liều thường quy Tomography 10 | NLM Non-Local Means Phuong pháp khử nhiễu dựa trên trung bình không cục bộ (tên phương pháp) 11 | PSNR Peak Signal to Noise Ratio Tỉ số tín hiệu cực đại trên nhiễu 12 |RED- Residual Encoder-Decoder Mạng nơ-ron tích chập mã hóa- CNN CNN giải mã có sử dụng phần dư 13 | SSIM Structural Similarity Chi số tương đồng cau trúc (tên độ đo sử dụng trong xử lý ảnh) 14 | TGV Total Generalize Variation Phương pháp biến phân toàn phan cải tiến 15 | VGG Visual Geometry Group Tên mạng no-ron tích chập được đặt theo tên của môt nhóm nghiên cứu về hình học trực quan DANH MỤC HINH VE Hình 1.1 Minh họa đầu phát và các đầu dò tương ứng trong máy chụp CT Ó4dẫy.2 Cac giai đoạn tạo ảnhŒCT.3 Giai đoạn quết.4 Dựng anh CT sử dụng biến đổ Radon .5 Dựng anh sử dụng phép chiếu ngược.6 Ảnh CT vùng gan ở cùng vi trí với liều lượng phóng xạ X bình thường và liều lượng thấp .7 Khử nhiễu CT vùng phổi dùng bộ lọc Gauss.8 Kết quả khử nhiễu ảnh CT vùng phổi dùng bộ lọc trung vị kích thƯỚC 5 Xð. Q Q Q Q HQ ng ng và va 29 Hình 1.9 Một trong những kiến trúc CNN đầu tiên sử dung để khử nhiễu anh [38].
QQ Q vo 36 Hình 2.1 Tổng quan về phương pháp khử nhiễu MRFD .3 Phân tách ảnh nhiễu thành các ảnh thành phần tần số.6 Phân chia ảnh thành các miếng ảnh.7 So đồ minh họa phương pháp dé xuất FD-SC2.8 Phân tách ảnh sử dụng các bộ lọc thông thấp 2D trong FD-SC2 .9 Các ảnh sử dụng trong thucnghiém .10 Kết quả khử nhiễu trên ảnh CT liều thấp mô phỏng mức nhiễu Ö In".11 Kết quả khử nhiễu trên anh CT liều thấp vùng phổi chứa một nốt có tọa độ điểm ảnh (X=190, Y=394).12 Ảnh hưởng của các tham số + trong (2.49) đến PSNR va SSIM .13 Ảnh hưởng của kích thước miếng đến PSNR và SSIM_.1 Kiến trúc của RED-CNN trong[13].2 Kiến trúc tổng thé của SACNN |46].3 Kiến trúc của WGAN-VGG [77].4 Kiến trúc chung của mạng FFDNet.5 Kiến trúc mạng SAR-DRN [85].6 Hình vẽ minh họa tích chap dan với tỷ lệ dan khác nhau .7 Một số ảnh đầu ra của mạng SAR-DRN khi được huấn luyện trên tập ảnh CT.8 Kiến trúc của mạng FD-VGG.9 Mô tả chức năng của lớp hạ mẫu ảnh đầu vào.10 Kiến trúc của mô hình khử nhiễu dựa trên mạng nơ-ron tích chập 0.aAI eee 85 Hình 3.11 Minh họa về tác động của toán tử 2-DConv .12 Các chỉ số đánh giá hiệu năng của BM3D, FD-SC2, WGAN- VGG [77], RED-CNN[13], FD-VGG và DRN-LDCT.13 Kết quả khử nhiễu anh LDCT 6 bung .14 Kết quả khử nhiễu trên ảnh CT vùng bụng chứa gan. 98 DANH MỤC BANG BIEU Bảng 2.1 So sánh chỉ số PSNR tính toán trên một số ảnh CT được khử nhiễu bằng các phương pháp khác nhau .2 Chỉ số SSIM của một số anh đã được khử nhiễu bằng các phương pháp khác nhau.3 So sánh thời gian chạy của các phương pháp MRFD. FD-SC1, FD-SC2. Q0 ee ee 69 Bảng 3.1 Cấu hình chi tiết mạng RED-CNN [13].2 Cấu hình chi tiết mang WGAN-VGG [77] (mang sinh Generator).
Cấu hình chi tiết mạng FD-VGG.4 Cấu hình chi tiết mang DRN-LDCT.5 PSNR, SSIM và FSIM trung bình của các phương pháp khử nhiễu ảnh LDCT khác nhau .6 Dung lượng mang và thời giantinhtoan. Bối cảnh nghiên cứu Trong nền y học hiện dai, vai trò của ảnh y tế ngày càng trở nên quan trọng. Mặc dù các hệ thống tạo ảnh y tế không ngừng được cải tiến cả về phần cứng và phần mềm nhưng do sự giới hạn về mặt vật lý và do sự thỏa hiệp giữa chất lượng ảnh với việc hạn chế các rủi ro có thể xảy ra cho người bệnh dẫn tới việc trong ảnh y tế luôn xuất hiện nhiễu và các yếu tố giả. Nhiéu và các yêu tố giả trong ảnh y tế có thể ảnh hưởng tới độ chính xác của việc chẩn đoán, điều trị bệnh.
Vì vậy, bài toán nâng cao chất lượng hình ảnh y tế bị nhiễu nhằm hạn chế những sai sót bắt nguồn từ hình ảnh y tế van là một thách thức có ý nghĩa đã và đang thu hút được sự chú ý của nhiều nhà nghiên cứu trong và ngoài nước.
Nội dung được bảo vệ bản quyền — Tải xuống đầy đủ
Trích dẫn luận án này
Nguyen Thanh Trung (2023). Nghiên cứu khử nhiễu ảnh CT liều thấp [Luận án tiến sĩ, Đại học Công nghệ, Đại học Quốc gia Hà Nội]. LuanAn.net. https://luanan.net/ky-thuat-dien-dien-tu/ky-thuat-dien-tu/nghien-cuu-khu-nhieu-anh-ct-lieu-thap
Câu hỏi thường gặp
Luận án "Nghiên cứu khử nhiễu ảnh CT liều thấp" nghiên cứu về vấn đề gì?
Luận án tiến sĩ nghiên cứu phát triển phương pháp khử nhiễu ảnh CT liều thấp, nâng cao chất lượng hình ảnh trong điện tử viễn thông.
Luận án "Nghiên cứu khử nhiễu ảnh CT liều thấp" được bảo vệ tại trường nào?
Luận án này được bảo vệ tại Đại học Công nghệ, Đại học Quốc gia Hà Nội. Năm bảo vệ: 2023.
Luận án "Nghiên cứu khử nhiễu ảnh CT liều thấp" thuộc chuyên ngành gì?
Luận án "Nghiên cứu khử nhiễu ảnh CT liều thấp" thuộc chuyên ngành Kỹ thuật Điện tử. Danh mục: Kỹ Thuật Điện Tử.
Luận án "Nghiên cứu khử nhiễu ảnh CT liều thấp" có bao nhiêu trang?
Luận án "Nghiên cứu khử nhiễu ảnh CT liều thấp" có 114 trang. Bạn có thể xem trước một phần tài liệu ngay trên trang web trước khi tải về.
Cách tải luận án "Nghiên cứu khử nhiễu ảnh CT liều thấp" về máy như thế nào?
Để tải luận án về máy, bạn nhấn nút "Tải xuống ngay" trên trang này, sau đó hoàn tất thanh toán phí lưu trữ. File sẽ được tải xuống ngay sau khi thanh toán thành công. Hỗ trợ qua Zalo: 0559 297 239.