Gợi ý Không mẫu (Zero-Shot Prompting)
Definition
Gợi ý không mẫu liên quan đến việc yêu cầu một mô hình ngôn ngữ đã tiền huấn luyện hoàn …
Terms tagged with NLP
Gợi ý không mẫu liên quan đến việc yêu cầu một mô hình ngôn ngữ đã tiền huấn luyện hoàn …
XLM-RoBERTa (Cross-lingual Language Model RoBERTa) là một mô hình đa ngôn ngữ quy mô lớn …
WordPiece là một phương pháp phân đoạn từ được sử dụng rộng rãi trong các mô hình xử lý …
Độc hại trong AI đề cập đến việc tạo ra hoặc lan truyền nội dung thiếu tôn trọng, có khả …
Phát hiện độc hại sử dụng các kỹ thuật xử lý ngôn ngữ tự nhiên để phân tích đầu vào văn …
Tạo văn bản là một mô hình ứng dụng cơ bản trong xử lý ngôn ngữ tự nhiên, nơi các mô hình …
Phân loại văn bản là một nhiệm vụ học có giám sát trong đó các thuật toán gán các danh …
Gán nhãn chuỗi liên quan đến việc dự đoán một nhãn phân loại cho mỗi token trong một …
Độ tương đồng câu đo lường mức độ chồng chéo về ngữ nghĩa giữa hai câu khác biệt. Nó vượt …
Gấp ngữ nghĩa đề cập đến quá trình nén các vector embedding phức tạp, nhiều chiều thành …
Sentence Transformers là phiên bản mở rộng của các mô hình Transformer truyền thống (như …
Nó vượt xa cấu trúc cú pháp để diễn giải ý định và tầm quan trọng thực sự của đầu vào …
Qwen3.5 chỉ một bản phát hành cụ thể trong dòng Qwen do Alibaba Cloud phát triển. Phiên …
Qwen đại diện cho một họ các mô hình ngôn ngữ lớn tiên tiến được tạo ra bởi Phòng thí …
Pythia là một loạt các mô hình ngôn ngữ lớn (LLM) mã nguồn mở do EleutherAI tạo ra, nhằm …
Thuật ngữ này bao gồm các sản phẩm thương mại và nghiên cứu do OpenAI, một phòng thí …
Một đại sứ giáo dục là một thành phần phần mềm, thường được thể hiện dưới dạng nhân vật …
Viết lại văn bản trong Xử lý Ngôn ngữ Tự nhiên liên quan đến việc tạo ra các cách diễn …
P-Tuning (Prompt Tuning) là một kỹ thuật được thiết kế để thích ứng các mô hình ngôn ngữ …
Nhận dạng ký tự quang học (OCR) sử dụng các thuật toán xử lý hình ảnh và nhận dạng mẫu để …
Nhận diện ngôn ngữ bản xứ (NLI) là một nhánh của xử lý ngôn ngữ tự nhiên, tập trung vào …
Các mô hình đa ngôn ngữ được thiết kế để xử lý các đầu vào ngôn ngữ đa dạng mà không cần …
Tạo mặt nạ liên quan đến việc sản xuất các mặt nạ không gian hoặc thời gian xác định phần …
Lĩnh vực này kết hợp các kỹ thuật học máy với xử lý ngôn ngữ tự nhiên và khai phá dữ liệu …
Trong bối cảnh thuật ngữ AI hiện đại, Lyra thường chỉ các hệ thống AI chuyên biệt tập …
MAUVE là một phép đo thống kê được thiết kế để đánh giá mức độ gần gũi giữa đầu ra của mô …
Ngữ cảnh dài đề cập đến khả năng của các mô hình dựa trên kiến trúc Transformer trong …
Có nguồn gốc từ lý thuyết hành vi ngôn ngữ và ngữ dụng học, góc nhìn này nhấn mạnh cách …
LLM-as-a-Judge là một mô hình đánh giá trong đó một Mô hình ngôn ngữ lớn đóng vai trò là …
Các phương pháp nhúng đồ thị tri thức, chẳng hạn như TransE hoặc DistMult, biến đổi các …
Nhận dạng Từ Thông minh đề cập đến các công nghệ nhận dạng ký tự quang học (OCR) tiên …
Generative Pre-trained Transformer 2 (GPT-2) là một mô hình ngôn ngữ tự hồi quy sử dụng …
GPT-5.6 đề cập đến một phiên bản mang tính suy đoán hoặc sắp ra mắt trong dòng họ các Mô …
Fill Mask là một mục tiêu tiền huấn luyện cơ bản được sử dụng trong các mô hình dựa trên …
ExBERT cung cấp khả năng giải thích cho mô hình transformer BERT bằng cách phân tích tầm …
ELMo tạo ra các vector nhúng từ nhạy cảm với ngữ cảnh bằng cách xử lý văn bản đầu vào qua …
Phân loại tài liệu là một nhiệm vụ cơ bản trong xử lý ngôn ngữ tự nhiên, nơi các thuật …
TriviaQA là một bộ dữ liệu được thiết kế cho bài toán trả lời câu hỏi trong lĩnh vực mở, …
Bộ dữ liệu WikiHow bao gồm khoảng 60.000 bài viết hướng dẫn được thu thập từ trang web …
Wikipedia là một trong những bộ sưu tập kiến thức phong phú và toàn diện nhất của con …
Bộ dữ liệu Yahoo Answers Topics là một tập con của kho lưu trữ Yahoo Answers lớn hơn, tập …
S2ORC là một kho lưu trữ toàn diện các bài báo khoa học được trích xuất từ Semantic …
Tập dữ liệu Altlex bao gồm các cặp câu có cùng ý nghĩa nền tảng nhưng sử dụng từ vựng …
Quora Question Pairs (QQP) là một tập dữ liệu phân loại nhị phân chứa hơn 400.000 cặp câu …
Các tập dữ liệu nén câu bao gồm các cặp trong đó câu đích là phiên bản rút gọn của câu …
BookCorpus là bộ sưu tập văn bản từ hơn 10.000 cuốn sách chưa xuất bản, được thu thập từ …
Trường Ngẫu nhiên Điều kiện (CRF) là một lớp các mô hình biệt thức thường được sử dụng …
Hài hước tính toán nghiên cứu cách máy móc có thể sản xuất hoặc diễn giải các trò đùa, …
Kiến thức thông thường đề cập đến lượng lớn thông tin ngầm định về cuộc sống hàng ngày, …
Khái niệm này tập trung vào việc thao tác văn bản, trong đó đơn vị cơ bản của phép tính …
Mặc dù lịch sử đề cập đến phân loại giáo dục của Benjamin Bloom, trong bối cảnh AI hiện …
BERT là một kỹ thuật học máy dựa trên kiến trúc Transformer để huấn luyện trước cho xử lý …
Kỹ thuật xử lý ngôn ngữ tự nhiên này biểu diễn văn bản dưới dạng tập hợp đa nguyên của …
Bác sĩ ghi chép y tế tự động sử dụng công nghệ xử lý ngôn ngữ tự nhiên (NLP) và nhận dạng …
Thuật ngữ ASR-complete cho thấy một hệ thống Nhận dạng Giọng nói Tự động đã đạt đến mức …
Các mô hình Vision-Language, thường được gọi là Mô hình Ngôn ngữ Lớn Đa phương thức …
Dịch thuật trong AI đề cập đến dịch máy thần kinh, nơi các mô hình học sâu ánh xạ các …
Tóm tắt văn bản giúp giảm khối lượng văn bản lớn thành các phiên bản ngắn hơn mà không …
Tìm kiếm ngữ nghĩa diễn giải ý định và ý nghĩa ngữ cảnh đằng sau một truy vấn, vượt xa …
Vì các mô hình Transformer xử lý tất cả các token song song thay vì tuần tự như RNN, …
Trả lời câu hỏi (QA) liên quan đến việc truy xuất hoặc tạo ra các phản hồi chính xác cho …
Nhận dạng thực thể có tên (NER) là một tác vụ con của trích xuất thông tin, nhằm tìm kiếm …
Các mô hình này ánh xạ dữ liệu nhiều chiều vào một không gian vectơ liên tục có chiều …
Trong các mô hình tuần tự sang tuần tự (sequence-to-sequence), bộ giải mã nhận vectơ ngữ …
Mã hóa Cặp Byte (BPE) là một kỹ thuật nén dữ liệu được điều chỉnh cho xử lý ngôn ngữ tự …
Học tự giám sát là một tập con của học máy, trong đó tín hiệu giám sát được tự động trích …
Học vài ví dụ cho phép các mô hình học máy khái quát hóa từ rất ít dữ liệu, thường dao …
Được giới thiệu trong bài báo ‘Attention Is All You Need’, kiến trúc …
Chuyển đổi thành Token là một bước tiền xử lý quan trọng trong Xử lý Ngôn ngữ Tự nhiên …
Token là những khối xây dựng cơ bản của dữ liệu đầu vào trong Xử lý Ngôn ngữ Tự nhiên …
Phân tích ngữ nghĩa trong AI tập trung vào việc hiểu ý nghĩa nền tảng của các đầu vào …
Lệnh đầu vào đóng vai trò là giao diện chính để tương tác với các mô hình ngôn ngữ lớn và …
Trong bối cảnh truyền thông kỹ thuật số và dữ liệu AI, ‘bài đăng’ đề cập đến …
Huấn luyện trước là một kỹ thuật nền tảng trong học sâu, nơi mô hình học các đặc điểm và …
Xử lý ngôn ngữ tự nhiên (NLP) là một lĩnh vực con của trí tuệ nhân tạo, kết hợp ngôn ngữ …
Chú ý Đa đầu mở rộng cơ chế chú ý tiêu chuẩn bằng cách chạy nó nhiều lần song song với …
Trong bối cảnh AI, ‘dài’ thường mô tả khả năng xử lý các đầu vào rộng lớn, …
Các Mô hình Ngôn ngữ Lớn (LLMs) là hệ thống trí tuệ nhân tạo tiên tiến dựa trên kiến trúc …
Mặc dù không phải là thuật toán kỹ thuật AI, ’thay vì’ rất quan trọng trong …
Các hệ thống AI phân cấp tổ chức thông tin hoặc kiểm soát thành một cấu trúc dạng cây gồm …
Trong trí tuệ nhân tạo, tạo sinh đề cập đến khả năng của các mô hình, đặc biệt là Mạng …
Trong xử lý ngôn ngữ tự nhiên, ngữ cảnh đóng vai trò quan trọng trong việc giải quyết sự …
Embedding là biểu diễn vector dày đặc của dữ liệu, trong đó các mối quan hệ ngữ nghĩa …
Cơ chế chú ý cho phép một mô hình cân nhắc tầm quan trọng của các yếu tố khác nhau trong …