OpenAI giới thiệu Safety Gym, bộ môi trường và công cụ chuyên dụng giúp các nhà phát triển đo lường và đảm bảo các tác tử học tăng cường (Reinforcement Learning) tuân thủ nghiêm ngặt các ràng buộc an toàn trong quá trình huấn luyện.
OpenAI giới thiệu Procgen Benchmark, bộ 16 môi trường được tạo ngẫu nhiên giúp đánh giá chính xác tốc độ và khả năng học tập các kỹ năng tổng quát của các tác nhân học tăng cường (Reinforcement Learning).
Khám phá cách OpenAI sử dụng Deep Reinforcement Learning quy mô lớn để huấn luyện AI đánh bại các game thủ chuyên nghiệp trong Dota 2, một cột mốc quan trọng trong lịch sử AI.
OpenAI giới thiệu Jukebox, một mạng thần kinh tiên tiến có khả năng sáng tạo âm nhạc nguyên bản, bao gồm cả giọng hát, với nhiều thể loại và phong cách nghệ sĩ khác nhau. Bài viết đi sâu vào kỹ thuật, cách thức hoạt động và cách bạn có thể trải nghiệm công nghệ này.
Phân tích mới nhất từ OpenAI chỉ ra rằng hiệu suất huấn luyện mạng thần kinh đã tăng trưởng vượt bậc, với lượng tài nguyên tính toán cần thiết giảm một nửa sau mỗi 16 tháng, vượt xa tốc độ phát triển của phần cứng truyền thống.
Khám phá nghiên cứu đột phá của OpenAI về GPT-3, mô hình ngôn ngữ với 175 tỷ tham số, khả năng học hỏi từ ngữ cảnh mà không cần tinh chỉnh (fine-tuning), thay đổi hoàn toàn cách chúng ta tiếp cận AI.
OpenAI vừa cập nhật tính năng phân tích dữ liệu trên ChatGPT, cho phép người dùng tương tác trực tiếp với bảng biểu, biểu đồ và nhập tệp tin từ Google Drive cũng như Microsoft OneDrive, giúp tối ưu hóa quy trình làm việc với dữ liệu.
OpenAI kết hợp cùng AIcrowd, CMU và DeepMind tổ chức hai cuộc thi AI quan trọng tại NeurIPS 2020, tập trung vào khả năng tổng quát hóa của tác nhân AI thông qua Procgen Benchmark và MineRL.
Khám phá cách OpenAI áp dụng các mô hình ngôn ngữ tạo sinh (Generative Language Models) để giải quyết các bài toán chứng minh định lý tự động, mở ra kỷ nguyên mới cho trí tuệ nhân tạo trong nghiên cứu toán học chuyên sâu.
OpenAI công bố phương pháp mới giúp cải thiện hành vi của các mô hình ngôn ngữ lớn (LLM) thông qua việc tinh chỉnh trên các tập dữ liệu được chọn lọc kỹ lưỡng, thay vì chỉ dựa vào quy mô dữ liệu khổng lồ.
Khám phá TruthfulQA, một bộ tiêu chuẩn đánh giá quan trọng từ OpenAI nhằm đo lường mức độ trung thực của các mô hình ngôn ngữ lớn (LLM), giúp hạn chế việc AI bắt chước các quan niệm sai lầm và tin giả từ con người.
Khám phá cách OpenAI giải quyết thách thức trong việc huấn luyện AI tóm tắt các văn bản dài thông qua cơ chế phản hồi từ con người (Human Feedback), giúp hệ thống tự động đánh giá và xử lý các tác vụ phức tạp với độ chính xác cao hơn.
