Khám phá chi tiết về sự kiện Hackathon đầu tiên do OpenAI tổ chức vào ngày 3 tháng 3, nơi quy tụ 100 chuyên gia hàng đầu trong cộng đồng trí tuệ nhân tạo để cùng nhau xây dựng và đổi mới.
OpenAI giới thiệu Evolved Policy Gradients (EPG), một phương pháp meta-learning đột phá cho phép các tác nhân học máy tự tiến hóa hàm mất mát của chính mình. Công nghệ này giúp AI thích nghi nhanh chóng với các tác vụ mới lạ, vượt xa khỏi phạm vi dữ liệu huấn luyện ban đầu, mở ra tiềm năng lớn trong việc giải quyết các bài toán điều hướng và ra quyết định phức tạp.
OpenAI giới thiệu phương pháp 'AI Safety via Debate' - kỹ thuật huấn luyện các tác nhân AI tranh luận với nhau dưới sự giám sát của con người để đảm bảo tính an toàn và minh bạch cho các hệ thống AI tiên tiến.
OpenAI chính thức phát hành phiên bản đầy đủ của Gym Retro, nền tảng nghiên cứu Reinforcement Learning mạnh mẽ. Với hơn 1.000 trò chơi được hỗ trợ từ nhiều trình giả lập khác nhau và công cụ tích hợp game mới, đây là bước ngoặt cho các nhà phát triển AI muốn thử nghiệm các thuật toán học tăng cường trên môi trường game cổ điển.
OpenAI chính thức mở đơn đăng ký cho chương trình OpenAI Fellows mùa thu 2018. Đây là cơ hội thực tập có lương kéo dài 6 tháng dành cho các kỹ sư và nhà nghiên cứu muốn tham gia trực tiếp vào các dự án AI tiên phong tại OpenAI.
OpenAI giới thiệu GamePad, một môi trường học tập chuyên biệt dành cho các mô hình AI nhằm giải quyết các bài toán chứng minh định lý phức tạp, mở ra kỷ nguyên mới cho việc tự động hóa suy luận logic.
Khám phá bước tiến đột phá của OpenAI trong việc kết hợp kiến trúc Transformer và học không giám sát (unsupervised pre-training) để đạt được kết quả vượt trội trên nhiều tác vụ ngôn ngữ đa dạng, mở ra kỷ nguyên mới cho AI.
Khám phá nghiên cứu đột phá của OpenAI về việc học biểu diễn chính sách (policy representations) trong các hệ thống đa tác tử. Bài viết phân tích cách các tác tử AI học hỏi lẫn nhau, tối ưu hóa sự phối hợp và giải quyết các thách thức phức tạp trong môi trường tương tác.
OpenAI đã công bố kết quả cuộc thi Retro Contest, một thử thách tập trung vào việc phát triển các thuật toán AI có khả năng tổng quát hóa từ những trải nghiệm trước đó thông qua môi trường game cổ điển.
Khám phá OpenAI Five, hệ thống gồm 5 mạng thần kinh nhân tạo đã tạo nên cột mốc lịch sử khi đánh bại các đội chơi Dota 2 nghiệp dư, mở ra kỷ nguyên mới cho AI trong môi trường game phức tạp.
Khám phá Glow, mô hình tạo sinh khả nghịch từ OpenAI sử dụng kỹ thuật tích chập 1x1 (invertible 1x1 convolutions). Bài viết phân tích sâu về kiến trúc, khả năng tạo ảnh độ phân giải cao và cách Glow giúp thao tác thuộc tính dữ liệu một cách hiệu quả.
Khám phá lại sự kiện OpenAI Five Benchmark - cột mốc quan trọng khi trí tuệ nhân tạo lần đầu tiên đánh bại các game thủ chuyên nghiệp trong tựa game Dota 2 phức tạp, mở ra kỷ nguyên mới cho học tăng cường (Reinforcement Learning).
