Gemini 3 được Google giới thiệu như thế hệ mô hình trí tuệ nhân tạo tiên tiến nhất hiện nay, được thiết kế để đồng hành cùng người dùng trong hành trình biến mọi ý tưởng thành những sản phẩm, giải pháp và trải nghiệm cụ thể.
Thông điệp từ Sundar Pichai, CEO Google và Alphabet
Gần hai năm trước, chúng tôi khởi động kỷ nguyên Gemini – một trong những chương trình nghiên cứu khoa học và phát triển sản phẩm có quy mô lớn nhất trong lịch sử Google. Từ thời điểm đó đến nay, chúng tôi thực sự ấn tượng trước cách người dùng toàn cầu đón nhận và khai thác Gemini trong đời sống và công việc hàng ngày.
Hiện tại, tính năng AI Overviews trong Tìm kiếm đã phục vụ khoảng 2 tỷ người mỗi tháng. Ứng dụng Gemini đạt hơn 650 triệu người dùng thường xuyên. Trên nền tảng đám mây, hơn 70% khách hàng Cloud đang tích hợp AI vào hệ thống của họ và khoảng 13 triệu lập trình viên đã xây dựng sản phẩm với các mô hình tạo sinh mà chúng tôi cung cấp. Những con số này chỉ phản ánh một phần nhỏ tác động thực tế mà hệ sinh thái Gemini đang mang lại.
Nhờ cách tiếp cận tổng thể, kết hợp chặt chẽ giữa hạ tầng tính toán, hoạt động nghiên cứu, hệ thống mô hình cốt lõi, công cụ phát triển và các sản phẩm tiếp cận hàng tỷ người dùng, chúng tôi có thể đưa những khả năng AI mới nhất đến tay mọi người với tốc độ nhanh hơn trước rất nhiều.
Mỗi thế hệ Gemini đều được xây dựng dựa trên những gì thế hệ trước đã làm tốt, nhằm giúp người dùng giải quyết nhiều nhiệm vụ phức tạp hơn. Gemini 1 mở ra bước đột phá về khả năng đa phương thức nguyên bản và xử lý ngữ cảnh dài, làm tăng đáng kể lượng thông tin mà mô hình có thể tiếp nhận và phân tích. Gemini 2 đặt nền móng cho các khả năng mang tính tác nhân, đồng thời nâng tầm khả năng lập luận và tư duy, giúp mô hình hỗ trợ tốt hơn cho những công việc và ý tưởng khó, tạo cơ sở cho Gemini 2.5 Pro dẫn đầu bảng xếp hạng LMArena suốt hơn sáu tháng.
Hôm nay, chúng tôi tiếp tục hành trình này bằng việc ra mắt Gemini 3 – mô hình AI được đánh giá là thông minh nhất của Google cho đến thời điểm hiện tại, kết hợp toàn bộ sức mạnh đã tích lũy qua nhiều thế hệ Gemini để giúp bạn đưa mọi ý tưởng vào đời sống.
Gemini 3 được xây dựng quanh khả năng lập luận sâu, chú trọng đến việc hiểu những tầng nghĩa tinh tế, nhận ra các gợi ý nhỏ trong ý tưởng sáng tạo và tháo gỡ những lớp vấn đề đang chồng chéo. Mô hình cũng nhạy hơn trong việc nắm bắt bối cảnh và mục đích thực sự đằng sau yêu cầu của bạn, nhờ đó có thể đưa ra câu trả lời phù hợp với ít lời nhắc hơn. Chỉ trong vòng hai năm, AI đã chuyển từ khả năng đọc và mô tả văn bản, hình ảnh đơn giản sang việc nhìn nhận toàn bộ tình huống theo ngữ cảnh.
Kể từ hôm nay, Gemini sẽ được triển khai rộng rãi trên toàn hệ sinh thái Google. Điều này bao gồm việc đưa Gemini 3 vào Chế độ AI trong Tìm kiếm với khả năng lập luận phức tạp hơn và những trải nghiệm tương tác hoàn toàn mới. Lần đầu tiên, chúng tôi tích hợp ngay một mô hình Gemini thế hệ mới vào Tìm kiếm từ ngày đầu ra mắt. Gemini 3 cũng hiện diện trong ứng dụng Gemini, trong các công cụ dành cho nhà phát triển như AI Studio và Vertex AI, cũng như trong nền tảng lập trình tác nhân mới mang tên Google Antigravity, sẽ được giới thiệu chi tiết ở phần sau.
Giống như những thế hệ đi trước, Gemini 3 một lần nữa thiết lập một tiêu chuẩn mới cho AI. Trong giai đoạn kế tiếp, chúng tôi sẽ tiếp tục đẩy xa giới hạn về trí tuệ của mô hình, khả năng hoạt động như tác nhân và mức độ cá nhân hóa, với mục tiêu khiến AI trở nên hữu ích và an toàn hơn cho tất cả mọi người.
Chúng tôi mong bạn sẽ khám phá và tận dụng Gemini 3 một cách sáng tạo. Mô hình sẽ liên tục được cải thiện theo thời gian, và chúng tôi rất háo hức được chứng kiến những thành tựu mới mà bạn tạo ra cùng Gemini 3 trong tương lai.
Sự xuất hiện của Gemini 3 và bước tiến của trí tuệ nhân tạo
Demis Hassabis, CEO Google DeepMind, và Koray Kavukcuoglu, CTO Google DeepMind kiêm Chief AI Architect của Google, đại diện đội ngũ Gemini
Hôm nay, chúng tôi tiến thêm một bước lớn trên hành trình hướng tới việc xây dựng Trí tuệ nhân tạo tổng quát (AGI) khi chính thức giới thiệu Gemini 3 đến cộng đồng người dùng và nhà phát triển.
Gemini 3 được thiết kế như mô hình dẫn đầu thế giới về khả năng hiểu và xử lý dữ liệu đa phương thức, đồng thời là nền tảng lập trình tác nhân và “vibe coding” mạnh mẽ nhất mà chúng tôi từng tạo ra. Mô hình mang lại trải nghiệm trực quan hóa phong phú, tương tác sâu hơn với người dùng, tất cả đều dựa trên năng lực lập luận được tối ưu hóa.
Chúng tôi bắt đầu kỷ nguyên Gemini 3 với việc ra mắt Gemini 3 Pro như một phiên bản trải nghiệm chủ lực. Từ hôm nay, mô hình này sẽ được tích hợp vào nhiều sản phẩm của Google để hỗ trợ bạn trong nhiều mặt của cuộc sống, từ học tập, làm việc, sáng tạo nội dung cho đến lập kế hoạch. Bên cạnh đó, chúng tôi giới thiệu Gemini 3 Deep Think – chế độ lập luận chuyên sâu giúp đưa hiệu năng của Gemini 3 lên một tầm cao mới. Chế độ này đang được gửi tới các nhóm đánh giá an toàn trước khi triển khai rộng rãi cho người dùng đăng ký gói Google AI Ultra.
Những năng lực cốt lõi mới của Gemini 3
Khả năng lập luận với chiều sâu và độ tinh tế cao

Gemini 3 Pro được tối ưu để hiện thực hóa các ý tưởng của bạn thông qua khả năng lập luận vượt trội và xử lý thông tin đa phương thức. So với Gemini 2.5 Pro, phiên bản này đạt kết quả tốt hơn trên hầu hết các thước đo đánh giá quan trọng trong lĩnh vực AI.
Mô hình hiện đứng đầu bảng xếp hạng LMArena với điểm số 1501, thể hiện năng lực lập luận ở trình độ tương đương cấp độ nghiên cứu sau đại học, với kết quả dẫn đầu trên bài kiểm tra Humanity’s Last Exam (đạt 37.5% mà không dùng công cụ hỗ trợ) và GPQA Diamond (đạt 91.9%). Trong lĩnh vực toán học, Gemini 3 Pro cũng thiết lập chuẩn mới khi đạt 23.4% trên MathArena Apex, một trong những mốc hiệu năng cao nhất hiện tại.
Không chỉ xử lý văn bản, Gemini 3 Pro còn mở rộng khái niệm lập luận đa phương thức. Mô hình đạt 81% trên MMMU-Pro và 87.6% trên Video-MMMU, đồng thời ghi nhận 72.1% trên SimpleQA Verified, thiết lập mốc mới về độ chính xác đã được thẩm định. Những kết quả này cho thấy Gemini 3 Pro có thể xử lý các bài toán phức tạp trong nhiều lĩnh vực, từ khoa học đến toán học và nhiều ngành khác, với mức độ tin cậy cao.

Trong từng cuộc trao đổi, Gemini 3 Pro được xây dựng để phản hồi một cách ngắn gọn, trực diện và hữu ích. Mô hình hạn chế tối đa việc đưa ra những câu nói xã giao hoặc xu nịnh, thay vào đó tập trung vào những góc nhìn thực chất, giúp người dùng hiểu vấn đề sâu hơn. Gemini 3 Pro hoạt động như một đối tác tư duy, tạo ra các cách tiếp cận mới để bạn diễn giải thông tin và thể hiện ý tưởng – từ việc chuyển tải các khái niệm khoa học phức tạp thành hình ảnh trực quan cho đến việc gợi ý hướng đi sáng tạo trong các dự án nội dung.

Gemini 3 có thể, chẳng hạn, viết mã để mô phỏng và trực quan hóa chuyển động của dòng plasma trong một thiết bị tokamak, đồng thời sáng tác một bài thơ mô tả bản chất vật lý của phản ứng nhiệt hạch theo cách dễ cảm nhận hơn.
Gemini 3 Deep Think
Chế độ Gemini 3 Deep Think được thiết kế để tiếp tục thử thách giới hạn của khả năng lập luận và xử lý đa phương thức. Mục tiêu của chế độ này là giúp bạn đi sâu hơn vào các bài toán phức tạp, nơi việc phân tích nhiều bước và quản lý chuỗi suy luận dài trở nên cần thiết.
Trong giai đoạn thử nghiệm, Gemini 3 Deep Think đã cho thấy hiệu năng vượt lên trên cả Gemini 3 Pro với kết quả 41.0% trên Humanity’s Last Exam (không dùng công cụ hỗ trợ) và 93.8% trên GPQA Diamond. Mô hình còn đạt 45.1% trên ARC-AGI (ở chế độ có khả năng triển khai mã), một mức điểm được xem là đột phá, cho thấy khả năng giải quyết các đề bài hoàn toàn mới mà không chỉ dựa vào kiến thức quen thuộc.
Gemini 3 trong học tập, xây dựng và lập kế hoạch
Hỗ trợ bạn học bất kỳ điều gì
Ngay từ đầu, Gemini đã được thiết kế để tổng hợp thông tin một cách trôi chảy trên nhiều dạng dữ liệu khác nhau, gồm văn bản, hình ảnh, video, âm thanh và mã lập trình. Với Gemini 3, khả năng lập luận đa phương thức tiếp tục được mở rộng, kết hợp năng lực đọc hiểu hình ảnh, không gian, ngôn ngữ và bối cảnh để giúp bạn học theo phong cách phù hợp nhất với mình. Mô hình cũng sở hữu cửa sổ ngữ cảnh lên tới 1 triệu token đầu vào, cho phép xử lý lượng lớn tài liệu trong một lần.
Ví dụ, nếu bạn muốn số hóa các công thức nấu ăn gia truyền của gia đình, Gemini 3 có thể nhận diện và chuyển đổi những ghi chép viết tay sang văn bản, dịch ra nhiều ngôn ngữ khác nhau rồi sắp xếp chúng thành một cuốn sổ tay nấu ăn để mọi người cùng chia sẻ. Nếu bạn muốn làm quen với một chủ đề hoàn toàn mới, bạn có thể cung cấp cho Gemini 3 những bài nghiên cứu học thuật, video bài giảng kéo dài nhiều giờ hoặc các khóa hướng dẫn, để mô hình biến chúng thành bộ flashcard tương tác, sơ đồ, hình minh họa hoặc những định dạng giúp việc ghi nhớ trở nên dễ dàng hơn. Thậm chí, Gemini 3 có thể phân tích một video ghi lại trận pickleball của bạn, chỉ ra những điểm cần cải thiện và gợi ý kế hoạch luyện tập chi tiết để nâng cao kỹ thuật.
Để việc hiểu thông tin trên web trở nên trực quan hơn, Chế độ AI trong Tìm kiếm hiện đã sử dụng Gemini 3 để tạo ra các trải nghiệm giao diện mới, như bố cục hiển thị sinh động, các công cụ tương tác hoặc mô phỏng theo yêu cầu. Những thành phần này được tạo ra ngay tại thời điểm bạn nhập truy vấn.

Từ đó, bạn có thể tìm hiểu những chủ đề khó, chẳng hạn như cách RNA polymerase hoạt động, thông qua những trải nghiệm trực quan được tạo sinh trong giao diện người dùng của Chế độ AI trên Tìm kiếm.
Xây dựng bất kỳ điều gì
Kế thừa thế mạnh của Gemini 2.5 Pro, Gemini 3 tiếp tục sẽ là công cụ trung tâm cho các nhà phát triển muốn biến ý tưởng thành sản phẩm. Mô hình có khả năng tạo sinh mã trong điều kiện không cần cung cấp ví dụ (zero shot) và xử lý các yêu cầu phức tạp để dựng nên giao diện web tương tác phong phú.
Gemini 3 cũng là mô hình hàng đầu của chúng tôi về lập trình tác nhân và “vibe coding”. Mô hình giúp các nhóm sản phẩm tự động hóa nhiều quy trình hơn, nâng cao đáng kể năng suất lập trình. Trên bảng xếp hạng WebDev Arena, Gemini 3 đạt điểm ELO 1487. Đồng thời, mô hình ghi nhận 54.2% trên Terminal-Bench 2.0 về khả năng dùng công cụ để điều khiển máy tính thông qua terminal, và đạt 76.2% trên SWE-bench Verified – một bộ đo lường hiệu quả hoạt động của các tác nhân lập trình.

Bạn có thể bắt đầu sử dụng Gemini 3 để lập trình ngay trong Google AI Studio, trên Vertex AI, qua Gemini CLI hoặc trên nền tảng lập trình tác nhân mới Google Antigravity. Mô hình cũng đã xuất hiện trên nhiều nền tảng bên thứ ba, bao gồm GitHub, JetBrains, Manus, Replit cùng một số công cụ lập trình khác.
Với Gemini 3, bạn có thể viết mã để xây dựng, tháo rời và “remix” các mô hình voxel 3D chi tiết, thử nghiệm trực tiếp trong AI Studio. Bạn cũng có thể tạo ra một thế giới khoa học viễn tưởng tương tác bằng cách sử dụng shader do mô hình gợi ý, hoặc “vibe code” để dựng nên các giao diện web và ứng dụng có tính tương tác cao, giàu tính thẩm mỹ.
Trải nghiệm lập trình ưu tiên tác nhân
Khi năng lực trí tuệ của mô hình được tăng tốc cùng Gemini 3, chúng tôi có điều kiện để tái nghĩ lại toàn bộ cách nhà phát triển tương tác với công cụ AI. Hôm nay, Google giới thiệu Google Antigravity – một nền tảng lập trình tác nhân mới cho phép các lập trình viên làm việc ở mức độ trừu tượng cao hơn, tập trung vào nhiệm vụ tổng thể thay vì từng thao tác chi tiết.
Google Antigravity khai thác khả năng lập luận nâng cao, sử dụng công cụ và lập trình tác nhân của Gemini 3 để biến AI từ trợ lý đơn lẻ thành một đối tác chủ động. Bề ngoài, đây vẫn là một môi trường lập trình tích hợp với AI (AI IDE) quen thuộc, nhưng các tác nhân giờ đây được đặt trong một không gian riêng với quyền truy cập trực tiếp vào trình soạn thảo mã, terminal và trình duyệt. Nhờ đó, các tác nhân có thể thay bạn lập kế hoạch và triển khai những tác vụ phần mềm phức tạp, nhiều bước, từ đầu đến cuối, đồng thời tự đánh giá lại mã của chính mình.
Bên cạnh Gemini 3 Pro, Google Antigravity cũng tích hợp chặt chẽ với mô hình Gemini 2.5 Computer Use, được tối ưu cho việc điều khiển trình duyệt, và mô hình chỉnh sửa hình ảnh Nano Banana (Gemini 2.5 Image) vốn được xếp hạng cao trong các bài đánh giá.
Trên thực tế, Google Antigravity có thể sử dụng Gemini 3 để vận hành một quy trình tác nhân hoàn chỉnh cho một ứng dụng theo dõi chuyến bay: tác nhân lập kế hoạch, viết mã, chạy thử và kiểm tra việc thực thi thông qua chức năng điều khiển máy tính trong trình duyệt.
Ứng dụng thực tế và định hướng phát triển của mô hình
Nâng tầm khả năng lập kế hoạch và tổ chức
Kể từ khi mở ra kỷ nguyên tác nhân với Gemini 2, chúng tôi đã đạt nhiều bước tiến lớn. Không chỉ năng lực lập trình tác nhân được nâng cao mà khả năng lập kế hoạch dài hạn, giữ cho nhiệm vụ đi đúng hướng cũng được cải thiện đáng kể. Gemini 3 là minh chứng rõ ràng khi mô hình dẫn đầu bảng xếp hạng Vending-Bench 2 – một bài kiểm tra khả năng lập kế hoạch dài hạn trong bối cảnh vận hành một mô hình kinh doanh máy bán hàng tự động mô phỏng.

Trong thử nghiệm này, Gemini 3 Pro thể hiện khả năng sử dụng công cụ và đưa ra quyết định ổn định trong suốt một năm vận hành mô phỏng, đồng thời tạo ra mức lợi nhuận cao hơn các mô hình tiên phong khác mà vẫn bám sát mục tiêu ban đầu.
Đối với người dùng, điều này đồng nghĩa với việc Gemini 3 có thể giúp xử lý công việc hàng ngày hiệu quả hơn. Bằng việc kết hợp khả năng suy luận sâu với việc dùng công cụ một cách nhất quán, Gemini 3 có thể thay bạn thực hiện những quy trình phức tạp, gồm nhiều bước, chẳng hạn như sắp xếp hộp thư Gmail bằng cách phân loại email, hoặc lập kế hoạch chi tiết cho một chuyến đi dài ngày. Tất cả đều diễn ra dưới sự kiểm soát và điều chỉnh của bạn.
Người dùng Google AI Ultra đã bắt đầu có thể trải nghiệm những tính năng tác nhân này trong ứng dụng Gemini thông qua Gemini Agent. Trong quá trình mở rộng khả năng tác nhân của Gemini, chúng tôi tích lũy được nhiều kinh nghiệm quan trọng và sẽ tiếp tục lắng nghe phản hồi để hoàn thiện khi đưa mô hình vào các sản phẩm khác của Google trong thời gian tới.

Gemini Agent có thể hỗ trợ bạn tổ chức lại hộp thư đến trong Gmail, cũng như đưa ra những gợi ý trực quan bằng hình ảnh hoặc mô đun tương tác trong ứng dụng Gemini, không chỉ dừng lại ở nội dung văn bản.
Phát triển Gemini 3 với trọng tâm là an toàn
Gemini 3 là mô hình được chúng tôi đầu tư nhiều nhất về mặt an toàn từ trước đến nay, đồng thời trải qua quy trình đánh giá toàn diện nhất từng áp dụng cho một mô hình Google AI. Kết quả cho thấy mô hình giảm rõ rệt xu hướng trả lời theo hướng chiều ý người dùng một cách vô điều kiện, tăng khả năng chống chịu trước các cuộc tấn công chèn lệnh và được nâng cấp để hạn chế việc bị lợi dụng trong các kịch bản tấn công mạng.
Bên cạnh hệ thống kiểm thử nội bộ cho những lĩnh vực ưu tiên cao trong Frontier Safety Framework, chúng tôi còn hợp tác với các chuyên gia độc lập hàng đầu. Google đã cung cấp quyền truy cập sớm Gemini 3 cho những tổ chức như UK AISI và nhận được các đánh giá độc lập từ những đơn vị uy tín trong ngành như Apollo, Vaultis, Dreadnode cùng một số đối tác khác.
Bước mở đầu cho kỷ nguyên mới của Gemini
Việc ra mắt Gemini 3 chỉ là bước đầu trong hành trình dài hơi. Kể từ hôm nay, Gemini 3 sẽ được triển khai theo nhiều hình thức khác nhau để phục vụ các nhóm người dùng đa dạng:
Đối với người dùng phổ thông, Gemini 3 có mặt trong ứng dụng Gemini và trong Chế độ AI trên Tìm kiếm dành cho những người đăng ký Google AI Pro và Ultra.
Đối với cộng đồng nhà phát triển, Gemini 3 hiện diện trong Gemini API trên AI Studio, trong nền tảng lập trình tác nhân Google Antigravity và thông qua Gemini CLI.
Với khách hàng doanh nghiệp, Gemini 3 được cung cấp trên Vertex AI và các gói dịch vụ Gemini Enterprise.
Đối với chế độ Gemini 3 Deep Think, chúng tôi đang dành thêm thời gian để hoàn thiện các bài đánh giá an toàn và tiếp tục lắng nghe phản hồi từ các nhóm thử nghiệm trước khi mở rộng cho người dùng đăng ký gói Google AI Ultra trong vài tuần tới.
Trong thời gian sắp tới, chúng tôi dự kiến sẽ giới thiệu thêm nhiều biến thể khác thuộc dòng Gemini 3, nhằm giúp bạn khai thác AI sâu hơn trong học tập, phát triển sản phẩm và lập kế hoạch cho mọi mặt của cuộc sống. Chúng tôi rất mong chờ những điều bạn sẽ khám phá, xây dựng và hoạch định cùng Gemini trong giai đoạn mới này.
