- Sử dụng ChatGPT/Gemini làm "Bách khoa toàn thư": Thay vì tra Google và phải tự tổng hợp từ nhiều nguồn, người già chủ động dùng AI để hỏi về kiến thức lịch sử, ý nghĩa các điển tích, hoặc nhờ tóm tắt các bài báo dài.
Lưu trữ các bài viết về công nghệ đăng trên báo Đồng Nai, Đồng Nai Cuối tuần, Lao động Đồng Nai
Thứ Bảy, 8 tháng 8, 2026
Ông già và biển cả: Ta già nhưng há sợ AI?
Thứ Ba, 30 tháng 6, 2026
Phiên dịch giọng nói mượt mà, tự nhiên với Gemini 3.5 Live Translate
Gemini 3.5 Live Translate là mô hình âm thanh mới nhất của Google, cung cấp khả năng dịch giọng nói trực tiếp gần như tức thời trên hơn 70 ngôn ngữ, bao gồm tiếng Việt.
Hôm nay, Google tiếp tục tiến thêm một bước với việc ra mắt Gemini 3.5 Live Translate, mô hình âm thanh mới nhất của Google dành cho dịch thuật giọng nói trực tiếp.
Mô hình tự động nhận diện hơn 70 ngôn ngữ, bao gồm cả tiếng Việt và tạo ra giọng nói được dịch một cách mượt mà, tự nhiên, đồng thời giữ được ngữ điệu, nhịp nói và cao độ giọng của người nói. Không giống các hệ thống dịch theo từng lượt hội thoại, vốn phải chờ người nói kết thúc trước khi phản hồi, 3.5 Live Translate liên tục tạo ra bản dịch bằng giọng nói, cân bằng giữa việc chờ thêm ngữ cảnh để cải thiện chất lượng dịch và dịch ngay lập tức để duy trì sự đồng bộ với người nói. Mô hình mang đến trải nghiệm âm thanh liền mạch, không có những khoảng ngắt quãng gượng gạo và chỉ chậm hơn người nói vài giây trong suốt cuộc trò chuyện.
Gemini 3.5 Live Translate bắt đầu được triển khai từ hôm nay trên các sản phẩm của Google:
- Dành cho các nhà phát triển dưới dạng bản xem trước công khai thông qua Gemini Live API và Google AI Studio
- Dành cho doanh nghiệp dưới dạng bản dùng thử riêng tư bắt đầu từ tháng này trên Google Meet
Gemini 3.5 Live Translate xử lý giọng nói theo thời gian thực ngay trong quá trình truyền tải, giúp tạo nên sự kết nối liền mạch hơn giữa các ngôn ngữ. Mô hình có thể xử lý đầu vào đa ngôn ngữ mà không cần cấu hình thủ công. Đồng thời, khả năng chống nhiễu mạnh mẽ giúp các ứng dụng hoạt động hiệu quả trong những môi trường ồn ào và khó kiểm soát. Bạn có thể tận dụng những khả năng này để hỗ trợ phiên dịch trực tiếp cho các cuộc gọi, cuộc họp, lớp học và chương trình phát sóng đa ngôn ngữ, cùng nhiều tình huống khác.
Thông qua việc sử dụng Gemini Live API, các nền tảng dành cho nhà phát triển như Agora, Fishjam, LiveKit, Pipecat và Vision Agents giúp các nhà phát triển dễ dàng xây dựng và triển khai các ứng dụng dịch giọng nói. Các tích hợp này đảm nhiệm phần hạ tầng truyền tải dữ liệu đa phương tiện theo thời gian thực vốn phức tạp, cho phép các nhà phát triển tập trung vào việc xây dựng trải nghiệm người dùng.
Các đối tác của chúng tôi tại Grab đang thử nghiệm mô hình này nhằm hỗ trợ giao tiếp đa ngôn ngữ gần như theo thời gian thực giữa tài xế và hành khách tại điểm đón. Hiện mỗi tháng, tài xế và hành khách thực hiện hơn 10 triệu cuộc gọi thoại thông qua nền tảng Grab.
Những phản hồi đầu tiên
Bên cạnh Grab, các công ty như CJ ENM, LiveKit cùng nhiều đơn vị khác cũng đã chia sẻ những phản hồi tích cực về 3.5 Live Translate, trong đó nhấn mạnh chất lượng dịch thuật ấn tượng, độ chính xác cao và độ trễ thấp của mô hình này:
“Trong quá trình thử nghiệm Gemini 3.5 Live Translate, chúng tôi đánh giá cao khả năng tự động nhận diện nhiều ngôn ngữ và dịch giọng nói một cách chính xác với độ trễ thấp của mô hình này.” - Philipp Kandal, Giám đốc Sản phẩm tại Grab
"CJ ENM rất hào hứng được hợp tác với Google DeepMind trong dự án 3.5 Live Translate. Các thử nghiệm ban đầu cho thấy chất lượng đầy hứa hẹn, góp phần mang lại trải nghiệm chân thực hơn cho khán giả toàn cầu và khán giả Hàn Quốc." - Bella Baek, Giám đốc AI tại CJ ENM
"Gemini 3.5 Live Translate giúp việc giao tiếp bằng giọng nói giữa nhiều ngôn ngữ trở nên dễ dàng hơn bao giờ hết. Tôi đã xây dựng một bản demo trên LiveKit Agents, nơi mọi người có thể nói ngôn ngữ của riêng mình và vẫn hiểu nhau theo thời gian thực." - Jesse Hall, Chuyên viên Hỗ trợ Nhà Phát triển tại LiveKit
"Trong quá trình làm việc với mô hình 3.5 Live Translate, chúng tôi đã thử nghiệm trên nhiều ngôn ngữ khác nhau và đội ngũ của chúng tôi thực sự ấn tượng trước tốc độ, độ chính xác và sự tự nhiên trong cách thể hiện của mô hình." - Nash Ramdial, Giám đốc tại VisionAgents
"Gemini 3.5 Live Translate kết hợp với giao thức MoQ của Fishjam mở ra một bước tiến mới cho hoạt động truyền phát đa phương tiện theo thời gian thực, cho phép dịch trực tiếp từ giọng nói sang giọng nói trên hơn 70 ngôn ngữ." - Maciej Rys, Phó chủ tịch kỹ thuật tại Software Mansion
"Chúng tôi đã thử nghiệm mô hình Gemini 3.5 Live Translate tại Agora và theo đánh giá của mình, mô hình đã mang lại những kết quả tiên tiến nhất hiện nay, với độ trễ thấp và độ chính xác cao, thiết lập một tiêu chuẩn mới cho dịch thuật theo thời gian thực." - Mason Adams, Chuyên viên Phát triển Phần mềm tại Agora
Trải nghiệm 3.5 Live Translate trong các cuộc họp trực tuyến
Tính năng dịch lời nói trong Google Meet sẽ sớm được ứng dụng mô hình 3.5 Live Translate, giúp nâng cao trải nghiệm người dùng thông qua:
- Hỗ trợ hơn 70 ngôn ngữ, một bước cải tiến lớn so với giới hạn chỉ 5 ngôn ngữ trước đây
- Cho phép trò chuyện qua lại giữa hơn 2.000 cặp tổ hợp ngôn ngữ khác nhau ngay trong một cuộc họp, mở rộng đáng kể so với trước đây khi chỉ hỗ trợ dịch qua lại giữa tiếng Anh và các ngôn ngữ khác
- Cập nhật giao diện mới giúp người dùng dễ dàng tiếp cận và sử dụng ngay tính năng dịch lời nói một cách tức thì.
Trải nghiệm 3.5 Live Translate trên ứng dụng Google Translate dành cho Android và iOS
Mô hình này cũng đang được triển khai trên ứng dụng Google Translate trên toàn cầu, áp dụng cho cả hệ điều hành Android và iOS. Khi sử dụng tính năng Dịch trực tiếp (Live translate), bạn chỉ cần kết nối với một cặp tai nghe bất kỳ để trải nghiệm bản dịch mượt mà hơn, đồng thời phản ánh chính xác tông giọng của người nói trên hơn 70 ngôn ngữ.
Đối với người dùng Android, chúng tôi cũng bắt đầu triển khai một “chế độ nghe” (Listening Mode) mới sử dụng 3.5 Live Translate, cho phép người dùng nghe bản dịch trực tiếp qua loa thoại của điện thoại. Chỉ cần đưa điện thoại lên tai như khi thực hiện một cuộc gọi thông thường, âm thanh đã được dịch sẽ được truyền trực tiếp đến bạn. Trải nghiệm mới này đặc biệt hữu ích trong những tình huống bạn muốn nhanh chóng nghe bản dịch mà không để người khác nghe thấy, hoặc khi không có sẵn tai nghe bên mình.
Được tích hợp ký hiệu mờ (watermark) bằng SynthID
Tất cả âm thanh do các mô hình của chúng tôi tạo ra đều được gắn watermark bằng SynthID. Watermark vô hình này được tích hợp trực tiếp vào đầu ra âm thanh, giúp nội dung do AI tạo ra vẫn có thể được nhận diện, qua đó góp phần ngăn chặn thông tin sai lệch. Để tìm hiểu thêm về cách tiếp cận của chúng tôi đối với vấn đề an toàn và trách nhiệm, vui lòng tham khảo thẻ thông tin mô hình.
Xem Video của Grab về mô phỏng tính năng Gemini 3.5 Live Translate: tại đây.
Thứ Ba, 21 tháng 4, 2026
Tính năng Trí thông minh cá nhân cho người dùng Gemini đã có tại Việt Nam
Đầu năm nay, chúng tôi đã giới thiệu tính năng Trí thông minh cá nhân (Personal Intelligence) tại Hoa Kỳ, cho thấy cách Gemini giúp cuộc sống trở nên dễ dàng hơn bằng việc thấu hiểu những điều bạn quan tâm nhất. Hôm nay, chúng tôi chính thức mang trải nghiệm cá nhân hóa này đến với người dùng tại Việt Nam.
Thứ Hai, 13 tháng 4, 2026
Google Finance phiên bản mới được hỗ trợ bởi AI mở rộng đến hơn 100 quốc gia, bao gồm Việt Nam
Thứ Tư, 1 tháng 4, 2026
Qua lại giữa Gemini và ChatGPT
Thứ Ba, 31 tháng 3, 2026
Mang những ký ức AI và lịch sử trò chuyện của bạn sang Gemini
Ta thường xài không chỉ một mà tới vài thằng trợ lý AI. Thí dụ, ChatGPT và Gemini. Như vậy sẽ có những điều ta nói với ChatGPT mà không nói với Gemini và ngược lại. Nghĩa là ChatGPT hiểu ta theo một cách, còn Gemini hiểu ta theo cách khác. Do đó, khi ta nói chuyện với Gemini mà nhắc tới thằng Tèo (trong khi trước đó ta chỉ nói tới thằng Tèo với ChatGPT mà thôi) thì Gemini nó đâu biết Tèo là thằng nào vì mới nghe lần đầu.
Bài viết của Maryam Sanglaji, Trưởng nhóm sản phẩm, ứng dụng Gemini, đăng ngày 26/3/2026 trên Google Blog, giới thiệu về tính năng đó và hướng dẫn cách sử dụng (nếu thích).
Chủ Nhật, 29 tháng 3, 2026
Tính năng Search Live mở rộng trên toàn cầu, bao gồm cả Việt Nam
Hôm nay, chúng tôi bắt đầu triển khai tính năng Search Live trên toàn cầu với tất cả các ngôn ngữ và khu vực có hỗ trợ Chế độ AI Mode. Với lần ra mắt này, người dùng tại hơn 200 quốc gia và vùng lãnh thổ sẽ có thể trò chuyện và tương tác với tính năng Tìm kiếm trong Chế độ AI Mode bằng cả giọng nói và camera.
Chủ Nhật, 15 tháng 3, 2026
AI đang thay đổi cách người tiêu dùng tìm kiếm và mở ra những cơ hội mới cho doanh nghiệp
Gemini là công cụ giúp nâng cao hiệu suất, góp phần thay đổi trải nghiệm người tiêu dùng, đồng thời khiến quảng cáo trở nên phù hợp và hiệu quả hơn. Công nghệ này cũng giúp thúc đẩy tăng trưởng cho doanh nghiệp bằng cách mang đến độ chính xác cao hơn, khơi mở sáng tạo và cung cấp sự hỗ trợ từ các tác nhân AI (AI agents) để tạo ra kết quả tốt hơn.
Tài liệu tóm lược này nêu bật các góc nhìn chiến lược được Dan Taylor, Phó Chủ tịch mảng Quảng cáo Toàn cầu của Google, chia sẻ trong buổi tọa đàm với báo chí, kết hợp góc nhìn toàn cầu với bối cảnh và kết quả tại Việt Nam.
Thứ Bảy, 28 tháng 2, 2026
Smartphone AI là như thế nào?
Tui xin nói ngay là tui chưa có ý định đổi điện thoại và cũng hổng có tiền mua điện thoại mới, nên không quan tâm với những model điện thoại mới ra mắt. Tuy nhiên điều khiến tui chú ý là Galaxy S26 được Samsung gọi là Galaxy AI. Tui tò mò muốn biết một chiếc smartphone ứng dụng AI như vậy có gì nổi trội so với smartphone khác. Vậy nên tui tìm đọc bài giới thiệu sau đây của Google để coi thử hệ điều hành Android trên Galaxy S26 có những tính năng AI mới như thế nào.
Nếu bạn có nhiều tiền và say mê công nghệ thì bài viết này giúp bạn hiểu hơn về sản phẩm và quyết định có nên mua hay không. Nếu các bạn cũng giống tui thì đọc bài này giúp bạn thỏa mãn trí tò mò, biết rằng có AI khác gì với không có. Còn nếu bạn không quan tâm đến công nghệ thì... đọc tới đây đủ rồi.
Thứ Tư, 25 tháng 2, 2026
Trí tuệ Cá nhân (Personal Intelligence) trên Gemini
Trong đời thường, có khi ta cần tìm hoặc cần nhớ đến một chi tiết nào đó rất riêng tư, thí dụ: Trong năm ngoái bạn đã có một chuyến đi chơi xa với bạn bè, giờ đây bạn muốn nhớ lại đã đi đâu, với ai, bằng phương tiện gì, chi phí ra sao. Tất nhiên nếu bạn hỏi AI thì nó không biết được vì đó là thông tin cá nhân. Bạn sẽ phải truy tìm lại các thông tin đã ghi lại, như mail, file đã lưu trên đĩa, hình ảnh đã chụp... và ngồi phân tích, tổng hợp.
Thứ Năm, 8 tháng 1, 2026
Khi Promptography thay thế Photography
Một ngày nọ, bạn nhìn thấy một bức ảnh quá đẹp – một cụ già với những nếp nhăn sâu thẳm, ánh sáng vàng vọt đổ bóng xuống con đường mưa tầm tã – rồi kêu lên: "Má ơi, tay nhiếp ảnh gia nào, xài máy ảnh gì mà thần sầu vậy ta?". Nhưng sự thật là: Chẳng có cái máy ảnh nào cả, cũng chẳng có cụ già nào dầm mưa hết. Tất cả chỉ là sản phẩm của một thằng cha đang ngồi vắt chân lên ghế, vừa nhâm nhi ly cà phê vừa... gõ phím.
Chào mừng bạn đến với kỷ nguyên của Promptography!Thứ Sáu, 2 tháng 1, 2026
Những trend tạo ảnh bằng Nano Banana thịnh hành nhất năm 2025
Mô hình chỉnh sửa và tạo hình ảnh Nano Banana của Google ra mắt vào tháng 8/2025 và nhanh chóng được yêu thích. Mọi người sử dụng Nano Banana rất nhiều (nhất là thông qua Gemini).
2. Tạo tượng nhỏ
Hãy thử dùng Nano Banana để tạo/chỉnh sửa theo ý mình đi bạn, nếu cần thì tham khảo các trend này cùng câu prompt do Google gợi ý. Thú vị lắm đó!
Thứ Hai, 29 tháng 12, 2025
ChatGPT cũng có "Cuối năm nhìn lại"
Ngày cuối năm đến rồi, nhiều người thích làm một cái "tổng kết cuối năm", hay "cuối năm nhìn lại" xem năm qua mình đã làm gì. Trong xu thế đó, ta thấy có YouTube Recap và Google Photos Recap như tui đã giới thiệu trong những bài trước. Giờ đến ChatGPT cũng có Bản tổng kết cá nhân cho mỗi người, và tên gọi cho Bản tổng kết này rất là cụ thể, rõ ràng: Your Year with ChatGPT.
Thứ Năm, 16 tháng 10, 2025
Google Search: Tính năng Chế độ AI nay đã có thể trải nghiệm bằng tiếng Việt!
Hãy tưởng tượng bạn có thể đặt cho Google Search một câu hỏi thật chi tiết—như so sánh các phương pháp pha cà phê khác nhau hoặc lên kế hoạch cho một chuyến đi cuối tuần phức tạp—và ngay lập tức nhận được câu trả lời phong phú do AI tạo ra, kèm theo những đường link hữu ích để khám phá sâu hơn. Đó chính là sức mạnh của Chế độ AI, và chúng tôi rất vui mừng thông báo rằng giờ đây tính năng này đã chính thức có mặt bằng tiếng Việt cho người dùng tại Việt Nam!
Thứ Sáu, 1 tháng 8, 2025
Những tính năng mới của NotebookLM - Số người dùng NotebookLM tại Việt Nam đạt Top 10 toàn cầu
Thứ Năm, 5 tháng 6, 2025
Xi gì đó Ô
Xi gì đó Ô tức là CxO, trong đó chữ quen thuộc nhứt với mọi người là CEO, tức Chief Executive Officer, thường được dịch là Giám đốc điều hành. Sau CEO, một chức vụ rất quan trọng nữa thường được nhắc đến là CFO, tức Chief Financial Officer, hay Giám đốc tài chánh. Rồi khi công nghệ thông tin phát triển ta có CIO, Chief Information Officer. Cho đến nay có vô số CxO ra đời, như COO, CTO, CMO... (tui sẽ liệt kê sau).
Thứ Bảy, 10 tháng 5, 2025
Tìm hiểu Nghệ thuật viết Prompt qua công cụ NotebookLM
Khi bạn đến với những ứng dụng AI, nhất là với những AI chatbot như ChatGPT, Gemini... thì Prompt mang ý nghĩa và đóng vai trò rất quan trọng.
Hiểu đơn giản, khi bạn sử dụng các công cụ AI, cái mà bạn gõ vào ô chat hoặc cung cấp cho AI để nó xử lý chính là "prompt". Độ rõ ràng, chi tiết và cách diễn đạt của prompt sẽ ảnh hưởng trực tiếp đến chất lượng và sự phù hợp của kết quả mà AI tạo ra.
Thứ Sáu, 9 tháng 5, 2025
NotebookLM - phần mềm sổ tay điện tử
Rất nhiều người khi nói đến AI thường chỉ nghĩ đến các chatbot như ChatGPT, hoặc Gemini, DeepSeek... Điều đó cũng dễ hiểu, bởi chatbot là những ứng dụng đối thoại trực tiếp với người dùng, và được nhiều người tiếp cận một cách trực quan nhất.
Chủ Nhật, 4 tháng 5, 2025
Tính năng Audio Overviews trên NotebookLM hỗ trợ hơn 50 ngôn ngữ, bao gồm tiếng Việt
hỗ trợ hơn 50 ngôn ngữ, bao gồm tiếng Việt
Thứ Hai, 28 tháng 4, 2025
ChatGPT xác định vị trí của ảnh dựa trên các manh mối trong hình
Mới đây, cộng đồng công nghệ xôn xao với tính năng mới được cập nhật trên ChatGPT - khả năng xác định vị trí của ảnh dựa trên các manh mối trong hình. Tính năng này được giới chuyên gia đánh giá là một "bước tiến vượt bậc" trong lĩnh vực nhận thức hình ảnh của AI.
Theo OpenAI, tính năng mới này hứa hẹn mang lại nhiều lợi ích thiết thực, đặc biệt trong các tình huống ứng phó khẩn cấp, ví dụ như hỗ trợ tìm kiếm nạn nhân gặp nạn thông qua hình ảnh hiện trường, hoặc phục vụ cho các mục đích nghiên cứu chuyên sâu.






























