Ứng dụng Transcriptinator ghi âm hoặc nhập âm thanh, phiên âm, xác định người nói và – tùy chọn – giúp bạn chuyển những gì đã nói thành ghi chú hữu ích. Mọi thông tin nhạy cảm đều được lưu trữ trên thiết bị của bạn.
Hoạt động trên thiết bị từ đầu đến cuối. Âm thanh không bao giờ rời khỏi điện thoại của bạn. Quá trình phiên âm chạy trên các mô hình Whisper mã nguồn mở cục bộ. Nhận dạng người nói sử dụng mô hình phân tách giọng nói pyannote và mô hình nhúng người nói 3D – cũng được thực hiện cục bộ. Bạn có thể sử dụng Transcriptinator ở chế độ máy bay; bước duy nhất cần kết nối mạng là tải xuống mô hình một lần.
Học giọng nói, không chỉ âm thanh. Chỉ cần đặt tên cho người nói một lần – ví dụ: "đó là đồng nghiệp Dana của tôi" – và Transcriptinator sẽ tự động gắn nhãn cho người đó trong mọi bản ghi âm sau này khi người đó nói. Hồ sơ giọng nói chỉ được lưu trữ trên thiết bị của bạn và không bao giờ được tải lên.
Chọn mức chất lượng. Có ba mức chất lượng phiên âm: Nhanh (Whisper cơ bản, ~200 MB), Cân bằng (Whisper nhỏ, ~600 MB) và Chính xác (Whisper trung bình, ~1,5 GB). Thiết lập tùy chọn toàn cầu, hoặc
chuyển đổi bất kỳ bản ghi âm nào thành văn bản với cấp độ khác nhau chỉ bằng một lần chạm.
Tự tạo quy tắc của riêng bạn. Chuyển các cụm từ được nói thành các thẻ trích xuất có cấu trúc mà bạn có thể sử dụng sau này. Nói "vuốt ve con mèo" và nhận được một việc cần làm. Nói "chúng ta hãy gặp nhau vào thứ Ba lúc 3 giờ" và nhận được một sự kiện trên lịch. Hai
chế độ khớp:
- Ngoại tuyến (cụm từ theo nghĩa đen) — xác định, không cần khóa API, chạy hoàn toàn trên thiết bị.
- AI (mô tả ngữ nghĩa) — với LLM được cấu hình, các mô tả bằng tiếng Anh thông thường sẽ tự động nhận diện các cụm từ diễn giải lại.
AI tùy chọn, sử dụng khóa của riêng bạn. Để phân loại tài liệu, tóm tắt và trích xuất thông minh các việc cần làm, sự kiện trên lịch, lời nhắc, quyết định, câu hỏi và ghi chú, hãy kết nối với một trong ba nhà cung cấp:
- Anthropic (Claude)
- OpenAI (ChatGPT)
- Google (Gemini)
Bạn tự cung cấp khóa API. Khóa được lưu trữ an toàn trên thiết bị của bạn — không bao giờ trên máy chủ của chúng tôi, không bao giờ trong bản sao lưu. Sự đồng ý là tùy chọn và có thể thu hồi bất cứ lúc nào. Chỉ có bản ghi văn bản mới được gửi đến nhà cung cấp của bạn
— không bao giờ là âm thanh, không bao giờ là đoạn ghi âm giọng nói. Tổng số tiền sử dụng hàng tháng và số lượng mã thông báo cho mỗi bản ghi được hiển thị ngay trong ứng dụng để bạn luôn biết mình đang chi tiêu bao nhiêu.
Mỗi đoạn trích đều ghi rõ nguồn gốc. Chạm vào việc cần làm, sự kiện lịch hoặc thẻ nhắc nhở để chuyển đến chính xác thời điểm đoạn âm thanh được nói. Các đoạn trích mang theo câu nói nguyên văn và liên kết trở lại
phân đoạn nguồn để bạn có thể xác minh trước khi hành động.
Những điểm mạnh của Transcriptinator
- Ghi chú cuộc họp với 2-6 người tham gia
- Phỏng vấn dài, bài giảng, bài thuyết giáo
- Ghi âm giọng nói cần bản ghi chép thực sự, không chỉ là bản ghi âm
- Nhập bản ghi âm hiện trường (WAV bao gồm IMA ADPCM, MP3, M4A, OGG, FLAC)
- Xây dựng quy trình làm việc của riêng bạn với các quy tắc tùy chỉnh
Những gì nó không làm được
- Phụ đề trực tiếp trong khi gọi — mọi thứ được xử lý sau khi ghi âm
- Xác minh người nói vì lý do bảo mật — việc khớp giọng nói chỉ là tiện ích gắn nhãn, không phải xác thực
- Đồng bộ hóa đám mây — một cách cố ý. Bản ghi âm của bạn sẽ được lưu trên điện thoại
Miễn phí, không quảng cáo, không bán thêm sản phẩm. Ứng dụng Transcriptinator hoàn toàn miễn phí và sẽ luôn miễn phí. Không quảng cáo, không mua hàng trong ứng dụng, không có gói trả phí. Các tính năng AI thực sự là tùy chọn — ứng dụng hoạt động hoàn toàn mà không cần bất kỳ dịch vụ bên ngoài nào.
Nhà phát hành: Cherry Blossom Development, LLC
Chuyển đổi giọng nói từ bất kỳ thiết bị ghi âm nào thành văn bản, xác định người nói và phân loại.
Lần cập nhật gần đây nhất
4 thg 9, 2026