Kto mówił
Model lokalnej detekcji mówcy dzieli nagranie na zwroty i etykietuje je Speaker 1, Speaker 2 i tak dalej, aby rozmowa czytała się jak scenariusz zamiast jednego bloku tekstu. Dwa małe pliki modelu, około 34 MB, pobierane raz.
Nowe w CaringDictate
CaringDictate teraz zauważa, kiedy rozmowa się rozpoczyna w dowolnym programie, nagrywa ją i zmienia w czytelną transkrypcję z etykietami mówcy i notatkami. Każdy z tych kroków odbywa się na twoim komputerze. Nic nie jest przesyłane, nie ma opłaty za minutę, i jest zawarte w tej samej jednorazowej cenie $49.
Jak to działa
Po włączeniu aplikacja CaringDictate obserwuje, które programy używają twojego mikrofonu i głośników jednocześnie — wzorzec, który tworzy rozmowa dwukierunkowa. Nie ma zatwierdzonej listy aplikacji: Zoom, Teams, WhatsApp, WeChat, Discord, Slack lub rozmowa w przeglądarce wyglądają dla niej wszystko tak samo.
Twój mikrofon trafia na lewy kanał, a audio drugiej strony na prawy, w jednym pliku stereo przechowywany na twoim komputerze. Plik jest pisany, gdy rozmowa się odbywa, więc awaria lub wyczerpana bateria pozostawia przegrawalny zapis zamiast niczego.
Gdy rozmowa się kończy, nagranie trafia do kolejki i jest transkrybowane w tle przez ten sam model mowy, którego używasz do dyktowania — na karcie graficznej, gdy wybrany model i maszyna mogą go używać. Czeka, gdy dyktują, więc nigdy nie walczy z tobą o maszynę.
Każda transkrypcja jest przeszukiwalna dla dowolnego słowa wewnątrz, w tym chińskiego. Zapisz jeden jako dokument Word, PDF, zwykły tekst, Markdown, lub jako .srt / .vtt napisy.
Kto mówił i do czego to doprowadziło
Ściana tekstu jest trudna w użyciu. Z włączoną detektorem mówcy, każdy zwrot jest przypisany, transkrypcja przerywa się na bloki mówcy, a nagranie uzyskuje krótki podział czasu każdej osoby.
Włącz przełącznik notatek i mały model języka na twoim dysku napisze streszczenie i elementy działań poniżej — i przemianuje nagranie z "Microsoft Teams" na coś, co rozpoznasz za miesiąc.
Oba są opcjonalne, oba są wyłączone, dopóki ich nie włączysz, i oba działają na tym komputerze jak wszystko innego w aplikacji.
Co jest w nim
Model lokalnej detekcji mówcy dzieli nagranie na zwroty i etykietuje je Speaker 1, Speaker 2 i tak dalej, aby rozmowa czytała się jak scenariusz zamiast jednego bloku tekstu. Dwa małe pliki modelu, około 34 MB, pobierane raz.
Każde nagranie pokazuje pasek udziału na mówcę z łącznym czasem mówienia. Przydatne do wywiadów i cicho ujawniające się na spotkaniu.
Włącz przełącznik notatek, a mały model sztucznej inteligencji na twoim dysku napisze streszczenie i listę elementów działań do każdego nagrania po jego transkrypcji. Sugeruje również tytuł, aby rząd przestał być nazywany "Microsoft Teams".
Osobisty słownik, który zbudowałeś do dyktowania — imena, nazwy produktów, terminy medyczne lub prawne — jest również stosowany do transkryptów spotkań.
Przeciągnij WAV, MP3 lub M4A nagrany gdzieś indziej i uzyskaj tę samą transkrypcję, te same etykiety mówcy i te same opcje eksportu. Do pięciu godzin audio.
Wybierz, gdzie znajdują się nagrania. Przechowuj je na zawsze lub miej automatycznie usunięte starsze, po 30, 90 lub 365 dniach, lub powyżej limitu dysku, który ustalasz. Przypiete nagrania nigdy nie są usuwane.
Ty jesteś za to odpowiedzialny
Nagrywanie jest wyłączone, gdy instalujesz CaringDictate. Przed przechwyceniem czegokolwiek przeczytaj krótką notatkę i zaakceptuj ją: reguły nagrywania różnią się w zależności od kraju i stanu, niektóre wymagają, aby wszyscy na rozmowie się zgodzili, a ta część jest dla ciebie.
Po tym jest proste. Mały wskaźnik siedzi na twoim ekranie podczas nagrywania, więc zawsze możesz powiedzieć. Czy wspomniałeś o tym innym osobom i jak to zrobić, to zależy od ciebie — aplikacja nie mówi za ciebie.
To nie jest porady prawne. Jeśli nie jesteś pewien co do konkretnej rozmowy, sprawdź reguły tam, gdzie ty i inne osoby jesteście.
Bezpośrednio z tobą
Warto przeczytać, zanim zdecydujesz, ponieważ część tego to to, czego ludzie oczekują od narzędzia spotkań i nie znajdują tutaj.
Nic nie dołącza do twojej rozmowy jako uczestnik, a nikt inny nie widzi, że CaringDictate jest tam. Nagrywa to, co twój własny komputer może już słyszeć, sposób, w jaki dyktafon na biurku byłby.
Jak i kiedy wspomniasz o nagraniu, to twoja rozmowa, a nie aplikacji. Na twoim ekranie siedzi mały wskaźnik podczas nagrywania, więc zawsze możesz powiedzieć, że jest włączona.
Aplikacja określa, ile różnych głosów jest i który zwrot należy do którego. Nie wie, kto jest kim, i nie buduje profilu głosu, który podąża za osobą między nagraniami.
Nagranie jest transkrybowane do pięciu godzin. Detekcja mówcy wymaga całego nagrania w pamięci, więc działa do 90 minut — poza tym nadal otrzymujesz pełną transkrypcję, po prostu bez etykiet.
Model notatek jest wystarczająco mały, aby działać na zwykłym komputerze, co jest punktem. Przeczytaj, co napisał, zanim wyślesz to komukolwiek.
Jeśli hostowany asystent spotkań, który dołącza do rozmowy, utrzymuje wspólny obszar roboczy drużyny i produkuje live napisy to to, czego potrzebujesz, to różna kategoria produktu i są dobre — zacznij z tym, którego twoja drużyna już używa. CaringDictate to opcja dla ludzi, którzy chcą, aby nagranie i transkrypcja pozostały na jednym komputerze.
Zanim zaczniesz
Pytania
Tak. Nagranie jest zapisywane na twoim własnym dysku twardym, transkrybowane przez model mowy już na twoim komputerze, a etykiety mówcy i notatki są produkowane przez modele na tej samej maszynie. Żadne audio, transkrypcja ani notatka nie jest przesyłana nigdzie — nie ma serwera zaangażowanego w nic z tego. Możesz wyjąć kabel sieciowy i wszystko to nadal działa.
Dowolne z nich. CaringDictate nie prowadzi listy zatwierdzonych aplikacji — obserwuje wzorzec audio, który tworzy rozmowa dwukierunkowa, więc Zoom, Microsoft Teams, WhatsApp, WeChat, Discord, Slack, Skype, rozmowa w Chrome lub Edge i wszystko innego działają w ten sam sposób. Możesz również nacisnąć Nagraj teraz i przechwycić coś, w tym rozmowę w pokoju.
Nie. Jest wyłączone, gdy instalujesz aplikację, a nic nie jest nagrywane, dopóki nie przeczytałeś i nie zaakceptowałeś krótkiej jednorazowej notatki na temat bycia odpowiedzialnym za zgodę tam, gdzie jesteś. Wyłączenie go ponownie zatrzymuje wszelkie automatyczne nagrywanie natychmiast.
To zależy od tego, gdzie ty i inne osoby jesteście. Niektóre kraje i stany USA wymagają, aby wszyscy na rozmowie się zgodzili; inni potrzebują tylko jednego. Nie możemy znać twojej sytuacji, a to nie jest porady prawne — jeśli nie jesteś pewien, zapytaj lub sprawdź reguły tam, gdzie jesteś, zanim nagryjesz.
Nie, chyba że im powiesz — to twoja rozmowa do zrobienia, w twoich słowach, a aplikacja nie mówi za ciebie. Na twoim ekranie siedzi mały wskaźnik podczas nagrywania, więc zawsze możesz powiedzieć, że jest włączona. Możesz wyłączyć ten wskaźnik, jeśli wolisz go nie widzieć.
Tak, po zainstalowaniu modeli mówców — dwa pliki, około 34 MB, pobierane raz w tle. Transkrypty następnie wychodzą jako Speaker 1, Speaker 2 i tak dalej, z podziałem, jak długo każda osoba mówiła. Etykiety są pozycyjne, nie tożsamościami: aplikacja nie ma pojęcia, kto jest kim, i nie prowadzi profilu głosu między nagraniami.
Tak, jeśli włączysz przełącznik notatek. Mały model języka jest pobierany raz, a następnie po każdym nagraniu jest transkrybowany, napisze krótkie streszczenie i listę elementów działań do tego nagrania i sugeruje tytuł. Działa na twoim procesorze jak wszystko innego tutaj, więc na wolniejszej maszynie zajmuje kilka minut. Dla nagrań, które już masz, jest przycisk Utwórz notatki na samym nagraniu.
Tak. Przeciągnij plik WAV, MP3 lub M4A na stronę Meetings, lub wybierz go przyciskiem. Otrzymujesz tę samą transkrypcję, te same opcjonalne etykiety mówcy i te same opcje eksportu — Word, PDF, tekst, Markdown, lub napisy. Obsługiwane są pliki do pięciu godzin.
Przeczytaj ją w aplikacji, skopiuj ją, przeszukaj każdą transkrypcję, którą masz, dla dowolnego słowa wewnątrz, lub zapisz ją jako dokument Word (.docx), PDF, zwykły tekst, Markdown, lub jako .srt / .vtt napisy. Audio pozostaje obok niej w swoim własnym folderze, który możesz otworzyć w każdej chwili.
Każde nagranie uzyskuje własny folder — w folderze danych CaringDictate domyślnie, lub gdziekolwiek wybierzesz. Wewnątrz są skompresowany plik audio, transkrypcja i notatki, jeśli je włączyłeś. Możesz przechowywać wszystko na zawsze, lub miej nagrania starsze niż 30, 90 lub 365 dni usunięte automatycznie, lub ustaw budżet dysku od 5 do 50 GB i pozwól najstarszemu pójść. Cokolwiek przypisujesz, nigdy nie zostaje usunięte.
Nagrywanie jest lekkie — pisze audio na dysk. Transkrypcja to ciężka część, i dzieje się to po rozmowie, jedno nagranie naraz, w tle. Gdzie twój wybrany model i maszyna na to pozwoli, praca działa na karcie graficznej, która jest kilka razy szybsza niż procesor, a aplikacja teraz mówi na stronie modeli głosu, który robi słuchanie. Wstrzymuje się, gdy dyktują, więc nigdy nie konkuruje z tobą.
Nie. Nagrywanie spotkań, transkrypcja, etykiety mówcy i notatki są częścią CaringDictate za tę samą jednorazową cenę $49, i przybyły w bezpłatnej aktualizacji dla ludzi, którzy to już kupili. Nie ma opłaty za minutę i nie ma planu miesięcznego, ponieważ nie ma serwera, za który ktoś by płacił.
Spróbuj na następnym połączeniu
Bezpłatny okres próbny 7 dni to cała aplikacja — dyktowanie, spotkania, transkrypty i wszystko. Bez logowania, bez karty.
$49 jednorazowo po okresie próbnym · Gwarancja zwrotu pieniędzy przez 30 dni