Vem talade
En lokal högtalardetektionsmodell delar inspelningen in i omgångar och märker dem Talare 1, Talare 2 och så vidare, så en konversation läses som ett manus istället för ett textblock. Två små modellfiler, cirka 34 MB, laddas ner en gång.
Nytt i CaringDictate
CaringDictate märker nu när ett samtal börjar i vilket program som helst, spelar in det, och förvandlar det till ett läsbart transkript med högtalarmarkeringar och anteckningar. Varje ett av dessa steg sker på din dator. Inget laddas upp, det finns ingen per-minut-avgift, och det är inkluderat i samma $49-engångspris.
Så fungerar det
När du väl slår på det, CaringDictate bevakar vilka program som använder din mikrofon och högtalare på samma gång — mönstret ett tvåvägssamtal gör. Det finns ingen lista över godkända appar: Zoom, Teams, WhatsApp, WeChat, Discord, Slack eller ett samtal i din webbläsare ser alla samma ut för den.
Din mikrofon går på vänster kanal och andra sidans ljud på höger, i en stereofil som hålls på din dator. Filen skrivs när samtalet sker, så en krasch eller ett flatt batteri lämnar en spelbara inspelning snarare än ingenting.
När samtalet slutar, inspelningen går med i en kö och transkriberas i bakgrunden av samma talmodell du dikterar med — på ditt grafikkort, när din valda modell och maskin kan använda ett. Det väntar medan du dikterar, så det konkurrerar aldrig med dig om maskinen.
Varje transkript är sökbar efter vilket ord som helst inne i det, inklusive kinesiska. Spara en som ett Word-dokument, PDF, vanlig text, Markdown, eller som .srt / .vtt-undertexter.
Vem talade, och vad det kom till
En vägg av text är svår att använda. Med högtalardetektionen påslagen, varje tur tillskrivs, transkriptet bryter in i högtalarblock, och inspelningen får en kort fördelning av vem som talade hur mycket.
Slå även på anteckningsväxlingen och en liten språkmodell på din egen disk skriver en sammanfattning och åtgärdspunkterna under — och byter namn på inspelningen från "Microsoft Teams" till något du kommer att känna igen en månad senare.
Båda är valfria, båda är av tills du slår på dem, och båda körs på denna dator som allt annat i appen.
Vad är det inne i den
En lokal högtalardetektionsmodell delar inspelningen in i omgångar och märker dem Talare 1, Talare 2 och så vidare, så en konversation läses som ett manus istället för ett textblock. Två små modellfiler, cirka 34 MB, laddas ner en gång.
Varje inspelning visar ett delningsblock per talare med deras totala talkid. Användbart för intervjuer, och tyst avslöjande i ett möte.
Slå på anteckningsväxlingen och en liten AI-modell på din egen disk skriver en sammanfattning och en lista med åtgärdspunkter in i varje inspelning efter att den transkriberats. Det föreslår också en titel, så raden slutar inte kallas "Microsoft Teams".
Den personliga ordboken du byggde för diktering — namn, produktnamn, medicinska eller juridiska termer — tillämpas också på mötestranskript.
Dra in en WAV, MP3 eller M4A du spelade in någon annanstans och få samma transkript, samma högtalarmarkeringar och samma exportval. Upp till fem timmar ljud.
Välj var inspelningar bor. Behåll dem för alltid eller få äldre borttagna efter 30, 90 eller 365 dagar, eller över en diskgräns du ställer in. Fästa inspelningar tas aldrig bort.
Du är ansvarig för det
Inspelning är av när du installerar CaringDictate. Innan något fångas läser du en kort anteckning och accepterar det: inspelningsregler skiljer sig beroende på land och stat, några frågar att alla på samtalet är överens, och den delen är din för att hantera.
Efter det är det enkelt. En liten indikator sitter på din skärm medan en inspelning körs, så du kan alltid säga. Om du nämner det för de andra på samtalet, och hur, är din beslut — appen talar inte för dig.
Detta är inte juridisk rådgivning. Om du är osäker på ett specifikt samtal, kontrollera reglerna där du och de andra personerna är.
Att vara rak med dig
Värt att läsa innan du bestämmer dig, eftersom något av detta är vad människor förväntar sig från ett mötesverktyg och inte kommer att hitta här.
Inget går med i ditt samtal som deltagare, och ingen annan ser att CaringDictate är där. Det spelar in vad din egen dator redan kan höra, på det sätt en inspelare på skrivbordet skulle.
Hur och när du nämner en inspelning är din sak, inte appens. På din egen skärm, en liten indikator sitter där medan en körs, så du kan alltid säga att det är på.
Appen räknar ut hur många olika röster det finns och vilken tur som tillhör vilken. Det vet inte vem någon är, och det bygger inte en röstprofil som följer en person mellan inspelningar.
En inspelning transkriberas upp till fem timmar. Högtalardetektionen behöver hela inspelningen i minnet, så den fungerar upp till 90 minuter — förbi det får du fortfarande den fullständiga transkripten, bara utan etiketterna.
Anteckningsmodellen är liten nog för att köras på en vanlig dator, vilket är poängen. Läs vad den skrev innan du skickar det till någon.
Om en värdtjänst för mötebiståndet som går med i samtalet, håller en delad teamarbetsyta och producerar live bildtexter är vad du behöver, det är en annan kategori av produkt och det finns bra — börja med vilken som helst din team redan använder. CaringDictate är möjligheten för människor som vill att inspelningen och transkriptet ska stanna på en dator.
Innan du börjar
Frågor
Ja. Inspelningen skrivs till din egen hårddisk, transkriberas av en talmodell redan på din dator, och högtalarmarkeringarna och anteckningarna produceras av modeller på samma maskin. Ingen ljud, transkript eller anteckning laddas upp någonstans — det finns ingen server inblandad i något av det. Du kan dra ut nätverkskabeln och det fungerar fortfarande allt.
Vilka som helst. CaringDictate håller inte en lista över godkända appar — det bevakar mönstret ett tvåvägssamtal gör, så Zoom, Microsoft Teams, WhatsApp, WeChat, Discord, Slack, Skype, ett samtal i Chrome eller Edge, och vad som helst annat all fungerar på samma sätt. Du kan också trycka på Spela in nu och fånga vad som helst, inklusive en konversation i rummet.
Nej. Det är av när du installerar appen, och ingenting spelas in förrän du har läst och accepterat en kort engångsanteckning om att vara ansvarig för samtycke där du är. Att slå tillbaka det av stoppar all automatisk inspelning direkt.
Det beror på var du och de andra personerna är. Vissa länder och amerikanska stater frågar att alla på samtalet är överens; andra behöver bara en person. Vi kan inte veta din situation och detta är inte juridisk rådgivning — om du är osäker, fråga, eller kontrollera reglerna där du är innan du spelar in.
Inte om du säger det — det är din sak att göra, i dina egna ord, och appen talar inte för dig. På din egen skärm, en liten indikator sitter där medan en inspelning körs, så du kan alltid säga att det är på. Du kan slå av den indikatorn om du föredrar att inte se den.
Ja, när högtalarmodellerna är installerade — två filer, cirka 34 MB, hämtade en gång i bakgrunden. Transkripten kommer sedan ut som Talare 1, Talare 2 och så vidare, med en fördelning av hur länge varje person talade. Etiketterna är positionella, inte identiteter: appen har ingen aning om vem någon är och behåller ingen röstprofil mellan inspelningar.
Ja, om du slår på anteckningsväxlingen. En liten språkmodell laddas ner en gång och skriver sedan, efter att varje inspelning transkriberas, en kort sammanfattning och en lista med åtgärdspunkter in i den inspelningen och föreslår en titel för den. Det körs på din processor som allt annat här, så det tar några minuter på en långsammare maskin. För inspelningar du redan har, det finns en Skapa anteckningar-knapp på själva inspelningen.
Ja. Dra en WAV-, MP3- eller M4A-fil till Möten-sidan, eller välj det med knappen. Du får samma transkript, samma valfria högtalarmarkeringar, och samma exportval — Word, PDF, text, Markdown, eller undertexter. Filer upp till fem timmar stöds.
Läs det i appen, kopiera det, sök alla transkript du har efter ett ord inne i det, eller spara det som ett Word-dokument (.docx), en PDF, vanlig text, Markdown, eller som .srt / .vtt-undertexter. Ljudet stannar vid sidan av det i sin egen mapp, som du kan öppna när som helst.
Varje inspelning får sin egen mapp — i din CaringDictate-datamapp som standard, eller var som helst du väljer. Inne i det är den komprimerade ljudfilen, transkriptet och anteckningarna om du aktiverade dem. Du kan behålla allt för alltid, eller få inspelningar äldre än 30, 90 eller 365 dagar borttagna automatiskt, eller ställ in en diskbudget på 5 till 50 GB och låt det äldsta gå. Allt du fäster tas aldrig bort.
Inspelning är lätt — det är att skriva ljud till disk. Transkribering är den tung delen, och det händer efter samtalet, en inspelning åt gången, i bakgrunden. Där din valda modell och maskin tillåter det, arbetet körs på ditt grafikkort, vilket är flera gånger snabbare än processorn, och appen säger nu på sin Röstmodeller-sida vilken som lyssnar. Det pausas medan du dikterar så det konkurrerar aldrig med dig.
Nej. Mötessamling, transkribering, högtalarmarkeringar och anteckningar är en del av CaringDictate till samma $49-engångspris, och de kom i en gratis uppdatering för människor som redan köpt den. Det finns ingen per-minut-avgift och ingen månatlig plan, eftersom det inte finns någon server för någon att betala för.
Prova det på ditt nästa samtal
Den gratis 7-dagars provperioden är hela appen — diktering, möten, transkript och allt. Ingen registrering, inget kort.
$49 engång efter provperioden · 30-dagars pengarna-tillbaka-garanti