Rekordy wideo i audio — przesyłanie nagrań do 2 GB, nagrania spotkań Teams, przeglądarka multimediów, transkrypcje i napisy, znaczniki redakcji oparte na czasie (ramka, rozmycie, pikselizacja, wyciszenie, sygnał dźwiękowy (bleep), zniekształcenie głosu, wstrzymanie), automatyczne śledzenie, wykrywanie twarzy i tekstu na ekranie, podgląd po redakcji oraz sposób udostępniania nagrań

Last updated: September 03, 2026 by Steve

Rekordy wideo i audio

Nagrania — zapisy z kamer nasobnych i CCTV, nagrania dyspozytorskie i 911, nagrania przesłuchań, poczta głosowa, nagrania spotkań Teams — to dokumenty takie jak każde inne we wniosku. Znajdują się w tym samym obszarze roboczym Dokumenty, z fasetą Wideo lub Audio, kolumną Czas trwania oraz plakietkami przetwarzania w wierszu. Oryginał nigdy nie jest modyfikowany: kopie do odtwarzania, miniatury, transkrypcje i udostępnione kopie to pliki pochodne przechowywane obok niego.

Nagrania na karcie Dokumenty, przefiltrowane do fasety Wideo

Wszystko na tej stronie ma zastosowanie wszędzie tam, gdzie widzisz kartę Dokumenty — oceny ochrony prywatności, incydenty i skargi mają ten sam obszar roboczy co wnioski.

Wprowadzanie nagrań

  • Przesyłanie. Upuść plik na karcie Dokumenty lub użyj Utwórz lub prześlij. Nagrania do 2 GB są akceptowane domyślnie. Pliki powyżej 100 MB są przesyłane we fragmentach z możliwością wznowienia: panel Kolejka przesyłania pokazuje postęp dla każdego pliku i przetrwa przerwane połączenie (wstrzymanie, wznowienie, anulowanie). Pozostaw stronę otwartą, dopóki się nie zakończy.
  • Nagrania spotkań Teams. Otwórz Dodaj z Microsoft 365 i wybierz Nagrania spotkań Teams, aby przechwycić nagranie spotkania, które zorganizowałeś. Nagranie jest pobierane przez przeglądarkę do kolejki przesyłania, a wygenerowana przez Teams transkrypcja jest dołączana razem z nim, jeśli istnieje, dzięki czemu nagranie nigdy nie jest transkrybowane po raz drugi.

Panel Kolejka przesyłania z dużym plikiem przesyłanym we fragmentach z możliwością wznowienia

Nagrania spotkań Teams w selektorze Dodaj z Microsoft 365

Przetwarzanie

Po przesłaniu rekord pokazuje Przetwarzanie, dopóki przygotowywana jest odtwarzalna w przeglądarce kopia, klatka plakatu, miniatury po najechaniu kursorem oraz (dla audio) waveform. Gdy transkrypcja jest włączona, pojawia się następnie plakietka Transkrybowanie…. Wdrożenie bez procesora multimediów odkłada rekord jako Wymaga procesora multimediów, dopóki nie stanie się dostępny — nigdy się to nie kończy niepowodzeniem — a Ponów znajduje się w wierszu dla nieudanego przygotowania. Jeśli Twoje wdrożenie skanuje przesyłane pliki za pomocą Microsoft Defender for Storage, rekord oznaczony jako złośliwy nie może zostać odtworzony, pobrany ani udostępniony.

Oglądanie i słuchanie

Otwórz wiersz, aby przejść do przeglądarki multimediów: natywne elementy sterujące, Spacja do odtwarzania i wstrzymywania, klawisze strzałek oraz J / K / L do przewijania krokowego i przeszukiwania, F dla pełnego ekranu, prędkość odtwarzania oraz przewijanie po najechaniu kursorem na oś czasu. Rekordy audio dodają pas waveform. Gdy rekord był już wcześniej otwierany, przeglądarka oferuje Wznów od gg:mm:ss.

Przeglądarka multimediów ze śledzonym znacznikiem rozmycia i podpisem wyłączenia w kadrze

Transkrypcje i napisy

Gdy wdrożono Azure AI Speech, każde nowe nagranie jest transkrybowane po przygotowaniu (administrator może to wyłączyć w Ustawienia → Funkcje). Szuflada Transkrypcja obok odtwarzacza pokazuje transkrypcję ze znacznikami czasu i etykietami mówców: kliknij segment, aby przejść do momentu, w którym pada dana wypowiedź, użyj Znajdź w transkrypcji, aby zlokalizować słowo, oraz włącz napisy w odtwarzaczu. Tekst transkrypcji zasila wyszukiwanie treści, wykrywanie duplikatów, podsumowania AI oraz Ask AccessPoint tak samo jak tekst każdego innego dokumentu i podlega tej samej bramce uprawnienia do PII wnioskodawcy co dokument — użytkownicy, którzy nie widzą PII wnioskodawcy, widzą wyłącznie liczby i czasy trwania.

Szuflada transkrypcji z etykietami mówców i funkcją znajdź w transkrypcji

Oznaczanie nagrania

Redakcja na nagraniu jest oparta na czasie: każdy znacznik obejmuje przedział na osi czasu, a dla wideo może dodatkowo obejmować obszar obrazu. Znaczniki tworzy się w widoku Redline (klawisze 1, 2 i 3 przełączają między Original, Redline i Redacted preview).

Otwórz Redaguj ▾ w panelu bocznym:

  • Zaznacz… pobiera przedział z Twojego zaznaczenia na osi czasu lub z głowicy odtwarzania i pozwala narysować obszar na klatce. Brak obszaru oznacza cały obraz dla danego przedziału.
  • Wycisz przedział, Zniekształć głos w przedziale oraz Wstrzymaj nagranie to skróty dla dźwięku i całego rekordu.
  • Wykryj twarze i tekst na ekranie (wideo) oraz Znajdź i zredaguj (wymaga transkrypcji) to narzędzia wykrywania opisane poniżej.

Menu Redaguj na nagraniu

Każdy znacznik ma Efekt: Ramka, Rozmycie lub Pikselizacja dla obrazu; Wycisz dźwięk, Sygnał dźwiękowy (bleep) lub Zniekształć głos dla dźwięku; Wstrzymaj całe nagranie dla całego rekordu. Podobnie jak redakcja strony, każdy znacznik niesie wyłączenie z alternatywami, komentarzami, flagami, zatwierdzeniem oraz wyświetlaną etykietą — cytatem wyłączenia, tekstem niestandardowym lub bez etykiety — która jest nadrukowywana w kadrze na udostępnionej kopii.

Okno dialogowe Nowy znacznik z otwartą listą efektów

Znacznik obszaru wraz z wyłączeniem, alternatywami i etykietą w panelu bocznym

Śledzenie poruszającego się obiektu

Znacznik obszaru może poruszać się razem z osobą lub przedmiotem, który obejmuje. Zaznacz znacznik i otwórz jego menu Śledzenie:

  • Śledź ten znacznik automatycznie podąża za obiektem, który zaznaczyłeś, przez cały klip w obu kierunkach. Zwykle rozszerza znacznik wcześniej, ponieważ zwykle zaznaczasz twarz w chwili, gdy ją zauważysz, i zatrzymuje się, zamiast dryfować, gdy traci obiekt.
  • Dodaj punkty śledzenia przez przeciąganie — przesuń głowicę odtwarzania, przeciągnij ramkę tam, gdzie obiekt znajduje się teraz, a redakcja przemieści się między punktami. Punkty śledzenia są widoczne jako znaczniki na pasku osi czasu.
  • Wyczyść śledzenie na tym znaczniku usuwa klatki kluczowe.

Śledź ten znacznik automatycznie na znaczniku obszaru

Zniekształcanie głosu

Zniekształć głos to inny rodzaj ograniczenia niż Wycisz i Sygnał dźwiękowy: wysokość dźwięku w przedziale jest przesunięta tak, że mówcy nie da się już zidentyfikować, podczas gdy każde słowo pozostaje słyszalne. Użyj tego tam, gdzie wyciszenie usunęłoby więcej, niż uzasadnia wyłączenie — regulatorzy nakazywali dokładnie to zamiast usunięcia (na przykład decyzje Ontario IPC MO-3961 i PO-4190), a niektóre ustawy o opłatach wymieniają „zniekształcanie" wśród płatnych metod maskowania. Wybierz Redaguj ▾ → Zniekształć głos w przedziale albo wybierz Zniekształć głos z listy Efekt w dowolnym oknie dialogowym znacznika. Przedział jest pokazywany na osi czasu w kolorze swojego wyłączenia z plakietką Zniekształcenie w panelu bocznym. W podglądzie Redacted preview przeglądarka nie potrafi na żywo przesunąć wysokości dźwięku, więc przedział jest odtwarzany wyciszony, a notatka przypomina, że udostępniona wersja zachowuje słowa słyszalne przy zmienionym głosie. Zniekształcenie jest stosowane w chwili tworzenia pliku do udostępnienia, a indeks redakcji i dziennik rejestrują efekt i wyłączenie dla każdego przedziału. Przedziały Zniekształcenia, Wyciszenia i Sygnału dźwiękowego można łączyć na jednym nagraniu.

Wykrywanie twarzy i tekstu na ekranie

Z menu Redaguj Wykryj twarze i tekst na ekranie przechodzi przez klatki wideo i proponuje:

  • Jeden śledzony obszar na każdą znalezioną twarz. Detektor twarzy działa w całości na Twoim App Service — nic nie opuszcza dzierżawy i nie ma opłaty za klatkę.
  • Obszar wszędzie tam, gdzie na ekranie pojawiają się wzorce wykrywania Twojej organizacji — tablica rejestracyjna, identyfikator z nazwiskiem, akta sprawy na monitorze. Przebieg dla tekstu odczytuje próbkowane klatki za pomocą Azure AI Document Intelligence i jest rozliczany za klatkę.

Propozycje używają Twojego domyślnego efektu obszaru (Rozmycie, chyba że Ustawienia → Wygląd redakcji mówią inaczej). Skanowanie działa w tle z powiadomieniem o postępie na żywo; możesz zamknąć przeglądarkę i wrócić później, a powiadomienie pojawia się po zakończeniu wraz z liczbą propozycji. Każde trafienie to przerywana bursztynowa propozycja oczekująca na Twoją akceptację lub odrzucenie — nic nie jest stosowane po cichu. Ponowne skanowanie oferuje zastąpienie wcześniejszych nieprzejrzanych propozycji, dzięki czemu ponowne uruchomienia nigdy nie piętrzą duplikatów. Każdy z dwóch detektorów może zostać wyłączony przez administratora w Ustawienia → Funkcje.

Skanowanie działające w tle

Wykryte twarze oczekujące na przegląd jako śledzone propozycje

Znajdź i zredaguj, reguły sugestii oraz przebieg redakcji AI działają również na transkrypcji: proponują znaczniki Wycisz na wypowiadanym przedziale, abyś mógł je zaakceptować lub odrzucić, dokładnie tak jak proponują redakcje tekstu w dokumencie.

Podgląd po redakcji

Widok Redacted preview odtwarza rekord tak, jak otrzyma go wnioskodawca — rozmyte, oznaczone ramką lub spikselizowane obszary, wyciszone lub zagłuszone przedziały oraz podpis etykiety wypalony w kadrze. Pokazuje wyłącznie zastosowane znaczniki; propozycje nigdy się w nim nie pojawiają.

Podgląd po redakcji z rozmytymi twarzami i wypalonym podpisem

Decyzja o ujawnieniu

Rozstrzygnięcie każdego nagrania — ujawnione w całości, ujawnione częściowo lub wstrzymane w całości — jest wyprowadzane z jego znaczników: brak znaczników oznacza ujawnienie w całości, znaczniki przedziałów oznaczają ujawnienie częściowe, a znacznik Wstrzymaj całe nagranie oznacza wstrzymanie w całości. Decyzja zasila stronę zawartości pakietu odpowiedzi, dziennik redakcji wniosku oraz statystyki rozstrzygnięć.

Udostępnianie nagrania

Pakiet odpowiedzi zawierający nagrania jest generowany w tle: wstępna kontrola Cię o tym informuje, Historia eksportu pokazuje jego postęp, a Ty otrzymujesz powiadomienie, gdy jest gotowy. Pakiet to plik ZIP zawierający pliki PDF, folder Media/ z wyrenderowanymi plikami MP4 lub MP3 — z wypalonymi znacznikami i podpisem rekordu — folder Files/ na pliki natywne udostępniane bez zmian oraz MANIFEST.sha256 wymieniający skrót każdej pozycji: dowód biura na to, co dokładnie zostało ujawnione. Zobacz Odpowiedź i opłaty w kwestii wstępnej kontroli pakietu i szacunku przeglądu nagrań.

Wstępna kontrola pakietu odpowiedzi dla pakietu zawierającego nagranie

Opłaty i godziny

Panel Opłaty na karcie Odpowiedź i opłaty pokazuje wiersz Szacowany przegląd nagrań — łączny czas trwania nagrań pomnożony przez mnożnik dzierżawcy, domyślnie cztery godziny recenzenta na godzinę nagrania — oraz oferuje Zasugeruj pozycję przeglądu nagrań, która otwiera okno dialogowe Dodaj pozycję wstępnie wypełnione podstawą oraz, tam gdzie cennik opłat rozlicza czas przeglądu, kwotą. Rejestr godzin zawiera kategorię Przegląd nagrań z pakietu Universal baseline.

Dla administratorów

Ustawienia → Funkcje → Nagrania multimedialne (wideo i audio) pokazuje, który procesor multimediów jest aktywny (w procesie aplikacji na App Service, zadanie Container Apps lub żaden), przełącznik Transkrybuj nagrania oraz dwa przełączniki wykrywania. Transkrypcja wymaga zasobu Azure AI Speech, wykrywanie tekstu na ekranie wymaga Azure AI Document Intelligence, a przetwarzanie na skalę produkcyjną wykorzystuje opcjonalne zadanie przetwarzania multimediów — wszystkie wdrażane we własnej subskrypcji przez szablon wdrożenia. Zobacz Funkcje oraz Przewodnik wdrożeniowy.

Powiązane strony

  • Dokumenty — obszar roboczy, który nagrania współdzielą z każdym innym rekordem, wraz z trybami etykiet i menu Pobierz.
  • Odpowiedź i opłaty — wstępna kontrola pakietu odpowiedzi i szacunek przeglądu nagrań.
  • Wygląd redakcji — domyślny efekt obszaru oraz egzekwowanie propozycji redakcji, które dotyczy wykryć.
  • Funkcje — przełączniki przetwarzania multimediów, transkrypcji i wykrywania.