Blog JSystems - uwalniamy wiedzę!

Szukaj

Microsoft 365 CopilotMicrosoft 365 Copilot

Copilot nie czyta zeskanowanego dokumentu (obraz) - dlaczego

W skrócie

  • Copilot nie czyta zeskanowanej umowy ani zdjęcia dokumentu i zachowuje się, jakby strona była pusta.
  • Skan albo zdjęcie to dla komputera obraz bez warstwy tekstowej, więc Copilot nie ma czego streścić.
  • Przepuść plik przez OCR, sprawdź czy tekst da się zaznaczyć, wrzuć go do chmury i włącz Work IQ.

Wgrywasz do Copilota zeskanowana umowe albo sfotografowany dokument i prosisz o streszczenie, a narzedzie zachowuje sie, jakby strona byla pusta. Ten problem dotyka wszystkich, ktorzy dostaja dokumenty w formie skanow: podpisane umowy, faktury, pisma. Copilot nie odmawia z zlosliwosci - po prostu w takim pliku nie ma tekstu, ktory moglby przeczytac.

Jak to wyglada w praktyce

Ksiegowa przysyla podpisana umowe jako PDF zlozony ze zdjec kolejnych stron. Wskazujesz plik ukosnikiem, piszesz "wypisz z tej umowy terminy platnosci", a Copilot odpowiada ogolnie albo informuje, ze nie znalazl takich informacji. To samo dzieje sie ze zdjeciem dokumentu zrobionym telefonem i zapisanym jako obraz. Widzisz na ekranie wyrazny tekst, mozesz go przeczytac wlasnymi oczami, ale Copilot traktuje strone jak obrazek, a nie jak dokument z trescia. Streszczenie albo nie powstaje, albo jest zupelnie oderwane od zawartosci.

Dlaczego Copilot tak robi

Skan albo zdjecie strony to dla komputera obraz, a nie tekst. Wygladają jak dokument, ale w srodku nie ma warstwy tekstowej, czyli tekstu, ktory da sie odczytac maszynowo. Copilot streszcza i analizuje tresc, wiec gdy tej tresci w pliku nie ma, nie ma czego przeczytac. To ograniczenie dotyczy przede wszystkim plikow PDF zapisanych jako skan graficzny, ale tak samo obrazow z tekstem. Rozwiazaniem jest rozpoznawanie tekstu, czyli OCR - proces, ktory zamienia obraz strony na prawdziwy, odczytywalny tekst. Dopiero po tej zamianie Copilot ma z czym pracowac.

Jak to rozwiazac krok po kroku

  1. Potwierdz, ze to skan. Otworz plik i sprobuj zaznaczyc fragment tekstu myszka. Jesli nie da sie zaznaczyc pojedynczych slow, tylko caly obszar jak obrazek, to dokument nie ma warstwy tekstowej.
  2. Przepusc plik przez rozpoznawanie tekstu (OCR). Wiele programow do obslugi PDF ma taka funkcje, ktora tworzy w dokumencie warstwe tekstowa nad obrazem.
  3. Zapisz wynik jako nowy plik z warstwa tekstowa. Sprawdz od razu, czy teraz tekst da sie zaznaczyc.
  4. Wgraj przetworzony plik do OneDrive dla firm albo do biblioteki SharePoint, bo Copilot czyta z chmury, a nie z dysku.
  5. W Copilot Chat wlacz Work IQ, wpisz ukosnik (/), kliknij zakladke Pliki i wskaz nowy dokument.
  6. Zadaj konkretne pytanie, na przyklad: "Wypisz z tego dokumentu wszystkie terminy platnosci i zacytuj fragmenty, z ktorych to wynika."

Jak sprawdzic, ze zadzialalo

Pierwszy test robisz jeszcze przed Copilotem: jesli po OCR potrafisz zaznaczyc i skopiowac tekst z dokumentu, warstwa tekstowa powstala poprawnie. W samym Copilocie sukces poznasz po tym, ze odpowiedz jest konkretna i niesie cytowania prowadzace do wlasciwych fragmentow. Kliknij kilka z nich, zeby upewnic sie, ze narzedzie faktycznie czyta tresc, a nie zgaduje. Jesli mimo OCR odpowiedz nadal jest pusta albo ogolna, sprawdz, czy rozpoznawanie tekstu objelo wszystkie strony, oraz czy plik na pewno lezy w chmurze i czy Work IQ jest wlaczone. Przy dokumentach o wysokiej stawce, jak umowy, i tak otwieraj cytowany fragment i porownuj go z oryginalem, bo OCR bywa niedoskonaly przy slabej jakosci skanu.

Wroc do listy: 200 najczestszych problemow z Microsoft 365 Copilot

Komentarze (0)

Musisz być zalogowany by móc dodać komentarz. Zaloguj się przez Google

Brak komentarzy...