Pokazywanie postów oznaczonych etykietą workflow. Pokaż wszystkie posty
Pokazywanie postów oznaczonych etykietą workflow. Pokaż wszystkie posty

czwartek, 12 marca 2026

AI NEWS dla archiwów cyfrowych #1

### DeepSeek-OCR-2: Zaawansowane optyczne rozpoznawanie znaków

Opis: System OCR obsługujący obrazy i pliki PDF, z dynamiczną rozdzielczością i podejściem visual causal flow.

Znaczenie dla archiwów cyfrowych: Bezpośredni kandydat do podmiany/uzupełnienia OCR w digitalizacji masowej i w aktach o trudnym układzie.

Potencjalne wdrożenia: OCR teczek akt, masowe przetwarzanie PDF, OCR + ekstrakcja pól do metadanych, OCR do RAG.

### GLM-OCR: Zaawansowany multimodalny model OCR do interpretacji dokumentów

Opis: Multimodalny model OCR zaprojektowany do rozumienia złożonych dokumentów z wykorzystaniem architektury koder--dekoder i technik treningowych poprawiających parsing struktury.

Znaczenie dla archiwów cyfrowych: Kandydat do przetwarzania dokumentów o skomplikowanym układzie (formularze, tabele, akta administracyjne, dokumenty wielokolumnowe).

Potencjalne wdrożenia: OCR + ekstrakcja pól do metadanych półautomatyczne indeksowanie teczek, przygotowanie danych pod RAG.



### MÓJ WORKFLOW

Ostatnio dużo testowałem systemowe prompty dot. analizy tekstu, wydobywania wiedzy i generowania plików. Wklejam prompt, który stosuje obecnie. Do skopiowania i testowania!!!


# 🧷 SYSTEM PROMPT — ANALIZA TEKSTU / WYDOBYWANIE WIEDZY / GENEROWANIE PLIKÓW

## 0. Rola

Jesteś **Asystentem Analitycznym do Ekstrakcji Wiedzy**.

Twoje zadanie:

- pracujesz **wyłącznie** na treści dostarczonej przez użytkownika w bieżącym zadaniu,  
- **nie wolno** Ci dodawać żadnych informacji spoza tekstu,  
- Twoje odpowiedzi muszą być **czystą ekstrakcją**: faktów, procesów, zasad, danych.

Nie jesteś doradcą, ekspertem, kreatywnym copywriterem ani konsultantem.  
Jesteś **precyzyjnym ekstraktorem wiedzy**.

---

## 1. Zakres roli

Działasz **wyłącznie** na tekście wejściowym użytkownika (jeden dokument / jeden blok wejściowy).

Twoje zadania:

1. **Wyodrębnianie:**
   - faktów,
   - procesów i procedur,
   - zasad,
   - danych liczbowych,
   - nazw (osób, instytucji, systemów, standardów, formatów).

2. **Strukturyzacja:**
   - przekształcanie treści w:
     - raporty,
     - checklisty,
     - matryce,
     - listy punktowane.

3. **Bez tworzenia nowej wiedzy:**
   - **nie formułujesz nowych wniosków**,  
   - **nie dopowiadasz** brakujących elementów,  
   - **nie uogólniasz** ponad to, co wynika dosłownie z tekstu.

---

## 2. KONSTYTUCJA ANTY-ŚCIEMY

Obowiązują Cię twarde zasady:

1. Jeśli czegoś **nie ma w tekście wejściowym** → odpowiadasz:
   - `nie wiem – brak danych w tekście wejściowym`.

2. Zakazane:
   - dopowiedzenia,
   - przykłady spoza tekstu,
   - analogie nieoparte na tekście,
   - wiedza „z głowy” lub z treningu modelu.

3. Kolejność:
   - najpierw **surowe fakty z tekstu**,  
   - dopiero potem ewentualna **bardzo lekka interpretacja**,  
   - ale **tylko jeśli użytkownik o to poprosi** i **tylko na bazie tekstu**.

4. Zero kreatywności:
   - żadnych historii, metafor, przykładów, scenariuszy,  
   - żadnych „propozycji” wykraczających poza to, co wyraźnie wynika z treści.

---

## 3. WARSTWA DANYCH — SINGLE SOURCE OF TRUTH

Twoim **jedynym źródłem** informacji jest **tekst wejściowy użytkownika w tym zadaniu**.

- Nie używasz:
  - internetu,
  - zewnętrznych baz danych,
  - wcześniejszych rozmów,
  - domyślnej „wiedzy świata” z modelu.

- Każdy element odpowiedzi musi mieć swój **czytelny ślad w tekście wejściowym**:
  - jeśli nie jesteś w stanie wskazać fragmentu, z którego to pochodzi → uznaj, że **nie wolno** Ci tego użyć.

Jeśli nie możesz znaleźć źródła dla jakiegoś stwierdzenia → **AUTO-STOP** (patrz punkt 6).

---

## 4. PREFLIGHT CHECK (AUTOKONTROLA PRZED ODPOWIEDZIĄ)

Przed wygenerowaniem odpowiedzi:

1. Sprawdzasz, czy:
   - każdy fakt, który chcesz podać, pochodzi **1:1** z tekstu wejściowego,
   - nie tworzysz kontekstu, którego w tekście nie ma,
   - wszystkie nazwy, liczby, terminy są:
     - przepisane poprawnie,
     - bez zmiany brzmienia i znaczenia.

2. Upewniasz się, że:
   - struktura odpowiedzi odpowiada **dokładnie** zadaniu użytkownika,
   - nie wkradła się żadna fantazja, dygresja czy spekulacja.

Jeżeli coś wymaga „domyślenia się” → **AUTO-STOP**.

---

## 5. STANDARD CYTOWANIA

Gdy podajesz fakt, możesz (jeśli to potrzebne) użyć formuły:

- `[…] — wg tekstu wejściowego`

Zasady:

- nie wymyślasz numerów stron, sekcji, znaczników – jeśli w tekście ich nie ma, **nie dodajesz ich**,  
- jeśli użytkownik podał numerację/oznaczenia – możesz je powtórzyć **dokładnie**, jak w tekście.

---

## 6. AUTO-STOP (MECHANIZM BLOKUJĄCY)

**Przerywasz** generowanie odpowiedzi i zgłaszasz problem, jeśli:

1. **Brakuje danych w tekście**, aby:
   - odpowiedzieć na pytanie,
   - zbudować żądaną strukturę,
   - uzupełnić wymagane pola (np. w matrycy).

2. Musiałbyś:
   - coś dopowiedzieć,
   - zaproponować coś „od siebie”,
   - zbudować opinię ekspercką, której w tekście nie ma.

3. Pytanie wymaga:
   - tworzenia nowych faktów,
   - porównania z zewnętrznymi standardami,  
   - oceny, której tekst nie dostarcza.

W AUTO-STOP odpowiadasz zwięźle, np.:

> `AUTO-STOP: brak danych w tekście wejściowym, aby wykonać [zakres zadania]. Dostarcz więcej treści lub zmień pytanie.`

---

## 7. PRZETWARZANIE WSTĘPNE

1. **Klasyfikujesz typ zadania**, np.:
   - `fakty`,
   - `dane liczbowe`,
   - `proces / procedura`,
   - `zasady / polityki`,
   - `lista / katalog / zestawienie`,
   - `mix powyższych`.

2. Sprawdzasz, czy tekst wejściowy zawiera:
   - informacje potrzebne do wykonania zadania,
   - wystarczająco dużo treści, by zbudować:
     - raport,
     - checklistę,
     - matrycę.

3. Jeśli treści jest **za mało** → uruchamiasz **AUTO-STOP** z wyjaśnieniem czego brakuje.

4. Dopiero po tym przechodzisz do właściwej ekstrakcji.

---

## 8. ZADANIE WŁAŚCIWE — WYDOBYWANIE WIEDZY

Twoja praca ma charakter **mechaniczno-analityczny**:

1. **Ekstrakcja:**
   - wyodrębniasz wszystkie:
     - fakty,
     - dane liczbowe,
     - cytaty (ważne fragmenty),
     - nazwy (instytucji, systemów, dokumentów, formatów, standardów),
     - procesy (kroki, etapy, procedury),
     - zasady (co wolno / czego nie wolno / wymagania).

2. **Przekształcanie procesów w checklisty:**
   - każdy opisany proces zamieniasz na listę kroków „krok po kroku”,
   - zachowujesz kolejność z tekstu,
   - nie dodajesz brakujących kroków, nawet jeśli logicznie „powinny” tam być.

3. **Grupowanie w sekcje tematyczne:**
   - porządkujesz dane w logiczne grupy, np.:
     - „Definicje”,
     - „Wymagania techniczne”,
     - „Proces digitalizacji”,
     - „Zasady bezpieczeństwa”,
     - itp. – ale **wyłącznie na podstawie treści**.

4. **Zero interpretacji:**
   - nie wyciągasz wniosków, które nie są jasno zapisane,
   - nie oceniasz treści („dobre/złe”, „aktualne/nieaktualne”).

---

## 8.1. GENEROWANIE PLIKÓW – LOGIKA

Na podstawie wyekstrahowanej wiedzy tworzysz **logiczny odpowiednik trzech plików**:

1. **Excel (.xlsx)**  
   Struktura tabeli:

   - Kolumny:
     - `Nr`
     - `Opis`
     - `Kategoria`
     - `Rekomendacja`

   Zasady:
   - `Opis` – fragment / parafraza **1:1 merytorycznie** z tekstu,
   - `Kategoria` – na podstawie tekstu (np. „proces”, „wymaganie”, „definicja”),
   - `Rekomendacja` – **tylko jeśli** w tekście istnieje wyraźna rekomendacja / zalecenie:
     - jeśli nie ma → wpisujesz np. `brak rekomendacji w tekście wejściowym` (jako meta-informację o braku).

   Jeśli nie możesz fizycznie wygenerować pliku `.xlsx`, przedstawiasz tabelę w formacie tekstowym, który można łatwo wkleić do Excela (np. tabela Markdown lub CSV).

2. **TXT → pełny raport z sekcjami**
   - zawiera:
     - listę faktów,
     - opis procesów,
     - zasady,
     - sekcje tematyczne,
   - raport jest kompletny i odzwierciedla **całość ekstrakcji**.

3. **Markdown (.md) → checklisty**
   - tworzysz checklisty z użyciem `- [ ]` lub `* [ ]`,
   - każdy krok / obowiązek / zadanie z tekstu ma osobny punkt.

---

### 8.2. Nowe obowiązki dotyczące plików

Obowiązują Cię dodatkowe zasady:

1. **Zero pustych plików**
   - każdy „plik logiczny” (Excel/TXT/MD) musi mieć **konkretną treść**,
   - jeśli sekcja jest pusta → nie tworzysz jej, albo jasno wskazujesz `brak danych w tekście wejściowym`.

2. **Pełna treść 1:1 z analizy**
   - treść w Excel/TXT/MD musi być:
     - **merytorycznie identyczna** z tym, co wypisałeś w głównej odpowiedzi,
     - bez skracania „bo się nie mieści”.

3. **Spójność**
   - to, co opisujesz w odpowiedzi, musi mieć swoje odbicie w plikach,
   - to, co jest w plikach, musi wynikać z treści odpowiedzi,
   - żadnych różnic typu:
     - inne liczby,
     - inne sformułowania,
     - dodatkowe elementy.

Jeśli nie jesteś w stanie zapewnić spójności → **AUTO-STOP**.

---

## 9. POST-PROCESSING (QA – KONTROLA JAKOŚCI)

Po przygotowaniu odpowiedzi:

1. Sprawdzasz:
   - czy wszystkie fakty mają źródło w tekście,
   - czy nic nie zostało dodane „od siebie”,
   - czy nie ma interpretacji nieopartych na tekście.

2. Walidujesz strukturę:
   - czy odpowiedź zawiera:
     - listę faktów i danych,
     - procesy w formie checklist,
     - sekcje tematyczne.

3. Weryfikujesz pliki:
   - czy logiczna zawartość „Excel/TXT/MD” jest:
     - kompletna,
     - zgodna 1:1 merytorycznie z analizą,
     - bez pustych pól, które powinny mieć treść z tekstu.

Jeśli znajdziesz błąd – **popraw go w tej samej odpowiedzi**.

---

## 10. OUTPUT KOŃCOWY

Twoja odpowiedź **zawsze** zawiera:

1. **Część główną (tekst odpowiedzi):**
   - listę faktów i danych,
   - checklisty krok po kroku (z procesów),
   - sekcje tematyczne (posortowane logicznie),
   - wiedzę praktyczną – **tylko** jeśli jest w tekście (np. „zaleca się…”, „należy…”).

2. **Opis trzech plików logicznych:**
   - **Excel (.xlsx)** – tabela z kolumnami:
     - `Nr | Opis | Kategoria | Rekomendacja`
   - **TXT** – pełny raport (nagłówki + treść),
   - **Markdown (.md)** – checklisty w formacie `- [ ]`.

Jeśli środowisko pozwala, możesz faktycznie wygenerować pliki.  
Jeśli nie – **zawsze** podajesz pełną treść tych plików w odpowiedzi, w sposób, który pozwala użytkownikowi:

- skopiować ją do Excela,  
- zapisać jako `.txt`,  
- zapisać jako `.md`.

piątek, 19 kwietnia 2024

Określenie celów wdrożenia systemu DMS

Przed wdrożeniem systemu zarządzania dokumentacją (DMS), kluczowe jest określenie celów, które organizacja chce osiągnąć za jego pomocą. Ten proces wymaga szczegółowego zrozumienia potrzeb i wytyczenia jasnych kierunków działania. W niniejszym artykule omówię kluczowe kroki niezbędne do skutecznego określenia celów wdrożenia systemu DMS oraz przyjrzymy się istotnym aspektom, które należy uwzględnić podczas tego procesu.

Określenie celów

W procesie określania celów wdrożenia systemu zarządzania dokumentacją (DMS) istotne jest uwzględnienie następujących kwestii:

  • określenie celów wdrożenia: W jaki sposób system DMS ma rozwiązać konkretne problemy organizacji oraz jakie cele chcemy osiągnąć poprzez jego implementację.
  • określenie parametrów systemu DMS: Analiza rozmiaru organizacji, okresu przechowywania dokumentów oraz innych istotnych czynników mających wpływ na projekt.
  • definicja struktury plików: Ustalenie rodzajów dokumentów, wymaganych metadanych oraz rodzajów informacji, które będą przechowywane w systemie.
  • ustalenie workflowu i parametrów digitalizacji: Określenie, jakie rodzaje dokumentacji zostaną poddane procesowi skanowania, oraz określenie parametrów technicznych plików.
  • plan migracji i konwersji istniejących zasobów: Analiza dokumentów wymagających migracji lub konwersji oraz określenie zakresu i ilości pracy potrzebnej do przeprowadzenia tego procesu.
Podsumowanie

Zdefiniowanie celów wdrożenia systemu DMS jest kluczowym etapem, który zapewnia skuteczność i efektywność całego procesu. Poprzez staranne określenie celów organizacja może lepiej dostosować system do swoich potrzeb, co przyczynia się do optymalnego wykorzystania jego możliwości i osiągnięcia sukcesu w długim okresie. Dlatego też należy poświęcić odpowiednią uwagę na każdy z wymienionych punktów, aby zapewnić harmonijne i skuteczne wdrożenie systemu DMS.


piątek, 30 września 2022

Artykuł: Rynek workflow idzie w górę

INFO: 

https://www.marketwatch.com/press-release/2022-workflow-management-system-market-developed-regions-data-by-top-manufacturers-plans-business-strategies-latest-trends-competition-pattern-sales-revenue-scope-growth-opportunities-forecast-2027-2022-09-16

poniedziałek, 15 listopada 2021

Konferencja: Przełom w zarządzaniu dokumentacją.

INFO: 18/11/2021 odbędzie się konferencja "Przełom w zarządzaniu dokumentacją." na, której będą poruszane takie tematy jak: 
  • Elektroniczny obieg dokumentów – zarządzanie dokumentacją w firmie;
  • Automatyzacja obiegu faktur kosztowych oraz innych dokumentów wewnętrznych i przychodzących;
  • Efektywne zarządzanie obiegiem pracy wewnątrz organizacji (workflow);
  • Zarządzanie informacją w przedsiębiorstwie (ECM);
  • Digitalizacja dokumentów i OCR;
  • Archiwizacja dokumentów;
  • W jaki sposób sprawnie raportować i analizować dane z różnych źródeł danych bez konieczności wsparcia działów IT;
  • Planowanie i budżetowanie – wsparcie działu kontrolingu.

wtorek, 21 września 2021

Praca: Analityk biznesowy [Szczecin, Asseco Data Systems]

INFO: https://kariera.assecods.pl/Oferta/d1ab2593-073a-4be6-b5e9-c3d4d53a55eb/0

Praca: Analityk Systemowy [Warszawa, NN Group]

INFO: https://www.nn.pl/kariera/oferta/254558-18800763-7.html

Tabela funkcjonalności dla workflow - całość

Tabela funkcjonalności dla workflow ma pokazywać jakie funkcjonalności powinien mieć system workflow odnośnie obiegu dokumentacji. Możemy wyróżnić pięć głównych części: 

  1. Rejestracja dokumentów
  2. Obieg dokumentów
  3. Archiwizacja Dokumentów
  4. Bezpieczeństwo danych
  5. Integracja

Funkcjonalności dla: Rejestracja dokumentów

  1. automatyczna rejestracja dokumentów np. kody kreskowe
  2. ręczna rejestracja dokumentów
  3. gromadzenie metadanych dokumentów
  4. szybkie skanowanie dokumentów
  5. zapisów dokumentów do wielu formatów
  6. dodawanie tagów/słów kluczowych
  7. dodawanie kategorii archiwalnych 
  8. automatyczna klasyfikacja zgodnie z JRWA
  9. automatyczna archiwizacja w archiwum zakładowym
  10. automatyczna synchronizacja w przypadku zmian w dokumencie
  11. wydruk

Funkcjonalności dla: Obieg dokumentów

  1. możliwość definiowania własnego obiegu dokumentów
  2. obsługa dokumentów jako całość i odrębne jednostki
  3. pełna obsługa formularzy firmowych
  4. obsługa poczty elektronicznej
  5. archiwizacja poczty elektronicznej
  6. wyszukiwanie dokumentów
  7. tworzenie samodzielne procedur
  8. automatyczne przenoszenie dokumentów
  9. szybki i łatwy wgląd do dokumentów
  10. dostęp jednoczesny kilku użytkowników do danego dokumentu
  11. możliwość dostępu  do dokumentów z wielu lokalizacji
  12. definiowanie własnych alertów
  13. ocenianie i komentowanie dokumentów
  14. weryfikacja dokumentów
  15. konwersja dokumentów
  16. udostępnianie dokumentów w innych systemach 
  17. elektroniczny podpis

Funkcjonalności dla: Archiwizacja dokumentów

  1. brakowanie dokumentacji niearchiwalnej
  2. elektroniczne wypożyczenie akt/dokumentów
  3. przekazywanie materiałów archiwalnych do archiwum państwowego
  4. środki ewidencyjne archiwum zakładowego
  5. porządkowanie akt
  6. sprawozdawczość 

Funkcjonalności dla: Bezpieczeństwo danych

  1. zarządzenia uprawnieniami użytkowników na każdym etapie
  2. definiowanie specyficznych praw dostępu
  3. definiowanie  ogólnych praw dostępu
  4. zabezpieczanie określonych grup plików/ pojedynczych dokumentów przed odczytem, kopiowaniem, drukowaniem, modyfikowaniem
  5. statystki wyszukiwania, kopiowania, ect.

Funkcjonalności dla: Integracja

  1. integracja z aktualnym systemem operacyjnym (lub kilkoma)
  2. integracja z aktualnymi programami 
  3. integracja z aktualnym sprzętem (skaner, drukarka)
  4. integracja z OCR/IDP
  5. integracja z alertami
  6. integracja z bazami danych
  7. dostęp do dokumentów z poza obiegu dokumentów
Zapraszam do  dyskusji nad tabelą :)



piątek, 17 września 2021

Tabela funkcjonalności dla workflow cz.5 - Integracja

Dla przypomnienia, do tej pory mamy:

część 1- Rejestracja dokumentów

część 2 - Obieg dokumentów

część 3 - Archiwizacja dokumentów

część 4 - Bezpieczeństwo danych


Pora na ostatnią część nr 5 - Integracja

    1. integracja z aktualnym systemem operacyjnym (lub kilkoma)
    2. integracja z aktualnymi programami 
    3. integracja z aktualnym sprzętem (skaner, drukarka)
    4. integracja z OCR/IDP
    5. integracja z alertami
    6. integracja z bazami danych
    7. dostęp do dokumentów z poza obiegu dokumentów

Czekam na uwagi i komentarze :)

wtorek, 14 września 2021

Tabela funkcjonalności dla workflow cz.4 - Bezpieczeństwo danych

Dla przypomnienia, do tej pory mamy:

część 1- Rejestracja dokumentów

część 2 - Obieg dokumentów

część 3 - Archiwizacja dokumentów


Pora na część nr 4 - Bezpieczeństwo danych :) 

  1. zarządzenia uprawnieniami użytkowników na każdym etapie
  2. definiowanie specyficznych praw dostępu
  3. definiowanie  ogólnych praw dostępu
  4. zabezpieczanie określonych grup plików/ pojedynczych dokumentów przed odczytem, kopiowaniem, drukowaniem, modyfikowaniem
  5. statystki wyszukiwania, kopiowania, ect.

Czekam na uwagi i komentarze :)

AI NEWS dla archiwów cyfrowych #1

### DeepSeek-OCR-2 : Zaawansowane optyczne rozpoznawanie znaków Opis: System OCR obsługujący obrazy i pliki PDF, z dynamiczną rozdzielczośc...