شرکت کارن تکنولوژی - درحال بارگزاری...

نوآوری پرداز کارن

توسعه بر بستر وب و موبایل، خدمات هوش مصنوعی و یادگیری ماشین، توسعه بازی بر بستر موبایل، توسعه بر بستر بلاکچین

شبکه های اجتماعی

تماس آنی ما با شما

در کوتاهترین زمان مشاوره رایگان دریافت نمایید

آرشیو فنی، گزارش بازرسی و مدارک HSE - از انبار کاغذ تا آرشیو جست‌وجوپذیر

آرشیو فنی، گزارش بازرسی و مدارک HSE - از انبار کاغذ تا آرشیو جست‌وجوپذیر

همه مقاله‌های قبلی این مجموعه درباره اسنادی بودند که امروز می‌رسند. آرشیو فنی مسئله دیگری است: ده‌ها هزار برگه که سال‌هاست وجود دارند، هیچ‌کس منتظرشان نیست، و دقیقاً به همین دلیل هیچ‌وقت نوبتشان نمی‌رسد. این تفاوت، تقریباً همه تصمیم‌های پروژه را عوض می‌کند.

در این مقاله می‌خوانید

  • انباشت، نه جریان - و چرا این تفاوت مهم است
  • دامنه را آنچه جست‌وجو می‌شود تعیین می‌کند، نه آنچه وجود دارد
  • سه نوع سند در آرشیو فنی
  • گردش‌کار پردازش انبوه
  • طبقه‌بندی اطلاعات و دسترسی
  • چطور بفهمیم پروژه ارزش داشته
جست‌وجوپذیر کردن آرشیو فنی و گزارش بازرسی صنایع فرآیندی با OCR فارسی

انباشت، نه جریان

در بیمه، بانک و لجستیک، سند می‌رسد و کسی منتظرش است. تأخیر در پردازش، هزینه فوری دارد. آرشیو فنی برعکس است: کاغذ سال‌هاست آنجاست و هیچ فرآیند جاری‌ای معطلش نیست.

این یعنی سه چیز که در پروژه‌های جریانی صدق نمی‌کنند:

  • پردازش می‌تواند دسته‌ای و شبانه باشد - نیازی به پاسخ در چند ثانیه نیست
  • پروژه پایان دارد - برخلاف سرویس همیشگی، یک روز تمام می‌شود
  • ارزش از بازاستفاده می‌آید، نه از سرعت - سود وقتی محقق می‌شود که کسی چیزی را پیدا کند که قبلاً پیدا نمی‌کرد
اگر نتوانید بگویید چه کسی قرار است در این آرشیو دنبال چه چیزی بگردد، هنوز آماده شروع نیستید - و این مهم‌تر از هر بحث فنی است.

دامنه را جست‌وجو تعیین می‌کند، نه حجم

اشتباه رایج این است که پروژه با «کل آرشیو» تعریف شود. نتیجه‌اش پروژه‌ای است طولانی، پرهزینه و بدون نتیجه قابل نمایش تا ماه‌ها بعد.

رویکرد بهتر برعکس است: اول از کارشناسان بپرسید در شش ماه گذشته دنبال چه چیزی گشته‌اند و پیدا نکرده‌اند. پاسخ‌ها معمولاً روی چند دسته مشخص متمرکز می‌شوند:

  • سوابق تعمیرات یک تجهیز مشخص پیش از خرید قطعه
  • گزارش بازرسی قبلی هنگام برنامه‌ریزی توقف
  • دیتاشیت تجهیزی که سازنده‌اش دیگر پشتیبانی نمی‌کند
  • سوابق حادثه و درس‌آموخته‌های HSE

همین چند دسته معمولاً بخش کوچکی از حجم آرشیو و بخش بزرگی از ارزشش هستند.

سه نوع سند، سه رفتار متفاوت

گزارش بازرسی - نیمه‌ساختاریافته

معمولاً فرم دارد ولی بخش‌های توصیفی دست‌نویس هم دارد. اقلام کلیدی: شماره تجهیز، تاریخ، نوع بازرسی و نتیجه.

دیتاشیت و مدرک سازنده - جدولی و اغلب لاتین

ساختار جدولی دارند و بخش زیادی‌شان لاتین است. مسئله اصلی، حفظ ساختار جدول و ارتباط پارامتر با مقدار است.

مدارک HSE و صورت‌جلسات - متنی

متن آزاد با ارجاعات فراوان. اینجا هدف استخراج فیلد نیست، جست‌وجوی معنایی است - یعنی بتوان پرسید و پاسخ را با ارجاع به سند گرفت.

نمی‌دانید از کدام بخش آرشیو شروع کنید؟

در جلسه ارزیابی، آرشیو را بر اساس آنچه واقعاً جست‌وجو می‌شود دامنه‌بندی می‌کنیم - نه بر اساس حجم کاغذ.

گردش‌کار پردازش انبوه

۱. فهرست‌برداری پیش از اسکن

پیش از هر اسکنی باید معلوم باشد چه چیزی در کدام قفسه است. این مرحله کسل‌کننده است و معمولاً حذف می‌شود - و بعداً همان‌جا پروژه گیر می‌کند.

۲. اسکن با کیفیت مناسب

کیفیت اسکن سقف کیفیت نهایی است. اسکن ارزان، پروژه را از همان ابتدا محدود می‌کند و دوباره‌کاری‌اش گران‌تر از انجام درست اولیه است.

۳. طبقه‌بندی و استخراج دسته‌ای

پردازش شبانه و دسته‌ای انجام می‌شود. برای هر نوع سند، اقلام متفاوتی استخراج می‌شود.

۴. نمایه‌سازی برای جست‌وجو

علاوه بر فیلدها، متن کامل برای جست‌وجوی معنایی نمایه می‌شود تا پرسش‌های آزاد هم پاسخ بگیرند.

۵. نمونه‌گیری کنترل کیفیت

بازبینی صد درصدی در حجم آرشیو ممکن نیست. نمونه‌گیری آماری از هر دسته انجام می‌شود و نرخ خطای هر دسته جداگانه گزارش می‌شود - چون کیفیت دیتاشیت چاپی با گزارش دست‌نویس یکی نیست.

طبقه‌بندی اطلاعات

بخشی از آرشیو فنی در صنایع فرآیندی طبقه‌بندی‌شده است. دو پیامد عملی:

  • پردازش داخل شبکه - هیچ سندی برای پردازش بیرون نمی‌رود
  • دسترسی نقش‌محور از روز اول - نه به‌عنوان قابلیتی که بعداً اضافه شود

و نکته‌ای که معمولاً دیر مطرح می‌شود: خودِ نتیجه جست‌وجو هم باید کنترل دسترسی داشته باشد. اگر کاربری اجازه دیدن یک سند را ندارد، آن سند نباید حتی در فهرست نتایج او ظاهر شود.

چطور بفهمیم ارزش داشته

در پروژه‌های جریانی، معیار روشن است: زمان پردازش. در آرشیو، معیار متفاوت است و باید از قبل تعریف شود:

  • میانگین زمان پیدا کردن یک سابقه - پیش و پس
  • تعداد جست‌وجوهایی که به نتیجه رسیده‌اند
  • مواردی که به‌خاطر نبود سابقه دوباره‌کاری شده‌اند

بدون این‌ها، پروژه آرشیو به‌راحتی به «کاغذ اسکن شد» تقلیل پیدا می‌کند - که خودش هیچ ارزشی نیست.

تصویر کامل کاربردها در این صنعت در صفحه راهکارهای نفت، گاز و انرژی است و جزئیات فنی در صفحه هوش اسناد.

پرسش‌های متداول

توصیه ما این نیست. دامنه را باید آنچه واقعاً جست‌وجو می‌شود تعیین کند، نه حجم کاغذ. از کارشناسان بپرسید در شش ماه گذشته دنبال چه چیزی گشته‌اند و پیدا نکرده‌اند؛ پاسخ‌ها معمولاً روی چند دسته متمرکز می‌شوند که بخش کوچکی از حجم و بخش بزرگی از ارزش‌اند.

تا حدی. اسناد محو، فکس‌شده، کاربنی یا مهرخورده نرخ خطای بالاتری دارند و این را از ابتدا می‌گوییم. به همین دلیل نرخ خطا به تفکیک دسته گزارش می‌شود، نه به‌صورت یک عدد کلی که تصویر واقعی را پنهان می‌کند.

چون پردازش دسته‌ای و شبانه است، مسئله زمان پاسخ نیست بلکه ظرفیت پردازش و حجم دامنه است. برآورد واقعی پس از فهرست‌برداری و آزمایش روی نمونه هر دسته داده می‌شود.

داخل شبکه پردازش می‌شوند و بیرون نمی‌روند. دسترسی نقش‌محور از روز اول اعمال می‌شود و - نکته‌ای که معمولاً فراموش می‌شود - نتیجه جست‌وجو هم کنترل دسترسی دارد: سندی که کاربر اجازه دیدنش را ندارد، حتی در فهرست نتایج او ظاهر نمی‌شود.

سقف کیفیت نهایی است. هیچ مدلی نمی‌تواند اطلاعاتی را که در اسکن ثبت نشده بازسازی کند. اسکن ارزان معمولاً به دوباره‌کاری گران‌تری ختم می‌شود.

با نمونه‌گیری آماری از هر دسته سند، و گزارش نرخ خطا به تفکیک همان دسته‌ها. بازبینی صددرصدی در حجم آرشیو نه ممکن است و نه لازم.

سوابق تعمیرات ورودی مفیدی برای آن هستند، اما پیش‌بینی خرابی به داده سنسوری پیوسته نیاز دارد و پروژه جداگانه‌ای در حوزه خدمات صنعت ۴.۰ است. آرشیو به‌تنهایی برای آن کافی نیست و ما هم چنین وعده‌ای نمی‌دهیم.

سایر قابلیت‌های پلتفرم مانوتل

صندوق چندکاناله

وب‌سایت، ایمیل، تلگرام، بله، ایتا، واتساپ و اینستاگرام در یک فهرست واحد؛ یک مشتری، یک پرونده.

معرفی کامل پلتفرم >

سیستم تیکتینگ با SLA

برای درخواست‌هایی که در یک نشست تمام نمی‌شوند: شناسه، مالک، وضعیت و مهلت - با محاسبه بر حسب ساعت کاری.

اطلاعات بیشتر >

چت آنلاین سایت

ابزارک زیر ۱۵ کیلوبایت با دستیار هوشمند ۲۴ ساعته، بدون اثر محسوس بر سرعت سایت.

اطلاعات بیشتر >

نصب روی سرور خودتان

نسخه On-Premise با هوش مصنوعی کامل و مدل زبانی محلی؛ داده از شبکه سازمان خارج نمی‌شود.

اطلاعات بیشتر >

جلسه شناخت رایگان، بدون تعهد

یک جلسه ۳۰ دقیقه‌ای رزرو کنید. اسناد خودتان را به دستیار می‌دهیم و همان جلسه نتیجه را می‌بینید.

شرکت سهامی
خاص
2016
تأسیس
+۵۰
متخصص هوش مصنوعی
+۱۲
محصول AI-Ready
+20
صنعت تخصصی
+10
سال تجربه
۰۲
مرکز توسعه
ISO 9001 & 27001
گواهینامه
AI-Native
معماری
Infosys
شریک تجاری
HCL Technologies
شریک تجاری
TCS
شریک تجاری