임베딩 모델은 키워드 일치를 넘어 문서의 컨텍스트와 의도를 이해하여 Synology Drive에서 AI 기반 검색을 가능하게 합니다.
OCR(광학 문자 인식) 모델은 이미지, 스캔한 문서 및 비디오 프레임에서 텍스트를 추출하여 Synology Drive에서 해당 콘텐츠를 검색할 수 있도록 합니다.
OCR 언어 선택에는 중국어 간체, 중국어 번체, 체코어, 덴마크어, 영어, 프랑스어, 독일어, 헝가리어, 이탈리아어, 일본어, 한국어, 네덜란드어, 노르웨이어, 폴란드어, 포르투갈어(브라질), 포르투갈어(포르투갈), 러시아어, 스페인어, 스웨덴어, 태국어 및 터키어가 포함됩니다.
더 많은 OCR 언어를 선택하면 메모리 사용량이 증가합니다.
STT(음성 텍스트 변환) 모델은 오디오 및 비디오 파일의 음성을 검색 가능한 텍스트로 변환합니다.
이미지 캡셔닝 모델은 이미지 또는 비디오 프레임에 대한 설명을 생성하여 사용자가 시각적 설명으로 검색할 수 있도록 합니다.
요구 사항
시스템과 기타 서비스도 메모리를 소비하므로 Synology는 최소 16 GB의 시스템 메모리를 예약할 것을 권장합니다.
예상 메모리 사용량:
임베딩 모델: 2 GB
OCR 모델: 2 GB
STT 모델: 3 GB
이미지 캡셔닝 모델: 3 GB
AI 통합 관리
지원되는 AI 공급자에는 Amazon Bedrock, Azure OpenAI, Baidu AI Cloud, Google AI Studio, Google Vertex AI, OpenAI 및 OpenAI 호환 API를 사용하는 기타 공급자가 포함됩니다.
관리자는 각 통합에 대한 기본 URL과 속도 제한을 설정할 수 있습니다.
비식별화
비식별화 옵션은 데이터 프라이버시를 보호하는 데 도움이 됩니다.
이름 항목 비식별화는 중국어, 덴마크어, 네덜란드어, 영어, 프랑스어, 독일어, 이탈리아어, 일본어, 한국어, 노르웨이어, 폴란드어, 포르투갈어, 러시아어, 스페인어, 스웨덴어에 대해 언어 모델을 사용합니다.
프롬프트에 감지된 언어가 여러 개 포함된 경우 AI는 주된 언어를 선택하고 해당 비식별화 모델을 사용합니다.
각 비식별화 언어 팩은 약 1GB의 메모리를 사용합니다.
지원되는 사전 정의된 정보 유형:
전역 사전 정의 정보 유형: 신용카드 번호, 암호화폐 지갑 주소, 날짜, 이메일 주소, 국제 은행 계좌 번호(IBAN), IP 주소, URL, 계정 tokens 등.
지역별 정보 유형: 여권 번호, 납세자 식별 번호, 운전면허 번호, Medicare 번호 등.
지원되는 지역에는 호주, 오스트리아, 벨기에, 불가리아, 칠레, 중국, 키프로스, 체코 공화국, 덴마크, 에스토니아, 핀란드, 프랑스, 독일, 그리스, 헝가리, 인도, 아일랜드, 이탈리아, 라트비아, 리투아니아, 룩셈부르크, 몰타, 네덜란드, 노르웨이, 폴란드, 포르투갈, 루마니아, 싱가포르, 슬로바키아, 슬로베니아, 스페인, 스웨덴, 대만, 영국, 미국이 포함됩니다.
요구 사항
이름 항목 비식별화를 사용하려면 Synology 저장소 시스템에 Container Manager가 필요합니다.
이름 항목 비식별화는 8GB 이상의 메모리가 있는 장치에서만 지원됩니다.
시스템은 이름 항목 비식별화를 활성화하기 전에 사용 가능한 장치 메모리를 확인합니다.
사전 정의된 비식별화 유형에는 패키지 종속성이나 메모리 요구 사항이 없습니다.
제한 사항
정보 유형은 Synology AI Console 버전에 따라 달라질 수 있습니다.
비식별화는 AI 모델 또는 정규식에 의존하므로 민감한 데이터의 완전한 마스킹을 보장할 수 없습니다.
더 많은 단어를 비식별화할수록 AI 생성 정보의 정확도가 떨어집니다.
감사 및 로그 관리
거래 로그에는 전송 시간, IP 주소, 사용자, 적용된 패키지, 적용된 AI 통합, AI 제공업체, 사용된 모델, 작업, 입력 tokens, 출력 tokens, 사용된 총 tokens, 상태를 포함한 AI 요청 세부 정보가 기록됩니다.
관리자 로그에는 시간, 사용자, IP 주소, 유형, 이벤트를 포함한 administrator 구성 변경 사항이 기록됩니다.
로그 보존 정책은 administrators가 로그 저장소를 관리하는 데 도움이 됩니다.
administrators는 추가적인 데이터 제어를 위해 AI 요청의 상세 입력 및 출력을 기록할지 여부를 선택할 수 있습니다.