문제마다 달라질 것이기 때문에 정확한 비율로 얘기하기는 어렵겠지만 데이터파이프라인의 경우가 일반적으로 훨씬 많은 리소스가 소요됩니다. 데이터 파이프라인에서 관리해야 하는 데이터의 양이 더 많기도 하고 데이터의 소스가 추가되거나 운영중 프로그램 변경으로 인해 유입되는 데이터가 약속된 형태에서 바뀌는 등 많은 이슈들이 발생하게 되고 이를 모두 관리하는 데에 많은 툴과 시간을 투자하시게 됩니다.
답변 감사합니다. 현재 소속된 조직에서도 단기적 성과물에 집착해서 앞단인 Data Pipeline에 대해서는 등한시하는 상황입니다. 그래서 실제 실무자들은 앞단에 발목이 잡히거나 일을 위한 일을 양산하고 있지요...
시각화 Tool을 활용할 때 가장 어려운 점 중의 하나는 Data Source로부터 대량의 분석 대상자료를 선별해서 가져올 때 소요시간 등과 관련된 문제입니다. Oracle Visualization Tool은 이 부분을 어떻게 지원하고 있는지요
가능합니다. 데이터를 선별해서 가져오는 과정은 시각화 도구에서 'Data Flow'를 활용하거나 Data Set을 생성할 때 '필터'를 적용할 수 있습니다. 또한 직접 SQL로 해당데이터를 선별하여 가져올 수 있습니다.
데이터 시각화 솔루션(클라우드, 데스트탑 버젼)의 사용 비용은 어떻게 되나요? 예를 들어 A사의 경우 Free Tier로 무료 사용기간이 있어서요.
클라우드 버전은 시간당 $1.34부터 시작하며, 자세한 내용은 아래링크를 참고하거나, 담당영업대표를 통해 연락해 주십시오.
https://cloud.oracle.com/en_US/oac/pricing
데스크탑 버전은 ADW(Autonomous Data Warehouse)를 사용하시는 고객은 무료로 사용할 수 있습니다.
Oracle Visualization Tool을 Oracle DB 기반의 Data 분석에 사용할 경우 다른 상용 DB와 연동해서 사용하는 경우와 비교할 때 유리한 점들이 있는지요.
ADW(Autonomous Data Warehouse)는 분석 업무에 최적화되어 있고, Oracle Exadata 기반의 서비스이기 때문에 다른 사용DB와 연동하는 것보다 성능면에서 매우 유리합니다.
[질문] 흔히들 얘기하는게 Data Pipeline 단을 구성하는게 전체 업무의 대부분을 차지한다고 얘기합니다. 오늘 주제인 배포와 운영 관점에서 두 Pipe Line 구성에 어느 정도 비율로 Resource가 할당되어야 할까요?