Data ze SAPu ve Snowflake, propojená s maržemi, skladem i kampaněmi

    SAP je nadnárodní ERP platforma používaná zejména většími firmami. Snowflake je cloudová datová platforma, která odděluje výpočet od úložiště dat, compute řeší přes virtuální warehousy, jež si firma sama škáluje a spouští podle potřeby. Napojíme SAP na Snowflake podle modulů a tabulek, které ve firmě reálně používáte, se stejnou logikou konektoru, jakou u SAPu standardně stavíme na BigQuery, který zůstává naším výchozím datovým skladem.

    K čemu propojení slouží

    SAP bývá hlavní zdroj účetních, skladových a prodejních dat u větších firem, ale ven z něj se data obvykle dostávají přes ruční exporty nebo omezené standardní reporty. Napojení do Snowflake udělá ze SAPu zdroj dat, se kterým počítají i další nástroje, včetně BI nástrojů napojených na Snowflake, ne uzavřený systém pro pár lidí s přístupem.

    Data mimo hranice SAPu

    Objednávky, skladové pohyby a účetní doklady ze SAPu se pravidelně ukládají do Snowflake, odkud s nimi může pracovat i zbytek firmy, ne jen ten, kdo se dostane do SAPu. SAP navíc svoje tabulky pojmenovává krátkými kódy jako MARA (obecná materiálová data) nebo VBAK (hlavičky prodejních dokladů), ne popisnými názvy, takže mapování na to, co která tabulka skutečně obsahuje, vyžaduje znalost datového slovníku SAPu, ne jen nahlédnutí do schématu.

    Kde se data dál používají

    Maržový report, skladové predikce a segmentace produktů v Google Ads pracují se stejným zdrojem, takže čísla ze SAPu, e-shopu a marketingu sedí na sebe, ať už nad nimi stojí BI nástroj napojený na Snowflake, nebo jiný nástroj.

    Na co si dát pozor

    SAP není jeden standardní systém, je to platforma, kterou má skoro každá firma nasazenou a nakonfigurovanou jinak. To má přímý dopad na to, jak napojení vzniká, a proč u SAPu neexistuje jeden univerzální konektor. K tomu přibývá otázka, jak se data ze SAPu dostanou do Snowflake, pokud SAP běží mimo veřejně dostupnou síť.

    • Nasazení a verze se liší firmu od firmy

      SAP běží on-premise i jako cloudové nasazení, v různých verzích a s různou mírou úprav na míru. Napojení proto vychází z konkrétní instalace, ne z jednotného řešení pro „SAP obecně“.

    • ECC a S/4HANA se dostávají ven jinak

      Cesta dat ven ze SAPu záleží i na tom, jakou edici provozujete. Starší ECC obvykle umožňuje čtení přes RFC/BAPI volání nebo přímý přístup k tabulkám, zatímco S/4HANA, a zejména S/4HANA Cloud, tohle přímé napojení blokuje a extrakci vede přes OData služby nebo CDS views. Typ napojení proto vychází i z toho, na jaké edici SAP reálně běžíte.

    • Rozsah dat určují použité moduly

      Které objekty a tabulky dává smysl exportovat, závisí na tom, jaké moduly firma v SAPu skutečně používá a jak si je nastavila. Napojení proto vždy nejdřív zmapuje, co je ve vaší instalaci reálně k dispozici, a teprve podle toho se navrhne rozsah přenášených dat.

    • Snowflake nemá vlastní on-premises gateway

      Pokud SAP běží on-premise nebo v privátní síti, Snowflake sám o sobě nenabízí lokální bránu, přes kterou by se k datům dostal, jako to řeší třeba Microsoft Fabric. Data proto nejdřív projdou stejnou extrakční pipeline, kterou používáme pro napojení na BigQuery, a přistanou v cloudovém stagingu, odkud je Snowflake načte přes Snowpipe nebo dávkově přes COPY INTO.

    • Více SAP instancí nebo firemních jednotek

      Pokud firma nebo skupina provozuje víc SAP instancí nebo účetních jednotek, data se musí oddělit už při načítání, aby šlo reportovat zvlášť i dohromady.

    • Virtuální warehouse účtuje i naprázdno

      Snowflake účtuje compute zvlášť od úložiště, po vteřinách s minimem 60 vteřin podle velikosti virtuálního warehousu. Pokud warehouse nemá nastavené automatické pozastavení (auto-suspend), čerpá kredity i ve chvíli, kdy na něm nikdo nic nepočítá, na rozdíl od BigQuery, kde platíte za jednotlivé dotazy, ne za běžící instanci.

    Jak to Datimo řeší

    1. 1

      Napojení šité na vaši instalaci

      Konektor stavíme podle toho, jaké moduly a tabulky ve vašem SAPu reálně používáte, ne jako univerzální řešení pro všechna nasazení. Datový model je stejný jako u napojení na BigQuery, mění se jen cílová platforma.

    2. 2

      Vy poskytnete přístupy, my synchronizaci

      Stačí nám poskytnout API přístupy do SAPu, případně situaci, kdy SAP neběží na veřejně dostupné síti, řešíme přes stejnou extrakční pipeline, jakou používáme u BigQuery. Řada firem má pro průběžnou synchronizaci bez zátěže nasazený SAP Landscape Transformation Replication Server (SLT), který sleduje změny v tabulkách přes databázové triggery, s tím dokážeme napojení postavit stejně jako s přímými API přístupy. O pravidelnou synchronizaci dat do Snowflake se postaráme sami.

    3. 3

      Data do Snowflake přes Snowpipe nebo COPY INTO

      Data landujeme v cloudovém úložišti a do Snowflake je načítáme přes Snowpipe pro průběžné načítání, nebo dávkově přes COPY INTO, podle toho, jak často potřebujete aktuální čísla.

    4. 4

      Synchronizace podle vaší infrastruktury

      Data se aktualizují podle domluveného intervalu a zátěže, kterou váš SAP unese, ne nárazově jednou za měsíc ručním exportem.

    5. 5

      Správa napojení v ceně

      Technickou správu, úpravy při změnách na straně SAPu, konfiguraci auto-suspend u virtuálních warehousů i aktivní monitoring hlídáme za vás, v rámci ceny.