Abra ve Snowflake, napojení podle edice, ne obecný export

    Abra (Gen i Flexi) je rodina českých ERP a účetních systémů. Snowflake je cloudová datová platforma (SaaS), která odděluje úložiště dat od výpočetního výkonu a účtuje obojí zvlášť, s výpočtem ve virtuálních warehousech, které si sami zapínáte, vypínáte a škálujete. Standardním cílovým úložištěm je u nás BigQuery, ale tam, kde firma na Snowflake už stojí, napojíme účetnictví, sklad a faktury z Abry přímo do něj, stejnou extrakční logikou, bez ručních exportů.

    K čemu propojení slouží

    Data z faktur, skladových karet a účetních dokladů z Abry pravidelně tečou do Snowflake přes staging úložiště v cloudu a přistávají v tabulkách, se kterými se dá pracovat přes SQL, bez ručního exportu a bez tabulek, které někdo musí každý týden aktualizovat.

    Data ve struktuře, se kterou se dá počítat

    Účetní doklady, skladové karty a pohyby z Abry se do Snowflake nahrávají přes Snowpipe nebo dávkově přes COPY INTO, ve struktuře připravené pro reporting, ne jako syrový export; u edice Flexi je zdrojem REST API s JSON nebo XML odpovědí, u Genu podle konkrétního nasazení.

    Kde se data dál používají

    Maržový report, segmentace produktů v Google Ads a skladové predikce pracují se stejným zdrojem, takže čísla v reportech sedí s účetnictvím, ať už nad daty stavíte v Power BI, Tableau nebo jiném BI nástroji napojeném na Snowflake.

    Na co si dát pozor

    U propojení do Snowflake se počítá s pár specifiky, která se u BigQuery neřeší. Je lepší je znát dopředu než je objevovat až v provozu.

    • Edice a verze Abry

      Abra existuje ve více edicích (Gen, Flexi) a verzích, dostupná data a rozhraní se podle nasazení liší. Abra Flexi běží nad PostgreSQL a k datům se prakticky přistupuje jen přes REST API, zatímco Abra Gen tradičně běží nad Firebirdem, Oraclem nebo MSSQL a podle nasazení umožňuje i přímější přístup k datům. Napojení proto vychází z konkrétní edice a nastavení, se kterým pracujete, ne z paušálního předpokladu.

    • Snowflake nemá on-premises bránu jako Fabric

      Abra není cloudová služba, data má obvykle na místním počítači nebo firemním serveru. Snowflake na rozdíl od Microsoft Fabric nemá vlastní produkt pro přímé napojení on-premises zdrojů — data se do něj nahrávají přes Snowpipe nebo COPY INTO z externí staging lokality v cloudovém úložišti (S3, ADLS Gen2 nebo GCS). V praxi to znamená, že stejná extrakční pipeline, která už dnes posílá data Abry do BigQuery, je nasměruje do staging úložiště, odkud si je Snowflake načte — je to stejná extrakční práce, jen s jiným posledním krokem, ne zásadně jiná integrace.

    • Compute běží, i když nikdo nekouká do reportu

      Snowflake účtuje výpočet (virtuální warehouse) zvlášť od úložiště, po sekundách s minimem 60 sekund běhu. Pokud warehouse nemá nastavené auto-suspend, běží a spotřebovává kredity i ve chvíli, kdy s daty nikdo nepracuje. Na rozdíl od BigQuery, kde se platí za jednotlivé dotazy a bez dotazu neběží žádný náklad navíc, je tohle riziko, na které je potřeba myslet už při nastavení.

    • Číselníky skladových karet

      Pokud se kódy produktů v Abře a v e-shopu liší, je potřeba mapovací vrstva. Bez ní marže nesedí na produkty v kampaních.

    • Limity API a více provozoven

      Abra obvykle omezuje objem a frekvenci dotazů, synchronizaci je proto potřeba plánovat. Pokud jedna skupina vede v Abře víc účetních jednotek, data se musí oddělit už při načítání, aby šlo reportovat zvlášť i dohromady.

    • REST API Flexi má JSON i XML a denní limit dotazů

      Abra Flexi vrací data přes REST API buď jako JSON, nebo jako XML se stejnou strukturou, podle přípony v URL nebo hlavičky Accept, a záznamy jde adresovat i vlastním kódem, ne jen číselným ID. Podle tarifu má API i denní limit počtu dotazů, od jednotek tisíc až po statisíce, což je potřeba zohlednit při plánování synchronizace.

    Jak to Datimo řeší

    1. 1

      Vlastní konektor pro vaši edici Abry

      Napojení se nastaví podle vaší edice a verze Abry a datové struktury — u Flexi přes REST API, u Genu podle zvoleného způsobu přístupu k datům — stejnou extrakční logikou, jakou používáme pro BigQuery.

    2. 2

      Staging v cloudu a načtení do Snowflake

      Data nejdřív přistanou v externí staging lokalitě (S3, ADLS Gen2 nebo GCS) a odtud je do Snowflake načteme přes Snowpipe nebo COPY INTO, podle toho, jak často data potřebujete aktualizovat.

    3. 3

      Pravidelná synchronizace

      Data se aktualizují podle domluveného intervalu, ne jednou za měsíc ručním exportem.

    4. 4

      Nastavení auto-suspend a sledování nákladů

      Virtuální warehouse nastavíme s auto-suspend, aby neběžel a neúčtoval kredity ve chvíli, kdy ho nikdo nepoužívá, a náklady na compute i úložiště sledujeme průběžně.

    5. 5

      Přístupy přes RBAC

      Kdo má k datům ve Snowflake přístup, řešíme přes rolí založený model (RBAC), případně napojený na vaše SSO, ne ad-hoc sdílením.

    6. 6

      Správa napojení v ceně

      Technickou správu, údržbu při změnách API i aktivní monitoring hlídáme za vás, v rámci ceny.