Domů
» Zprávy
»
Salesforce Heroku Outage: What Happens to Deployed Applications?
Salesforce Heroku Outage: What Happens to Deployed Applications?
A Heroku outage does not always mean every deployed application is completely offline. The impact depends on which part of the platform is failing: routing, dyno networking, data services, deployment tools, DNS, logging, or an integration such as Heroku Connect. For operators, the fastest way to respond is to identify the affected layer before restarting or changing a healthy application.
Heroku's own incident history shows why that distinction matters. On June 10, 2025, Heroku reported a severe platform disruption that created up to 24 hours of downtime for many customers. Heroku's post-incident summary said an unintended operating-system update restarted networking services on production hosts, while a routing setup flaw prevented correct network routes from being reapplied. The same incident also affected internal tools and the Heroku Status site, complicating diagnosis and communication. Heroku stated that the incident was not a security event and that no customer data was lost. See the official June 10 outage summary.
More recently, on May 8, 2026, Heroku reported a service disruption involving an upstream provider that affected a subset of customers in the North America region. Reported symptoms included intermittent connectivity, elevated database latency, and degraded performance involving third-party add-ons. Heroku later said it migrated affected resources to a new availability zone and restored web applications and databases. The incident history is available on the official Heroku incident page.
A monitoring view illustrates how a platform incident can affect routing, web dynos, workers, deployments, and add-ons differently while a database remains healthy.
Quick impact matrix: what can break during a Heroku outage?
Affected layer
What users may see
What operators may see
HTTP routing
Timeouts, 503 responses, intermittent requests
Router errors, falling throughput, some dynos unreachable
Dyno runtime or networking
Partial or complete application failures
Dyno relocations, failed connections, H99 or related platform symptoms
Heroku Postgres
Slow pages, errors on data-dependent actions
High DB latency, connection failures, read-only or failover conditions
Heroku Connect
Salesforce-backed data may become stale
Sync lag or paused/error states while app data remains locally accessible
Build/release tools
Existing app may continue serving normally
New deploys, review apps, release tasks, or configuration changes may stall
Dashboard/API/CLI
Usually no direct user-facing effect
Management actions may be unavailable or delayed
DNS
New or changed hostnames may not resolve
New apps/domains inaccessible even if runtime is healthy
1. Spuštění aplikací může selhat, i když se váš kód nezměnil.
Všechny aplikace Heroku běží ve spravovaných kontejnerech zvaných dynamata. Webová dynamata přijímají HTTP provoz, pracovní dynamata obvykle zpracovávají úlohy na pozadí a jednorázová dynamata se zabývají administrativními úkoly. Dokumentace k dynům v Heroku vysvětluje, že za chod těchto kontejnerů je zodpovědný správce dynů.
Problém s platformou proto může způsobit, že dříve fungující verze bude nedostupná bez nasazení jakékoli aplikace. Pokud se hostitelská síť, správce dynama nebo podkladová infrastruktura stanou nedostupnými, aplikace může selhat, i když její kód a konfigurace zůstanou nezměněny.
Během výpadku 10. června 2025 popsal Heroku selhání sítě, které přerušilo odchozí připojení k dynamometrům na postižených hostitelích. Toto je důležité provozní ponaučení: chyba, která vypadá jako selhání závislosti aplikace, může mít původ pod aplikační vrstvou.
2. Selhání směrování může způsobit chyby 503, časové limity nebo občasný úspěch.
HTTP routery Heroku přijímají příchozí provoz a přeposílá požadavky na webové dynamometry. Oficiální dokumentace směrování popisuje tuto cestu od vyvažovačů zátěže přes routery k aplikačním dynamometrům.
Pokud je narušena pouze část této cesty, uživatelé mohou hlásit, že web „někdy funguje“. Jeden požadavek může dosáhnout funkčního dynamometru, zatímco jiný selže. Proto je více kontrol z různých míst informativnější než jediné obnovení prohlížeče.
Referenční číslo chybových kódů Heroku je užitečné, pokud jsou k dispozici protokoly. Kódy H99 a R99 jsou konkrétně zdokumentovány jako chyby platformy. Jiné kódy mohou indikovat vypršení časového limitu požadavku, odmítnutí připojení k backendu, karanténu dynamometrů nebo problémy na úrovni aplikace, takže kód H sám o sobě by neměl být automaticky sváděn k incidentu v celém Heroku.
3. Výpadek datové služby může způsobit, že aplikace bude běžet, ale bude funkčně nepoužitelná.
Aplikace může mít webové dynama v pořádku, i když je její databáze pomalá nebo nedostupná. Stránky, které nevyžadují data, se mohou stále načítat, zatímco přihlášení, pokladna, vyhledávání, zápis nebo volání API selhávají. To vede k částečnému výpadku, který může koncovým uživatelům připadat nekonzistentní.
Incident z 8. května 2026 je užitečným příkladem, protože Heroku hlásila u dotčených zákazníků přerušované připojení a zvýšenou latenci databáze. Heroku také doporučila, aby dotčení zákazníci zvážili failover databáze jako zmírnění následků incidentu.
Plánovaná údržba může také způsobit kratší přerušení. Dokumentace údržby Postgres od Heroku uvádí, že údržba může restartovat související aplikaci a že uživatelé mohou po dobu několika minut zaznamenat chyby nebo zpoždění. Před eskalací je proto třeba rozlišit mezi plánovanou údržbou a neočekávaným výpadkem platformy.
4. Selhání Heroku Connect může způsobit zastarání dat Salesforce, aniž by se musela webová aplikace vypnout.
Heroku Connect synchronizuje data mezi organizací Salesforce a Heroku Postgres. Podle dokumentace Heroku Connect služba poskytuje synchronizaci dat, nikoliv samotná jako webový běhový modul.
Pokud je aplikace Connect přerušena, nasazená aplikace může zůstat dostupná, i když se synchronizovaná data Salesforce přestanou aktualizovat. Čtení z existující kopie Postgres může stále fungovat, ale uživatelé mohou v závislosti na mapování a pracovním postupu aplikace vidět zastaralé záznamy nebo zpožděné zápisy.
Dokumentace údržby Heroku uvádí, že během údržby Heroku Connect není synchronizace a konfigurace k dispozici, zatímco existující data v Postgres zůstávají přístupná; změny ve frontě se zachovají a synchronizace se poté obnoví. Toto chování je zdokumentováno v dokumentu Heroku Connect Maintenance Operations .
5. Problémy s nasazením nemusí nutně znamenat, že je produkce nefunkční
Operátoři by měli oddělovat „nelze nasadit“ od „aplikace není dostupná“. Heroku kategorizuje sestavení, Git push, nasazení API, Dashboard, CLI a související operace správy odděleně od běhových a datových služeb. Incident s nástroji může blokovat novou verzi, zatímco aktuálně spuštěná verze nadále obsluhuje provoz.
Tento rozdíl byl viditelný v incidentu Heroku z 5. května 2026, kdy někteří zákazníci nemohli vytvářet aplikace pro kontrolu, ale Heroku výslovně uvedlo, že spuštěné aplikace tím nebyly ovlivněny.
Dokumentace k fázi vydání Heroku také uvádí, že pokud úloha ve fázi vydání selže, nová verze se nenasadí a aktuální verze zůstane nedotčena. Během incidentu se vyhněte interpretaci zaseknutého kanálu jako důkazu selhání živé aplikace.
6. Incidenty DNS mohou ovlivnit nově vytvořené aplikace nebo domény odlišně od stávajících.
DNS je dalším případem, kdy může být rozsah omezený. V září 2025 společnost Heroku nahlásila problém s DNS v upstreamu, který zpozdil zřizování záznamů DNS pro nové aplikace a domény. Oficiální incident uváděl, že nově vytvořené názvy hostitelů mohly zůstat nepřístupné, dokud nebyl problém s poskytovatelem vyřešen, zatímco rozsah incidentu se rozvinul tak, že zahrnoval některé chyby DNS pro stávající aplikace v regionu EU.
Pro praktickou diagnostiku otestujte stávající název hostitele Heroku odděleně od nedávno přidané vlastní domény. Také zkontrolujte DNS resolver nezávisle na stavu aplikace.
Co byste měli zkontrolovat jako první při podezření na výpadek Heroku?
Nejprve zkontrolujte Salesforce Trust. Heroku uvádí, že Salesforce Trust se stal primárním komunikačním kanálem pro incidenty a údržbu 10. října 2025, přičemž starší web Heroku Status byl během přechodu zachován jako paralelní záloha. Viz dokumentace k Heroku Status .
Určete postiženou kategorii. Oddělte aplikace/běhové prostředí, datové služby a nástroje. Tím se zabrání zbytečným změnám aplikací během incidentu platformy.
Otestujte více než jen domovskou stránku. Zkontrolujte statický koncový bod, koncový bod závislý na databázi, úlohy na pozadí a případně i pracovní postup synchronizovaný se Salesforce.
Zkontrolujte chybové kódy a časová razítka. Proveďte korelaci chyb routeru/běhového prostředí Heroku s oficiálním časem zahájení incidentu.
Ověřte, zda jsou nasazení pouze blokována. Pokud je produkční prostředí v pořádku, vyhněte se vynucování nasazení během incidentu nestabilní řídicí roviny.
Uchovávejte důkazy. Zaznamenávejte selhání požadavků, protokoly, metriky, latenci databáze, ID incidentů a přesné UTC okno.
Měly by se dynamometry během výpadku restartovat?
Pouze pokud to podporují pokyny k incidentu nebo vaše vlastní důkazy. Restartování může pomoci, když se konkrétní dynamo zasekne, ale může také odstranit zdravý proces nebo způsobit další fluktuaci během incidentu napříč platformou.
Pro incident z 10. června 2025 zveřejnila společnost Heroku specifické řešení pro aplikace Private Space: postižení zákazníci mohli postupně zastavovat jednotlivé dynamometry, aby mohly být nahrazeny. Společnost Heroku výslovně varovala, že to nezaručuje úplné obnovení provozu, pokud jsou upstreamové služby narušeny, a že dynamometry by neměly být nahrazovány všechny současně. Pokyny specifické pro daný incident jsou uvedeny v oficiálním článku o nápravě .
Nezobecňujte tento postup na každý výpadek. Pokud je skutečným úzkým hrdlem databáze, směrovací vrstva, poskytovatel DNS nebo Heroku Connect, restartování webových dynamometrů nemusí vést k ničemu.
Obnova není dokončena, když se domovská stránka poprvé zobrazí.
Po obnovení dostupnosti platformy mohou následné systémy stále dohánět zpoždění. Heroku uvedl, že po výpadku v červnu 2025 byly doručovány e-maily se zpožděním, synchronizace Heroku Connect musela ztraceno a fáze vydání měla nahromadění nevyřízených úkolů, jejichž vyřízení trvalo hodiny.
Pro produkční aplikaci ověřte zotavení v celém řetězci závislostí:
Míra úspěšnosti a latence HTTP se normalizovaly.
Všechny očekávané webové a pracovní dynamometry jsou v pořádku.
Čtení a zápisy z databáze probíhají s normální latencí.
Fronty a naplánované úlohy se spíše zpracovávají, než aby se hromadily.
Mapování Heroku Connect se synchronizuje, pokud se používá.
Nasazení a úlohy ve fázi vydání fungují normálně.
Protokoly a metriky přicházejí bez abnormálního zpoždění.
Doplňky třetích stran a externí API byly obnoveny.
Sečteno a podtrženo
Výpadek Salesforce Heroku může ovlivnit nasazené aplikace na několika různých vrstvách. Incidenty běhu a směrování mohou přímo znemožnit přístup k aplikacím; datové incidenty mohou nechat procesy spuštěné, ale narušit základní funkce; incidenty připojení mohou způsobit zastarání dat zálohovaných Salesforce; a incidenty nástrojů mohou blokovat nasazení, aniž by ovlivnily verzi, která je již v produkčním prostředí.
Nejlepší provozní reakcí proto není „restartovat vše“. Nejprve zjistěte, zda je selhání v aplikacích/běhovém prostředí, datech, nástrojích, DNS nebo integraci. Porovnejte své vlastní metriky s důvěrou Salesforce, uchovávejte důkazy, řiďte se pokyny pro zmírnění dopadů specifickými pro daný incident a po obnovení ověřte každou závislost. Tento přístup snižuje riziko, že se incident platformy promění ve váš vlastní incident aplikace.