Domov
» Správy
»
Salesforce Heroku Outage: What Happens to Deployed Applications?
Salesforce Heroku Outage: What Happens to Deployed Applications?
A Heroku outage does not always mean every deployed application is completely offline. The impact depends on which part of the platform is failing: routing, dyno networking, data services, deployment tools, DNS, logging, or an integration such as Heroku Connect. For operators, the fastest way to respond is to identify the affected layer before restarting or changing a healthy application.
Heroku's own incident history shows why that distinction matters. On June 10, 2025, Heroku reported a severe platform disruption that created up to 24 hours of downtime for many customers. Heroku's post-incident summary said an unintended operating-system update restarted networking services on production hosts, while a routing setup flaw prevented correct network routes from being reapplied. The same incident also affected internal tools and the Heroku Status site, complicating diagnosis and communication. Heroku stated that the incident was not a security event and that no customer data was lost. See the official June 10 outage summary.
More recently, on May 8, 2026, Heroku reported a service disruption involving an upstream provider that affected a subset of customers in the North America region. Reported symptoms included intermittent connectivity, elevated database latency, and degraded performance involving third-party add-ons. Heroku later said it migrated affected resources to a new availability zone and restored web applications and databases. The incident history is available on the official Heroku incident page.
A monitoring view illustrates how a platform incident can affect routing, web dynos, workers, deployments, and add-ons differently while a database remains healthy.
Quick impact matrix: what can break during a Heroku outage?
Affected layer
What users may see
What operators may see
HTTP routing
Timeouts, 503 responses, intermittent requests
Router errors, falling throughput, some dynos unreachable
Dyno runtime or networking
Partial or complete application failures
Dyno relocations, failed connections, H99 or related platform symptoms
Heroku Postgres
Slow pages, errors on data-dependent actions
High DB latency, connection failures, read-only or failover conditions
Heroku Connect
Salesforce-backed data may become stale
Sync lag or paused/error states while app data remains locally accessible
Build/release tools
Existing app may continue serving normally
New deploys, review apps, release tasks, or configuration changes may stall
Dashboard/API/CLI
Usually no direct user-facing effect
Management actions may be unavailable or delayed
DNS
New or changed hostnames may not resolve
New apps/domains inaccessible even if runtime is healthy
1. Spustenie aplikácií môže zlyhať, aj keď sa váš kód nezmenil
Všetky aplikácie Heroku bežia v spravovaných kontajneroch nazývaných dyno. Webové dyno prijímajú HTTP prevádzku, pracovné dyno zvyčajne spracovávajú úlohy na pozadí a jednorazové dyno riešia administratívne úlohy. Dokumentácia k dyno v Heroku vysvetľuje, že správca dyno je zodpovedný za udržiavanie týchto kontajnerov v chode.
Problém s platformou môže preto spôsobiť, že predtým fungujúca verzia bude nedostupná bez nasadenia akejkoľvek aplikácie. Ak sa hostiteľská sieť, správca dynamometra alebo základná infraštruktúra stanú nedostupnými, aplikácia môže zlyhať, aj keď jej kód a konfigurácia zostanú nezmenené.
Počas výpadku 10. júna 2025 spoločnosť Heroku opísala zlyhanie siete, ktoré prerušilo odchádzajúce pripojenie pre dynamometre na postihnutých hostiteľoch. Toto je dôležité prevádzkové ponaučenie: chyba, ktorá vyzerá ako zlyhanie závislosti aplikácie, môže mať pôvod pod aplikačnou vrstvou.
2. Zlyhania smerovania môžu spôsobiť chyby 503, časové limity alebo občasný úspech.
HTTP routery Heroku prijímajú prichádzajúcu prevádzku a preposielajú požiadavky na webové dynamometre. Oficiálna dokumentácia smerovania popisuje túto cestu od vyrovnávačov záťaže cez routery k aplikačným dynamometrom.
Ak je narušená iba časť tejto cesty, používatelia môžu hlásiť, že stránka „niekedy funguje“. Jedna požiadavka môže dosiahnuť funkčný dynamometer, zatiaľ čo iná zlyhá. Preto je viacero kontrol z rôznych miest informatívnejších ako jedno obnovenie prehliadača.
Referenčný kód chyby Heroku je užitočný, keď sú protokoly stále k dispozícii. Kódy H99 a R99 sú konkrétne zdokumentované ako chyby platformy. Iné kódy môžu indikovať časový limit požiadavky, odmietnuté pripojenia backendu, karanténne dynamometre alebo problémy na úrovni aplikácie, takže samotný kód H by nemal byť automaticky pripisovaný incidentu v celom Heroku.
3. Výpadok dátovej služby môže spôsobiť, že aplikácia bude bežať, ale bude funkčne nepoužiteľná.
Aplikácia môže mať webové dynamometre v poriadku, aj keď je jej databáza pomalá alebo nedostupná. Stránky, ktoré nevyžadujú údaje, sa môžu stále načítavať, zatiaľ čo prihlásenie, pokladňa, vyhľadávanie, zápis alebo volania API zlyhávajú. To vytvára čiastočný výpadok, ktorý sa môže koncovým používateľom zdať nekonzistentný.
Incident z 8. mája 2026 je užitočným príkladom, pretože spoločnosť Heroku hlásila prerušované pripojenie a zvýšenú latenciu databázy u dotknutých zákazníkov. Spoločnosť Heroku tiež odporučila, aby dotknutí zákazníci zvážili záložné prepnutie databázy ako zmiernenie následkov počas incidentu.
Plánovaná údržba môže tiež spôsobiť kratšie prerušenia. Dokumentácia údržby Postgres od spoločnosti Heroku uvádza, že údržba môže reštartovať príslušnú aplikáciu a že používatelia môžu vidieť chyby alebo oneskorenia niekoľko minút. Preto by sa pred eskaláciou mala rozlišovať medzi plánovanou údržbou a neočakávaným výpadkom platformy.
4. Zlyhania Heroku Connect môžu spôsobiť zastaranie údajov Salesforce bez toho, aby sa webová aplikácia musela vypnúť.
Heroku Connect synchronizuje dáta medzi organizáciou Salesforce a Heroku Postgres. Podľa dokumentácie Heroku Connect služba poskytuje synchronizáciu dát a nefunguje ako samotný webový runtime.
Ak je aplikácia Connect prerušená, nasadená aplikácia môže zostať dostupná, aj keď sa synchronizované údaje Salesforce prestanú aktualizovať. Čítanie z existujúcej kópie Postgres môže stále fungovať, ale používatelia môžu vidieť zastarané záznamy alebo oneskorené zápisy v závislosti od mapovania a pracovného postupu aplikácie.
V dokumentácii údržby Heroku sa uvádza, že počas údržby Heroku Connect nie je synchronizácia a konfigurácia k dispozícii, pričom existujúce údaje v Postgres zostávajú prístupné; zmeny v rade sa zachovajú a synchronizácia sa následne obnoví. Toto správanie je zdokumentované v dokumente Údržba Heroku Connect .
5. Problémy s nasadením nemusia nevyhnutne znamenať, že produkcia je nefunkčná
Prevádzkovatelia by mali oddeliť „nedá sa nasadiť“ od „aplikácia nie je dostupná“. Heroku kategorizuje zostavenia, Git push, nasadzovacie API, Dashboard, CLI a súvisiace operácie správy oddelene od runtime a dátových služieb. Incident s nástrojmi môže zablokovať nové vydanie, zatiaľ čo aktuálne spustené vydanie naďalej obsluhuje prevádzku.
Tento rozdiel bol viditeľný pri incidente spoločnosti Heroku z 5. mája 2026, keď niektorí zákazníci nemohli vytvárať aplikácie na kontrolu, ale spoločnosť Heroku výslovne uviedla, že spustené aplikácie to neovplyvnilo.
Dokumentácia k fáze vydania Heroku tiež uvádza, že ak úloha vo fáze vydania zlyhá, nová verzia sa nenasadí a aktuálna verzia zostane nezmenená. Počas incidentu sa vyhnite interpretácii zaseknutého kanála ako dôkazu, že aktívna aplikácia zlyhala.
6. Incidenty DNS môžu ovplyvniť novovytvorené aplikácie alebo domény odlišne od existujúcich.
DNS je ďalším prípadom, kde môže byť rozsah úzky. V septembri 2025 spoločnosť Heroku nahlásila problém s DNS v upstreame, ktorý oneskoril poskytovanie záznamov DNS pre nové aplikácie a domény. Oficiálny incident poznamenal, že novovytvorené názvy hostiteľov mohli zostať neprístupné, kým sa problém s poskytovateľom nevyriešil, zatiaľ čo rozsah incidentu sa rozvinul tak, že zahŕňal niektoré chyby DNS pre existujúce aplikácie v regióne EÚ.
Pre praktickú diagnostiku otestujte existujúci názov hostiteľa Heroku oddelene od nedávno pridanej vlastnej domény. Skontrolujte aj rozlíšenie DNS nezávisle od stavu aplikácie.
Čo by ste mali skontrolovať ako prvé pri podozrení na výpadok Heroku?
Najprv skontrolujte Salesforce Trust. Heroku uvádza, že Salesforce Trust sa 10. októbra 2025 stal primárnym komunikačným kanálom pre incidenty a údržbu, pričom staršia stránka Heroku Status bola počas prechodu ponechaná ako paralelná záloha. Pozrite si dokumentáciu k Heroku Status .
Určite postihnutú kategóriu. Oddeľte aplikácie/runtime, dátové služby a nástroje. Tým sa zabráni zbytočným zmenám aplikácií počas incidentu na platforme.
Otestujte viac než len domovskú stránku. Skontrolujte statický koncový bod, koncový bod závislý od databázy, úlohy na pozadí a v prípade potreby aj pracovný postup synchronizovaný so Salesforce.
Skontrolujte chybové kódy a časové pečiatky. Porovnajte chyby routera/runtime Heroku s oficiálnym časom začiatku incidentu.
Potvrďte, či sú nasadenia iba blokované. Ak je produkčný systém v poriadku, vyhnite sa vynúteniu nasadenia počas incidentu nestabilnej riadiacej roviny.
Zachovajte dôkazy. Zaznamenávajte zlyhania požiadaviek, protokoly, metriky, latenciu databázy, ID incidentov a presné UTC okno.
Mali by som reštartovať dynamometre počas výpadku?
Iba vtedy, keď to podporujú pokyny k incidentu alebo vaše vlastné dôkazy. Reštartovanie môže pomôcť, keď sa konkrétny dynamometer zasekol, ale môže tiež odstrániť zdravý proces alebo spôsobiť ďalšiu stratu zákazníkov počas incidentu na celej platforme.
V prípade incidentu z 10. júna 2025 spoločnosť Heroku zverejnila špecifické riešenie pre aplikácie Private Space: dotknutí zákazníci mohli postupne zastaviť jednotlivé dynamometre, aby boli vymenené. Spoločnosť Heroku výslovne varovala, že to nezaručuje úplné obnovenie prevádzky, pokiaľ sú nadradené služby narušené, a že dynamometre by sa nemali všetky vymieňať súčasne. Toto usmernenie týkajúce sa konkrétneho incidentu je uvedené v oficiálnom článku o náprave .
Nezovšeobecňujte tento postup na každý výpadok. Ak je skutočným úzkym hrdlom databáza, smerovacia vrstva, poskytovateľ DNS alebo Heroku Connect, reštartovanie webových dynamometrov nemusí viesť k žiadnemu výsledku.
Obnova nie je dokončená, keď sa domovská stránka prvýkrát zobrazí znova.
Po obnovení dostupnosti platformy môžu následné systémy stále dobiehať zameškané. Heroku uviedol, že po výpadku v júni 2025 boli doručované oneskorené e-maily so stavom, synchronizácia Heroku Connect musela dobehnúť zameškané a fáza vydávania mala nevybavené úlohy, ktorých vyriešenie trvalo hodiny.
V prípade produkčnej aplikácie overte obnovu v celom reťazci závislostí:
Miera úspešnosti a latencia HTTP sa normalizovali.
Všetky očakávané webové a pracovné dynamometre sú v poriadku.
Čítanie a zápis z databázy prebieha s normálnou latenciou.
Fronty a naplánované úlohy sa skôr spracovávajú, než hromadia.
Mapovania Heroku Connect sú synchronizované, ak sa používajú.
Nasadenia a úlohy vo fáze vydania fungujú normálne.
Záznamy a metriky prichádzajú bez abnormálneho oneskorenia.
Doplnky tretích strán a externé rozhrania API boli obnovené.
Zrátané a podčiarknuté
Výpadok Salesforce Heroku môže ovplyvniť nasadené aplikácie na niekoľkých rôznych vrstvách. Incidenty runtime a routing môžu priamo spôsobiť, že aplikácie budú nedostupné; incidenty dát môžu nechať procesy bežať, ale narušiť základné funkcie; incidenty Connect môžu spôsobiť zastaranie dát podporovaných Salesforce; a incidenty nástrojov môžu blokovať nasadenie bez ovplyvnenia vydania, ktoré je už v produkcii.
Najlepšou operačnou reakciou preto nie je „reštartovať všetko“. Najprv zistite, či je zlyhanie v aplikáciách/runtime, dátach, nástrojoch, DNS alebo integrácii. Porovnajte svoje vlastné metriky s dôveryhodnosťou Salesforce, uchovajte dôkazy, dodržiavajte pokyny na zmiernenie dopadov špecifických incidentov a po obnovení overte každú závislosť. Tento prístup znižuje riziko, že sa incident platformy zmení na vlastný incident aplikácie.