Salesforcen käyttökatkokset vuonna 2025 eivät noudattaneet yhtä yksinkertaista kaavaa. Jotkut tapaukset rajoittuivat tiettyihin instansseihin tai tuotteisiin, kun taas toiset ulottuivat useiden pilvipalveluiden alueelle tai olivat riippuvaisia kolmannen osapuolen infrastruktuurista. Operatiivisten, IT-, CRM-, kaupankäynti- ja markkinointitiimien kannalta hyödyllinen retrospektiivi ei ole luettelo kaikista kyseisenä vuonna julkaistuista Trust-postauksista. Se on katsaus häiriöihin, jotka paljastavat toistuvia vikaantumistyyppejä: todennusriippuvuudet, datakeskuksen infrastruktuuri, tietokannan palautus, sisällönjakeluverkot, pilvipalveluntarjoajan DNS ja muutokset, jotka on peruutettava.
Tämä viite keskittyy valikoituun joukkoon merkittäviä Salesforce Trustin dokumentoimia vuoden 2025 tapauksia. ”Merkittävä” tarkoittaa tässä toiminnallisesti merkittävää keston, laajuuden tai asiakkaan työnkulun tyypin vuoksi. Se ei tarkoita, että kaikki asiakkaat olisivat kärsineet, eikä kyseessä ole täydellinen tapausten luettelo. Tarkka vaikutus riippui tuotteesta, instanssista, alueesta ja vuokralaisesta.
Operatiivinen tiimi tarkastelee palvelun kuntoa ja häiriöiden aikajanaa havainnollistaen, millaista järjestelmien välistä valvontaa tarvitaan, kun pilvialustan häiriö vaikuttaa liiketoiminnan työnkulkuihin.
Vuoden 2025 Salesforcen käyttökatkosten aikajana: valikoituja tapauksia, jotka kannattaa tutkia
Päivämäärä
Mitä Salesforce raportoi
Ilmoitettu kesto tai toipumisikkuna
Miksi sillä on merkitystä operatiivisesti
7. helmikuuta
Palveluhäiriö osalla asiakkaista, ja Salesforce mainitsee resurssirajoitukset, jotka liittyvät korkeaan verkkoliikenteen käyttöasteeseen.
2 tuntia 20 minuuttia
Kapasiteetti ja liikennepaine voivat muuttaa suorituskyvyn heikkenemisen täydelliseksi käytettämättömyydeksi.
13.–14. helmikuuta
Palveluhäiriö liittyi kolmannen osapuolen toimittajan ongelmaan; Salesforcen mukaan toimittaja löysi vaurioita fyysisessä verkkoinfrastruktuurissa Salesforcen työskennellessä vikasietoisuuden parissa.
1 tunti 45 minuuttia
Ulkoisista yhteyksistä voi tulla osa tehokasta Salesforcen saatavuusrajaa.
10.–11. kesäkuuta
Usean pilven tapahtuma vaikutti todennukseen ja palveluihin useissa tuotteissa, kuten Herokussa, Commercessa, Marketing Cloudissa ja muissa Salesforce-palveluissa.
Yksi Trust-tapaus kesti 22 tuntia 43 minuuttia
Identiteetti- ja jaettujen alustojen riippuvuudet voivat luoda laaja-alaisia liiketoimintavaikutuksia, vaikka yksittäiset sovellukset pysyisivät toimintakunnossa.
18.–19. kesäkuuta
Jäähdytysjärjestelmän vikaantuminen Indianapolisin datakeskuksessa laukaisi verkkohäiriön; Salesforce raportoi, että useimmat pahasti vaurioituneiden pinojen palvelimet menivät offline-tilaan ennen vaiheittaista korjausta.
Palveluhäiriön kesto mainitussa tapauksessa oli 18 tuntia 44 minuuttia.
Fyysiset tilat, sähkö, verkot, virtuaalinen infrastruktuuri, tietokannat ja sovellusten palautus voivat muodostaa pitkän riippuvuusketjun.
2.–6. lokakuuta
Marketing Cloud -asiakkaat, joiden tietokanta oli DB10016, menettivät palvelunsa, koska tietokanta ei ollut käytettävissä. Salesforce palautti ja validoi tietokannan.
Palveluhäiriövaiheen raportoitu kestäneen 3 päivää 16 tuntia ennen suorituskyvyn heikkenemistä
Tietokannan palautus voi olla paljon hitaampaa kuin sovelluksen uudelleenkäynnistys, joten jatkuvuussuunnitelmissa on oltava pitkäkestoinen tila.
20. lokakuuta
Useisiin Salesforce-pilvipalveluihin vaikutti kolmannen osapuolen pilvi-infrastruktuuritoimittajan DNS-ongelma. Commerce Cloud, MuleSoft, Marketing Cloud Account Engagement, Heroku ja muut palvelut raportoivat asiaan liittyvästä vaikutuksesta.
Vaihteli palveluittain; Commercen häiriö kesti 3 tuntia 19 minuuttia, kun taas MuleSoftin tapaus oli avoinna 16 tuntia 23 minuuttia.
Yhden toimittajan tason riippuvuus voi aiheuttaa erilaisia oireita ja palautumisaikoja eri tuotteissa.
18. marraskuuta
Osa Commerce Cloudin myymälöistä koki ajoittaisia HTTP 500 -virheitä. Salesforce kertoi alustansa ja verkkonsa toimivan normaalisti ja selitti häiriön johtuvan kolmannen osapuolen CDN-palveluntarjoajan määrityspäivityksestä, joka on peruttu.
4 tuntia 40 minuuttia
Asiakaskohtainen saatavuus voi epäonnistua toimitusreunalla, vaikka ydinsovellusalusta olisi kunnossa.
1. ”Salesforce on alhaalla” on yleensä liian yleisluontoinen ilmaus ollakseen käytännöllinen
Salesforce Trust raportoi tapaukset tuotteen, instanssin, palvelun ja joskus tietokannan tai alueellisen komponentin mukaan. Helmikuun 7. päivän häiriö vaikutti osaan asiakkaista. Lokakuun 2. päivän Marketing Cloud -tapaus keskittyi yhteen tietokantaan. Lokakuun 20. päivän tapahtuma kattoi useita pilvipalveluita, mutta sillä oli erilaiset palautumisajat ja oireet. Vastaajille ensimmäinen hyödyllinen kysymys ei siis ole pelkästään se, onko Salesforce poissa käytöstä, vaan mikä vuokraaja, tuote, alue, instanssi ja riippuvuus vikaantuu.
2. Kolmannen osapuolen infrastruktuurista tuli osa katkostarinaa
Useat vuonna 2025 sattuneet tapaukset osoittavat, miksi SaaS-jatkuvuussuunnittelu ei voi pysähtyä SaaS-toimittajan rajalle. Helmikuun 13.–14. päivänä sattunut tapaus koski kolmannen osapuolen verkkotoimittajaa. Lokakuun 20. päivänä sattunut monipilvipalvelun häiriö liittyi kolmannen osapuolen pilvi-infrastruktuuritoimittajan DNS-ongelmaan. Marraskuun 18. päivänä Salesforce raportoi Commerce Cloud -kaupan yhteysongelmista, jotka liittyivät kolmannen osapuolen CDN-palveluntarjoajan määrityspäivitykseen.
Opetus ei ole se, että kolmannet osapuolet olisivat luonnostaan epäluotettavia. Vaan se, että asiakkaiden työnkulut ovat riippuvaisia palveluketjusta: identiteetistä, DNS:stä, verkoista, sisällönjakelusta, pilvi-infrastruktuurista, API-rajapinnoista ja sovelluspalveluista. Tapahtumamallisi tulisi seurata tätä ketjua.
3. Toipuminen on usein vaiheittaista, ei välitöntä
Kesäkuun 18.–19. päivänä järjestetty datakeskustapahtuma on tästä vahva esimerkki. Salesforce kuvaili fyysisten ja virtuaalisten resurssien palauttamista, tietokantojen ja replikoiden tuomista verkkoon, dataparametrien validointia ja riippuvaisten palveluiden palauttamista. Lokakuun Marketing Cloud -tietokannan häiriö eteni samoin palautuksen, kokoonpanotarkistusten, validoinnin ja myöhemmän suorituskyvyn heikkenemisvaiheen kautta.
Tällä erolla on merkitystä liiketoimintatiimeille. ”Alusta toipuu” ei välttämättä tarkoita, että jokainen jono on tyhjennetty, jokainen integraatio on toistettu, jokainen myymälä on vakaa tai jokainen ajoitettu työ on suoritettu onnistuneesti.
Käytännön tapausten varalle tarkoitettu tarkistuslista Salesforcen käyttökatkosten varalta
Tunnista tarkka räjähdysalueesi. Kirjaa ylös organisaatiot, omat verkkotunnukset, tuotteet, liiketoimintayksiköt, alueet, instanssit ja integraatiot.
Tarkista Salesforcen luotettavuus ennen tuotannon muuttamista. Vertaa oireitasi viralliseen tapahtumatietoihin, jotta et tee tarpeettomia määritysmuutoksia toimittajan puolen tapahtuman aikana.
Erilliset kirjautumis-, API-, data- ja käyttöliittymävirheet. Todennusvirhe, hitaat sivut, viivästyneet asynkroniset työt, tietokannan saatavuuskatkos ja CDN-virheet vaativat erilaisia kiertoteitä.
Suojaa tietojen eheys. Vältä sokeita uudelleenyrityksiä, jotka voivat luoda kaksoiskappaleita tapauksista, liideistä, tilauksista, maksuista tai lähtevistä viesteistä. Käytä idempotenssi-säätimiä, jos integraatiot tukevat niitä.
Jonota kriittiset työt vikaantuvan riippuvuuden ulkopuolella. Tallenna kiireelliset myynti-, tuki-, toimitus- tai palvelupyynnöt hallittuun varakanavaan aikaleimojen ja omistajuuden avulla.
Seuraa palautumista työnkulun, ei pelkästään tilan värin mukaan. Testaa kirjautumista, luku-/kirjoitustoimintoja, API-kutsuja, ajoitettuja töitä, saapuvia viestejä, lähteviä ilmoituksia ja arvokkaita asiakaspolkuja.
Täsmäytä palautuksen jälkeen. Tarkista epäonnistuneet työt, uudelleenyritysjonot, osittaiset tapahtumat, epäonnistuneet automaatiot, kaksoiskappaleet ja raportointiaukot.
Säilytä tapahtumaloki. Kirjaa muistiin ensimmäinen oire, virallinen tapahtumatunnus, liiketoimintavaikutus, lieventämistoimenpiteet, palautumispisteet ja tapahtuman jälkeiset toimenpiteet.
Salesforce Trust -tapauksen lukeminen ilman ylireagointia
Hyödyllinen luottamustarkistus koostuu kolmesta vaiheesta. Ensin lue palvelut ja instanssit, joihin tapahtuma vaikuttaa. Toiseksi vertaa julkaistua aloitusaikaa telemetriasi tietoihin; Salesforce joskus tarkistaa tapausten aloitusaikoja tutkinnan parantuessa. Kolmanneksi erota palvelun häiriöt suorituskyvyn heikkenemisestä tai ominaisuuksien häiriöistä. Nämä tunnisteet kuvaavat erilaisia toimintatiloja, ja ominaisuustason tapaus voi jättää suurimman osan alustasta käyttökelpoiseksi.
Älä oleta, että tapauksen kesto vastaa ajanjaksoa, jonka aikana jokainen asianomainen asiakas koki identtisiä oireita. Salesforce-päivitykset kuvaavat usein vaikutusalueen laajenemista tai pienenemistä, vaiheittaista palautumista tai tuotekohtaista korjausta. Sisäistä raportointia varten kirjaa ylös sekä toimittajan virallinen aikajana että oma havaittu vaikutusikkunasi.
Jatkuvuussuunnittelun opetuksia vuoden 2025 pisimmistä tapahtumista
Vuoden 2025 vahvin oppitunti häiriönsietokyvyn parantamiseksi on, että käyttökatkosuunnitelman tulisi kestää yli 30 minuuttia. Lyhytaikainen häiriö saattaa vaatia vain kommunikointia ja kärsivällisyyttä. Usean tunnin tapahtuma vaatii jonotettua työtä ja hallittuja manuaalisia prosesseja. Useita päiviä kestävä häiriö, kuten mainittu Marketing Cloud -tietokantahäiriö, vaatii henkilöstön siirtoja, ruuhkan hallintaa, asiakasviestintää sekä palautussuunnitelman lykätyille kampanjoille, tuonneille, vienneille, API-toiminnoille ja raportoinnille.
Määritä palautumisprioriteetit ennen käyttökatkoa. Myyntiorganisaatiolle liidien vastaanotto ja asiakassitoumukset voivat olla ennen analytiikan päivityksiä. Jälleenmyyjälle tilausten vastaanotto, varaston tarkkuus ja asiakaspalvelun näkyvyys voivat olla kriittisiä. Markkinointitiimille prioriteetti voi olla päällekkäisten lähetysten estäminen ja kampanjan tilan säilyttäminen sen sijaan, että yritettäisiin pakottaa jokainen ajoitettu toiminto epävakaan järjestelmän läpi.
Mitä joukkueiden tulisi muuttaa vuoden 2025 tarkastelun jälkeen?
Käytä retrospektiiviä oletusten testaamiseen, älä seuraavan vian ennustamiseen. Vuoden 2025 tapaukset osoittavat, että alkusyynä oleva ongelma voi johtua liikennepaineesta, toimittajien verkottumisesta, fyysisestä jäähdytyksestä, tietokannoista, DNS:stä, CDN-kokoonpanosta tai ohjelmistomuutoksista. Mikään yksittäinen ratkaisu ei kata kaikkia näitä.
Kypsän Salesforcen jatkuvuussuunnitelman tulisi siksi yhdistää liiketoimintaprosessit teknisiin riippuvuuksiin, määrittää varajärjestelmien omistajat, määritellä turvallinen uudelleenyrityskäyttäytyminen, pitää Salesforcen luottamuksen valvonta lähellä tapausten työnkulkua ja sisällyttää virallinen täsmäytysvaihe palvelun palauttamisen jälkeen. Hyödyllisin mittari ei ole yksinkertaisesti "aika, kunnes Salesforce muuttui vihreäksi". Se on aika, joka kuluu siihen, kunnes liiketoimintaprosessi on varmistettu alusta loppuun ja ruuhka on turvallisesti poistettu.
Viite ja rajoitukset
Tämä retrospektiivi laadittiin Salesforcen omista luottamus- ja tukitiedoista ja keskittyy valittuihin vuoden 2025 tapahtumiin. Salesforce julkaisi vuoden aikana monia muita tapahtumailmoituksia, mukaan lukien lyhyempiä ja suppeammin käsiteltyjä tapahtumia. Joitakin luottamussivuja päivitettiin alkuperäisen tapahtuman jälkeen vaikutusikkunoiden ja vaurioituneiden komponenttien selventämisen myötä. Katso palvelun nykyinen tila Salesforcen luottamustilasta historiallisen artikkelin sijaan.