sql >> Base de Datos >  >> RDS >> Sqlserver

Cálculo del tiempo de duración de SQL

En varias ocasiones he hecho algo similar. Esencialmente, agrupación basada en separaciones dentro de un ordenamiento complejo. Los conceptos básicos del enfoque que utilizo, con respecto a este problema, son los siguientes:

  1. Cree una tabla de todos los rangos de tiempo de interés.
  2. Encuentre la hora de inicio para cada grupo de intervalos de tiempo de interés.
  3. Encuentre la hora de finalización para cada grupo de intervalos de tiempo de interés.
  4. Incorpore las horas de inicio y finalización a la lista de intervalos de tiempo y grupo.

O, con más detalle:(cada uno de estos pasos podría ser parte de un gran CTE, pero lo he dividido en tablas temporales para facilitar la lectura...)

Paso 1:encuentre la lista de todos los rangos de tiempo de interés (utilicé un método similar al vinculado por @Brad). NOTA:como señaló @Manfred Sorg, esto supone que no hay "segundos faltantes" en los datos de un bus. Si hay una interrupción en las marcas de tiempo, este código interpretará el rango único como dos (o más) rangos distintos.

;with stopSeconds as (
  select BusID, BusStopID, TimeStamp,
         [date] = cast(datediff(dd,0,TimeStamp) as datetime),
         [grp] = dateadd(ss, -row_number() over(partition by BusID order by TimeStamp), TimeStamp)
  from #test
  where BusStopID is not null
)
select BusID, BusStopID, date,
       [sTime] = dateadd(ss,datediff(ss,date,min(TimeStamp)), 0),
       [eTime] = dateadd(ss,datediff(ss,date,max(TimeStamp)), 0),
       [secondsOfStop] = datediff(ss, min(TimeStamp), max(Timestamp)),
       [sOrd] = row_number() over(partition by BusID, BusStopID order by datediff(ss,date,min(TimeStamp))),
       [eOrd] = row_number() over(partition by BusID, BusStopID order by datediff(ss,date,max(TimeStamp)))
into #ranges
from stopSeconds
group by BusID, BusStopID, date, grp

Paso 2:encuentre la hora más temprana para cada parada

select this.BusID, this.BusStopID, this.sTime minSTime,
       [stopOrder] = row_number() over(partition by this.BusID, this.BusStopID order by this.sTime)
into #starts
from #ranges this
  left join #ranges prev on this.BusID = prev.BusID
                        and this.BusStopID = prev.BusStopID
                        and this.sOrd = prev.sOrd+1
                        and this.sTime between dateadd(mi,-10,prev.sTime) and dateadd(mi,10,prev.sTime)
where prev.BusID is null

Paso 3:encuentre la última hora para cada parada

select this.BusID, this.BusStopID, this.eTime maxETime,
       [stopOrder] = row_number() over(partition by this.BusID, this.BusStopID order by this.eTime)
into #ends
from #ranges this
  left join #ranges next on this.BusID = next.BusID
                        and this.BusStopID = next.BusStopID
                        and this.eOrd = next.eOrd-1
                        and this.eTime between dateadd(mi,-10,next.eTime) and dateadd(mi,10,next.eTime)
where next.BusID is null

Paso 4:Une todo

select r.BusID, r.BusStopID,
       [avgLengthOfStop] = avg(datediff(ss,r.sTime,r.eTime)),
       [earliestStop] = min(r.sTime),
       [latestDepart] = max(r.eTime)
from #starts s
  join #ends e on s.BusID=e.BusID
              and s.BusStopID=e.BusStopID
              and s.stopOrder=e.stopOrder
  join #ranges r on r.BusID=s.BusID
                and r.BusStopID=s.BusStopID
                and r.sTime between s.minSTime and e.maxETime
                and r.eTime between s.minSTime and e.maxETime
group by r.BusID, r.BusStopID, s.stopOrder
having count(distinct r.date) > 1 --filters out the "noise"

Finalmente, para estar completo, ordenar:

drop table #ends
drop table #starts
drop table #ranges