Álgebra lineal: operaciones e identidades de inversión
Vectores y matrices son el lenguaje del caso multivariado. Acá juntamos las pocas identidades que se usan todo el tiempo —cómo se transpone e invierte un producto, qué propiedades tienen las formas cuadráticas, y dos lemas que evitan reinvertir matrices enteras cuando solo cambia un pedacito.
Transpuesta e inversa de un producto
La regla central: transponer (o invertir) un producto invierte el orden de los factores.
El error típico es escribir —que en general es falso. Cambiá las entradas y miralo:
Transponer (o invertir) un producto invierte el orden de los factores: (AB)ᵀ = BᵀAᵀ, no AᵀBᵀ. Cambiá las entradas: el orden invertido coincide siempre; el orden ingenuo, casi nunca (salvo casos especiales). Lo mismo vale para la inversa: (AB)⁻¹ = B⁻¹A⁻¹ —primero deshacés lo último que hiciste, como sacarse zapatos antes que medias.
La intuición de la inversa es física: para deshacer "ponerse medias y después zapatos", primero te sacás los zapatos. Conviene tener también (se anota ), y que para una matriz simétrica —el caso de covarianzas y precisiones.
Propiedades de las formas cuadráticas
Una forma cuadrática es un escalar . Dos hechos la gobiernan:
Solo importa la parte simétrica. Como el resultado es un número (igual a su transpuesta), , y por lo tanto
Cualquier parte antisimétrica se cancela, así que siempre se puede suponer simétrica. Su definición se lee en los autovalores: simétrica es definida positiva ( para todo ) si y solo si todos sus autovalores son positivos —el análogo vectorial de "" en una parábola.
El gradiente. Las derivadas matriciales que más se usan:
De acá sale, en una línea, por qué minimizar un cuadrático es resolver un sistema lineal:
Son las ecuaciones normales de mínimos cuadrados, y el mismo que apareció al completar el cuadrado en dimensiones.
Identidades de inversión
Invertir una matriz cuesta . Pero muchas veces ya tenés y a solo le cambia un pedazo de rango bajo. Reinvertir todo sería un desperdicio —y para eso están estas dos identidades.
Sherman–Morrison (corrección de rango 1)
Si actualizás con un término (rango 1):
Todo el lado derecho usa el que ya tenías más unos pocos productos matriz-vector: el costo baja de a . El único punto delicado es el denominador : si se anula, la matriz actualizada es singular y no hay inversa. Movélo hacia cero y miralo:
Si ya tenés A⁻¹ y a A le sumás una corrección de rango 1 (uvᵀ), no hace falta reinvertir desde cero: (A + uvᵀ)⁻¹ = A⁻¹ − (A⁻¹u vᵀA⁻¹)/(1 + vᵀA⁻¹u). Las dos columnas coinciden siempre —pero la directa cuesta O(n³) y la fórmula solo O(n²). El único peligro es que el denominador 1 + vᵀA⁻¹u se haga cero: ahí la matriz actualizada deja de ser invertible.
Identidad de Woodbury (rango )
Es la generalización a una corrección de rango , con de , de y de :
Sherman–Morrison es el caso , , . La ganancia es la misma idea a lo grande: en vez de invertir la matriz grande , solo hay que invertir la chica del paréntesis. Cuando , es un ahorro enorme —y es exactamente lo que hace que la actualización recursiva de mínimos cuadrados, la ganancia de un filtro de Kalman y las actualizaciones de procesos gaussianos sean baratas paso a paso, sin reinvertir nada.
Cierre del bloque
Con esto, la sección de Álgebra recorre el camino completo: manipular expresiones (productos notables, factorización, fracciones), completar el cuadrado (escalar y matricial), exponenciales, logaritmos y series, y la caja de herramientas de álgebra lineal. Es la base algebraica sobre la que se apoya toda la pista de probabilidad e inferencia estadística.