Vettori e spazio geometrico
In breve
L'algebra lineare nasce da un'idea fisica e geometrica semplicissima: il vettore, una freccia che ha una lunghezza e una direzione. Con i vettori si descrivono forze, velocità, spostamenti — tutto ciò che "ha un verso". Ma la vera potenza arriva quando si scopre che un vettore si può scrivere come una lista di numeri (le sue componenti) e che le operazioni geometriche (sommare frecce, allungarle) diventano operazioni numeriche. Questo capitolo costruisce il ponte tra la geometria (frecce nello spazio) e l'algebra (liste di numeri): somma di vettori, moltiplicazione per uno scalare, prodotto scalare (che misura angoli) e prodotto vettoriale (che dà aree e direzioni perpendicolari). Sono i mattoni di tutto il corso.
🎯 Alla fine di questo capitolo saprai: cos'è un vettore e come si rappresenta con componenti; come si fanno somma e prodotto per uno scalare; cosa misurano il prodotto scalare (angoli, ortogonalità) e il prodotto vettoriale (area, direzione perpendicolare); e cosa significa norma di un vettore.
Che cos'è un vettore
Perché conta: il vettore è l'oggetto elementare di tutta l'algebra lineare; capirlo bene in dimensione 2 e 3 rende naturale tutto il resto.
Molte grandezze si descrivono con un solo numero: la temperatura, la massa, il tempo. Si chiamano scalari. Ma altre grandezze hanno bisogno anche di una direzione: una forza spinge verso qualcosa, una velocità va in un verso. Queste sono grandezze vettoriali, e si rappresentano con un vettore: geometricamente, una freccia caratterizzata da tre cose — un modulo (la lunghezza), una direzione (la retta su cui giace) e un verso (da che parte punta).
Il salto decisivo è passare dalla freccia ai numeri. Fissato un sistema di riferimento (assi cartesiani), ogni vettore si scrive come una lista ordinata di numeri, le sue componenti: nel piano , nello spazio . Le componenti dicono "di quanto ci si sposta lungo ciascun asse". Un vettore di è semplicemente una lista di numeri: . Da qui in poi "vettore" e "lista di numeri" sono la stessa cosa vista da due lati: geometrico e algebrico.
🔗 Analogia. Un vettore è come un'istruzione di spostamento su una mappa: "3 isolati a est e 2 a nord". Il punto di partenza non conta (l'istruzione è la stessa ovunque parti): contano solo quanto e in che direzione. Le componenti sono esattamente questa istruzione. Due frecce diverse sul foglio, ma con lo stesso "3 a est, 2 a nord", sono lo stesso vettore.
Somma e prodotto per uno scalare
Perché conta: queste due operazioni sono il "motore" dell'intera algebra lineare; da esse nasce la nozione di combinazione lineare, onnipresente nel corso.
Con i vettori si fanno due operazioni fondamentali, entrambe con un significato geometrico limpido.
La somma si calcola sommando componente per componente: . Geometricamente è la regola del parallelogramma (o "testa-coda"): metti la coda di sulla punta di ; la freccia che va dalla coda di alla punta di è la somma. È il risultato di "prima lo spostamento , poi lo spostamento ".
La moltiplicazione per uno scalare moltiplica ogni componente per il numero : . Geometricamente allunga (o accorcia) il vettore del fattore , senza cambiarne la direzione; se , ne inverte il verso. Con raddoppia, con dimezza, con lo capovolge.
Da queste due operazioni nasce il concetto più importante di tutto il corso: la combinazione lineare. Una combinazione lineare dei vettori è una scrittura del tipo cioè: allunga ciascun vettore per un suo scalare e somma tutto. "Combinare linearmente" significa costruire nuovi vettori a partire da alcuni dati usando solo queste due operazioni. Vedremo che quasi ogni domanda dell'algebra lineare ("questo vettore si può ottenere da quelli?", "questi sono indipendenti?") è una domanda sulle combinazioni lineari.
🧩 Esempio. Siano e . Allora ; ; e la combinazione lineare . Ogni scelta dei coefficienti dà un vettore diverso: al variare di , tutte le combinazioni riempiono l'intero piano (perché e non sono paralleli).
Norma e prodotto scalare
Perché conta: il prodotto scalare è lo strumento che introduce lunghezze e angoli nell'algebra lineare; senza di esso non potremmo parlare di ortogonalità.
Finora abbiamo sommato e allungato vettori, ma non abbiamo ancora misurato lunghezze e angoli. Lo strumento che li introduce è il prodotto scalare (o prodotto interno). Dati due vettori, il prodotto scalare è un numero (uno scalare, da cui il nome), definito come somma dei prodotti delle componenti:
Da esso discende la norma (o modulo, la lunghezza) di un vettore: . Nel piano è semplicemente il teorema di Pitagora: la lunghezza della freccia è .
Ma il prodotto scalare fa molto di più: è legato all'angolo tra i due vettori dalla formula Questa formula è potentissima. Ci dice tra l'altro che il segno del prodotto scalare rivela l'angolo: positivo se acuto (), negativo se ottuso, nullo se retto. Ecco il fatto più usato in assoluto: L'ortogonalità — cardine di tutta la geometria e di gran parte dell'algebra lineare — si riduce così a un semplice conto: il prodotto scalare è zero.
⚠️ Attenzione. Non confondere prodotto scalare (dà un numero, misura angoli/lunghezze) e prodotto per uno scalare (moltiplica un vettore per un numero, dà un vettore). Nomi simili, oggetti diversissimi. E occhio: il prodotto scalare non è "componente per componente" (quello darebbe un vettore); è la somma di quei prodotti (dà un numero).
Il prodotto vettoriale (nello spazio)
Perché conta: dà una direzione perpendicolare a due vettori e misura aree; ricorre in fisica (momento, campo magnetico) e in geometria dello spazio.
Solo nello spazio tridimensionale esiste una terza operazione, il prodotto vettoriale . A differenza del prodotto scalare, il risultato è un vettore, con tre proprietà caratteristiche:
- è perpendicolare a entrambi i vettori e (esce dal piano che essi individuano);
- il suo verso è dato dalla "regola della mano destra";
- il suo modulo vale , che è esattamente l'area del parallelogramma costruito su e .
Ne segue un criterio utile: se e solo se i due vettori sono paralleli (allineati), perché allora l'area del parallelogramma è nulla. Il prodotto vettoriale è quindi il "gemello" del prodotto scalare: quello si annulla per vettori perpendicolari, questo per vettori paralleli. Insieme, i due prodotti catturano tutta l'informazione geometrica sulla posizione reciproca di due vettori.
🗺️ Come si collega il tutto
Questo capitolo costruisce il ponte tra geometria e algebra: un vettore è insieme una freccia (modulo, direzione, verso) e una lista di componenti in . Le due operazioni base — somma e prodotto per uno scalare — generano il concetto-chiave dell'intero corso, la combinazione lineare, che ritroveremo negli spazi vettoriali (cap. 5), nell'indipendenza lineare e nelle basi (cap. 6). Il prodotto scalare introduce lunghezze e angoli, e soprattutto l'ortogonalità (), che sarà il cuore del cap. 10 (basi ortonormali, proiezioni). Il prodotto vettoriale dà aree e direzioni perpendicolari, utile nella geometria di rette e piani (cap. 11). Il passo successivo è organizzare più vettori in una tabella di numeri — la matrice (cap. 2) — e scoprire che rappresenta una trasformazione dello spazio.
🔑 Concetti chiave
| Termine | In una frase | Da non confondere con |
|---|---|---|
| Vettore | Freccia = lista di componenti : modulo, direzione, verso | Scalare (un solo numero, senza direzione) |
| Combinazione lineare | : allunga e somma | (è il concetto centrale del corso) |
| Prodotto per scalare | : allunga/inverte il vettore → dà un vettore | Prodotto scalare (dà un numero) |
| Prodotto scalare | → numero; misura angoli | Prodotto vettoriale (dà un vettore) |
| Norma | : la lunghezza (Pitagora) | (è un numero ) |
| Ortogonalità | perpendicolari | Parallelismo () |
| Prodotto vettoriale | (solo in ): perpendicolare, modulo = area | Prodotto scalare (numero, non vettore) |
📝 Riepilogo
- Un vettore rappresenta una grandezza con direzione (forza, velocità, spostamento): geometricamente una freccia (modulo, direzione, verso), algebricamente una lista di componenti in . Geometria e algebra sono due facce dello stesso oggetto.
- Le operazioni base sono somma (componente per componente, regola del parallelogramma) e prodotto per uno scalare (: allunga/accorcia/inverte). Da esse nasce la combinazione lineare , concetto centrale di tutto il corso.
- Il prodotto scalare è un numero: dà la norma (Pitagora) e l'angolo (). Fatto chiave: ortogonali.
- Il prodotto vettoriale (solo in ) dà un vettore perpendicolare a entrambi, di modulo pari all'area del parallelogramma; si annulla se i vettori sono paralleli. Prossimo passo: le matrici (cap. 2).
Geometria e Algebra Lineare
Hai letto. Ora impara.
L'AI trasforma questo modulo in strumenti di studio personalizzati.
Matrici e operazioni tra matrici
In breve
Una matrice è una tabella rettangolare di numeri. Detta così sembra un semplice contenitore, ma è molto di più: una matrice è il modo in cui si scrive una trasformazione dello spazio (una rotazione, una dilatazione, una proiezione) e insieme il modo in cui si impacchettano i coefficienti di un sistema di equazioni lineari. Questi due volti — matrice come trasformazione e matrice come tabella di coefficienti — attraversano tutto il corso. In questo capitolo impariamo a maneggiare le matrici: come si sommano, si moltiplicano per uno scalare e — operazione cruciale e sorprendente — come si moltiplicano tra loro. Il prodotto tra matrici, con la sua regola "riga per colonna", è il cuore pulsante dell'algebra lineare.
🎯 Alla fine di questo capitolo saprai: cos'è una matrice e la sua terminologia (righe, colonne, tipi); come si fanno somma, prodotto per scalare e trasposta; come funziona il prodotto righe-per-colonne e perché non è commutativo; il ruolo della matrice identità.
Che cos'è una matrice
Perché conta: la matrice è lo strumento di calcolo centrale del corso; ogni sistema lineare e ogni applicazione lineare si scrive con una matrice.
Una matrice è una tabella rettangolare di numeri disposti in righe e colonne; si dice allora di tipo (o dimensione) . Il numero nella riga e colonna si indica (prima l'indice di riga, poi quello di colonna). Per esempio, è una matrice (2 righe, 3 colonne), e (riga 2, colonna 3).
Alcuni tipi hanno nomi propri: una matrice quadrata ha lo stesso numero di righe e colonne (); un vettore colonna è una matrice (una sola colonna) e un vettore riga una . La diagonale principale di una matrice quadrata è la sequenza degli elementi (dall'angolo in alto a sinistra in giù). Una matrice diagonale ha tutti gli elementi nulli fuori dalla diagonale; una triangolare ha tutti zeri sotto (o sopra) la diagonale.
Perché tutto questo apparato? Perché una matrice è un doppio oggetto: (1) una collezione ordinata di vettori (le sue righe o le sue colonne), e (2), come vedremo, la "ricetta" di una trasformazione che manda vettori in vettori. Tenere a mente questi due significati rende ogni operazione naturale invece che meccanica.
🔗 Analogia. Una matrice è come un foglio di calcolo (una tabella con righe e colonne di numeri). Ma è un foglio "attivo": non solo conserva dati, ma agisce — moltiplicandolo per un vettore, lo trasforma. Come una macchina fotografica che prende una scena (il vettore in ingresso) e ne produce una versione modificata (ruotata, ingrandita, deformata).
Somma, prodotto per scalare, trasposta
Perché conta: sono le operazioni elementari; semplici, ma con la trasposta che ricorre in ortogonalità e matrici simmetriche.
Le operazioni "facili" sulle matrici funzionano componente per componente, come per i vettori:
- Somma : si sommano gli elementi corrispondenti, . Richiede che e abbiano lo stesso tipo (stesse righe e colonne): non si sommano tabelle di forma diversa.
- Prodotto per uno scalare : si moltiplica ogni elemento per .
Una terza operazione, all'apparenza banale ma importantissima, è la trasposta : si ottiene scambiando righe e colonne (la riga diventa la colonna ). Se è , allora è , e . Per esempio, la trasposta della vista sopra () è una matrice . La trasposta introduce un concetto che ritroveremo spesso: una matrice quadrata si dice simmetrica se (è "specchiata" rispetto alla diagonale, cioè ). Le matrici simmetriche hanno proprietà eccezionali (cap. 9-10).
Il prodotto tra matrici
Perché conta: è l'operazione centrale dell'algebra lineare; corrisponde alla composizione di trasformazioni e non si comporta come la moltiplicazione tra numeri.
Ed eccoci all'operazione cruciale: il prodotto di due matrici . Non si fa "elemento per elemento" (sarebbe inutile); si fa con la regola riga per colonna: l'elemento di posto del prodotto è il prodotto scalare della riga di con la colonna di :
Da questa regola nasce un vincolo fondamentale sulle dimensioni: si moltiplica (di tipo ) per (di tipo ) solo se il numero di colonne di è uguale al numero di righe di (le "" devono combaciare, perché riga e colonna devono avere la stessa lunghezza per farne il prodotto scalare). Il risultato è di tipo . In sintesi: .
Perché una regola così strana? Perché corrisponde alla composizione di trasformazioni: se trasforma lo spazio in un modo e in un altro, la matrice è la trasformazione "prima , poi " (una dopo l'altra). Il prodotto riga-per-colonna è precisamente ciò che fa combaciare i conti quando si applicano due trasformazioni in sequenza. Tornerà chiaro nel cap. 7.
🧩 Esempio. Moltiplichiamo per (entrambe ). L'elemento è riga 1 di per colonna 1 di : . L'elemento : . L'elemento : . L'elemento : . Dunque
Non commutatività e matrice identità
Perché conta: la non commutatività è la differenza più importante tra matrici e numeri; l'identità è l'elemento neutro, base della nozione di inversa.
Il prodotto tra matrici ha una proprietà che rompe l'intuizione costruita sui numeri: non è commutativo. In generale L'ordine conta! Spesso addirittura uno dei due prodotti esiste e l'altro no (per le dimensioni), o danno matrici di tipo diverso. Anche quando entrambi esistono e hanno lo stesso tipo, i risultati sono di norma diversi. Questo ha senso pensando alle trasformazioni: "ruota poi rifletti" dà un risultato diverso da "rifletti poi ruota". È una delle prime cose a cui abituarsi: con le matrici l'ordine dei fattori non si può scambiare.
Esiste però un elemento speciale che si comporta da "1": la matrice identità , la matrice quadrata con tutti 1 sulla diagonale e 0 altrove: L'identità è l'elemento neutro del prodotto: per ogni matrice (di dimensioni compatibili). Come trasformazione, è la trasformazione che "non fa nulla" (lascia ogni vettore dov'è). Il suo ruolo è centrale perché permette di definire la matrice inversa (cap. 3): sarà la matrice che, moltiplicata per , dà — cioè "annulla" l'effetto di , esattamente come per i numeri.
⚠️ Attenzione. Con le matrici cadono due regole valide per i numeri. Primo: (non commutatività). Secondo: non implica che o (esistono matrici non nulle il cui prodotto è la matrice nulla!). Non si può quindi "semplificare" liberamente come coi numeri. Il prodotto è invece associativo: , e questo vale sempre.
🗺️ Come si collega il tutto
La matrice ha due volti che percorrono tutto il corso: tabella di coefficienti di un sistema lineare (cap. 4) e "ricetta" di una trasformazione dello spazio (cap. 7). Le operazioni facili (somma, prodotto per scalare, trasposta) si fanno componente per componente; la trasposta introduce le matrici simmetriche (), protagoniste dei cap. 9-10. Il prodotto righe-per-colonne è l'operazione centrale: corrisponde alla composizione di trasformazioni, e la sua non commutatività () è la caratteristica più tipica. La matrice identità è l'elemento neutro e apre la strada alla matrice inversa (cap. 3), che a sua volta serve a risolvere i sistemi lineari. Il passo successivo è misurare una matrice quadrata con un solo numero — il determinante — che dirà se è invertibile.
🔑 Concetti chiave
| Termine | In una frase | Da non confondere con |
|---|---|---|
| Matrice | Tabella di numeri: righe, colonne | Vettore (matrice con una sola riga/colonna) |
| Trasposta | Scambia righe e colonne | Inversa (annulla , cosa diversa) |
| Simmetrica | : specchiata sulla diagonale | Diagonale (zeri fuori dalla diagonale) |
| Prodotto | Riga di · colonna di ; serve | Prodotto per scalare (moltiplica ogni elemento) |
| Non commutatività | In generale : l'ordine conta | (per i numeri invece ) |
| Identità | 1 sulla diagonale, 0 altrove; | Matrice nulla (tutti 0, elemento neutro della somma) |
📝 Riepilogo
- Una matrice è una tabella di numeri ( righe, colonne); l'elemento sta in riga , colonna . Casi speciali: quadrata (), diagonale, triangolare, vettore riga/colonna. Doppio significato: tabella di coefficienti e trasformazione dello spazio.
- Operazioni "facili" (componente per componente): somma (solo stesso tipo), prodotto per scalare , trasposta (scambia righe↔colonne). Una matrice è simmetrica se .
- Il prodotto segue la regola riga per colonna (); si può fare solo se le colonne di = righe di , e . Corrisponde alla composizione di trasformazioni.
- Il prodotto è associativo ma non commutativo () e non implica o . La matrice identità (1 sulla diagonale) è l'elemento neutro () e apre la via alla matrice inversa (cap. 3). Prossimo passo: il determinante.
Geometria e Algebra Lineare
Hai letto. Ora impara.
L'AI trasforma questo modulo in strumenti di studio personalizzati.
Determinante e matrice inversa
In breve
Il determinante è un numero che si associa a ogni matrice quadrata e ne riassume una proprietà geometrica profonda: quanto la trasformazione descritta dalla matrice dilata (o comprime) i volumi. Ma il suo uso più immediato è un test: il determinante ci dice, con un solo conto, se una matrice è invertibile — cioè se la sua trasformazione si può "annullare" tornando indietro. Questo capitolo definisce il determinante (per matrici , e in generale), ne spiega il significato geometrico come area/volume, e introduce la matrice inversa , il "reciproco" di una matrice, che esiste esattamente quando il determinante è diverso da zero.
🎯 Alla fine di questo capitolo saprai: cos'è il determinante e come si calcola (, , Laplace); il suo significato geometrico (fattore di dilatazione di area/volume); il criterio invertibile; cos'è la matrice inversa e a cosa serve.
Il determinante e il suo significato
Perché conta: il determinante è l'indicatore che collega calcolo e geometria; da esso dipendono invertibilità, indipendenza lineare e molto altro.
A ogni matrice quadrata si associa un numero, il determinante (scritto anche ). Per le matrici piccole c'è una formula esplicita.
Per una matrice :
Per una matrice c'è la regola di Sarrus (prodotti delle diagonali "discendenti" meno prodotti delle "ascendenti"):
Al di là delle formule, ciò che conta è il significato. Il determinante misura quanto la trasformazione associata alla matrice dilata le aree (in 2D) o i volumi (in 3D). Prendi il quadrato unitario di area 1: applicando la matrice , diventa un parallelogramma la cui area è esattamente . Se , la trasformazione triplica le aree; se , le dimezza. Il segno del determinante indica se la trasformazione conserva o inverte l'orientazione (come uno specchio che scambia destra e sinistra).
Il caso più importante è . Significa che la trasformazione schiaccia lo spazio in una dimensione inferiore (il quadrato viene "appiattito" su un segmento, area zero). Quando questo accade, l'informazione va persa in modo irreversibile: non si può più "tornare indietro". Ecco perché — come vedremo — è esattamente la condizione di non invertibilità.
🔗 Analogia. Il determinante è come il fattore di scala di una fotocopiatrice. Impostata al 200% (det = 4 in area, cioè ) ingrandisce; al 50% rimpicciolisce. Ma se la fotocopiatrice "schiaccia" l'immagine fino a ridurla a una linea (det = 0), hai perso il documento: da una linea non puoi ricostruire la pagina. Un determinante nullo è una fotocopia irrimediabilmente rovinata.
Calcolo per matrici grandi: sviluppo di Laplace
Perché conta: per matrici oltre il serve un metodo sistematico; lo sviluppo di Laplace lo fornisce e chiarisce la struttura ricorsiva del determinante.
Per matrici con non c'è una formula "a diagonali"; si usa lo sviluppo di Laplace (per righe o colonne), che riduce il calcolo a determinanti più piccoli. L'idea: si sceglie una riga (o colonna) e si sommano, con segni alternati, i prodotti di ciascun elemento per il determinante della sottomatrice ottenuta cancellando la sua riga e la sua colonna (il suo minore complementare). I segni seguono lo schema a scacchiera : dove è il minore complementare. È un procedimento ricorsivo: un si riduce a quattro , ciascuno a tre .
Un consiglio pratico decisivo: conviene sviluppare lungo la riga o colonna con più zeri, perché gli elementi nulli annullano interi termini e riducono i conti. Utile anche sapere che il determinante di una matrice triangolare (tutti zeri sotto o sopra la diagonale) è semplicemente il prodotto degli elementi diagonali — un caso in cui il conto è immediato. Questo suggerisce una strategia (cap. 4): ridurre una matrice a forma triangolare per calcolarne facilmente il determinante.
La matrice inversa
Perché conta: l'inversa è ciò che permette di "annullare" una trasformazione e di risolvere sistemi lineari; il determinante ne governa l'esistenza.
Per i numeri, ogni ha un reciproco tale che . L'analogo per le matrici è la matrice inversa. Data una matrice quadrata , la sua inversa (quando esiste) è l'unica matrice tale che dove è l'identità. Geometricamente, è la trasformazione che annulla l'effetto di : se ruota di 30°, ruota di e riporta tutto al punto di partenza.
Ma non tutte le matrici hanno un'inversa. Una matrice si dice invertibile (o non singolare) se ammette inversa, singolare se non la ammette. Ed ecco il legame fondamentale con il determinante — uno dei teoremi cardine del corso: La ragione è quella geometrica vista sopra: se , la trasformazione schiaccia lo spazio e perde informazione, quindi non è "reversibile"; se , nessuna informazione va persa e si può tornare indietro. Per una matrice c'è una formula esplicita: in cui si vede a occhio nudo il ruolo del determinante: se la formula esplode (divisione per zero) — l'inversa non esiste.
🧩 Esempio. Sia . Il determinante è : la matrice è invertibile. Applicando la formula: . Verifica: . ✓
⚠️ Attenzione. Non esiste la "divisione tra matrici"! Al posto di si scrive oppure — e i due sono in generale diversi (non commutatività, cap. 2), quindi bisogna stare attenti da che lato si moltiplica. Inoltre l'inversa esiste solo per matrici quadrate e solo se : prima di invertire, controlla sempre il determinante.
🗺️ Come si collega il tutto
Il determinante è il numero che condensa la geometria di una matrice quadrata: misura il fattore di dilatazione di area/volume della sua trasformazione (cap. 7). Il caso segnala che lo spazio viene schiacciato: è la condizione di non invertibilità e, come vedremo, di dipendenza lineare delle colonne (cap. 6) e di esistenza di autovalore nullo (cap. 8). La matrice inversa annulla la trasformazione e permette di risolvere i sistemi scrivendo (cap. 4). Il criterio invertibile lega calcolo e geometria ed è uno dei perni dell'intero corso. Il passo successivo è usare questi strumenti per risolvere in modo sistematico i sistemi lineari (cap. 4), col metodo di Gauss.
🔑 Concetti chiave
| Termine | In una frase | Da non confondere con |
|---|---|---|
| Determinante | Numero (solo per matrici quadrate): fattore di dilatazione area/volume | Traccia (somma degli elementi diagonali) |
| Trasformazione che schiaccia lo spazio → non invertibile | (invertibile, "reversibile") | |
| Sviluppo di Laplace | Calcolo ricorsivo per righe/colonne con segni | Sarrus (solo per ) |
| Matrice inversa | : annulla la trasformazione | Trasposta (scambia righe/colonne) |
| Invertibile / singolare | Ha / non ha inversa; invertibile | (singolare = det nullo = non invertibile) |
📝 Riepilogo
- Il determinante è un numero associato a una matrice quadrata. Formule: → ; → regola di Sarrus; caso generale → sviluppo di Laplace (ricorsivo, per righe/colonne, segni , meglio dove ci sono più zeri). Per una matrice triangolare è il prodotto degli elementi diagonali.
- Significato geometrico: è il fattore di dilatazione di aree (2D) / volumi (3D) della trasformazione; il segno indica se l'orientazione è conservata o invertita. significa che lo spazio viene schiacciato (informazione persa).
- La matrice inversa soddisfa : è la trasformazione che annulla . Criterio fondamentale: è invertibile (altrimenti è singolare). Formula : A^{-1}=\frac{1}{\det A}\begin{psmallmatrix} d & -b \\ -c & a\end{psmallmatrix}.
- Non esiste "divisione tra matrici": si usa , facendo attenzione al lato (non commutatività). L'inversa serve a risolvere come . Prossimo passo: i sistemi lineari e il metodo di Gauss (cap. 4).
Geometria e Algebra Lineare
Hai letto. Ora impara.
L'AI trasforma questo modulo in strumenti di studio personalizzati.
Sistemi lineari e metodo di Gauss
In breve
Un sistema lineare è un insieme di equazioni di primo grado in più incognite: il problema più antico e più applicativo di tutta la matematica (bilanciare reazioni chimiche, dimensionare strutture, risolvere circuiti). L'algebra lineare gli dà una forma compatta e potente: ogni sistema si scrive come , con matrice dei coefficienti, vettore delle incognite, vettore dei termini noti. Questo capitolo mostra il metodo universale per risolverli — l'eliminazione di Gauss — e il teorema che dice quando un sistema ha soluzione e quante ne ha: il teorema di Rouché-Capelli, basato sul concetto di rango.
🎯 Alla fine di questo capitolo saprai: scrivere un sistema in forma matriciale ; risolverlo con l'eliminazione di Gauss (operazioni elementari, forma a scalini); il concetto di rango; il teorema di Rouché-Capelli (esistenza e numero delle soluzioni); la differenza tra sistema determinato, indeterminato, impossibile.
Sistemi lineari in forma matriciale
Perché conta: la scrittura unifica tutti i sistemi lineari in un unico oggetto e collega il problema a matrici, determinanti e inverse.
Un sistema lineare di equazioni in incognite ha la forma "Lineare" significa che le incognite compaiono solo al primo grado (nessun , nessun prodotto , nessun seno o esponenziale). Questa restrizione, apparentemente limitante, è ciò che rende il problema completamente risolubile.
Il colpo di genio dell'algebra lineare è impacchettare tutto in forma matriciale: dove è la matrice dei coefficienti (, tutti gli ), il vettore colonna delle incognite, il vettore colonna dei termini noti. Grazie alla regola del prodotto riga-per-colonna (cap. 2), il prodotto ricostruisce esattamente i primi membri delle equazioni. Un sistema con si dice omogeneo (ha sempre almeno la soluzione banale ).
Questa forma apre subito una strada: se è quadrata e invertibile (), si può moltiplicare a sinistra per ottenendo — soluzione unica, bell'e pronta. Ma questo è solo il caso più fortunato; in generale servono strumenti più flessibili, perché può non essere quadrata o avere determinante nullo.
🔗 Analogia. Un sistema lineare è come una ricetta con vincoli: "il totale di zucchero deve essere 200g, quello di farina 500g...". Ogni equazione è un vincolo; le incognite sono le quantità di ciascun ingrediente. Risolvere il sistema è trovare le dosi che rispettano tutti i vincoli contemporaneamente. A volte c'è un'unica ricetta possibile, a volte infinite, a volte nessuna: esattamente i tre casi che studieremo.
L'eliminazione di Gauss
Perché conta: è l'algoritmo universale per risolvere qualsiasi sistema lineare, semplice, meccanico e sempre funzionante.
Il metodo generale per risolvere un sistema è l'eliminazione di Gauss. L'idea: trasformare il sistema in uno equivalente (con le stesse soluzioni) ma più semplice, "a scalini", che si risolve a vista. Gli strumenti sono le operazioni elementari sulle righe, che non cambiano le soluzioni:
- scambiare due righe (equazioni);
- moltiplicare una riga per un numero ;
- sommare a una riga un multiplo di un'altra.
L'ultima è la mossa-chiave: sommando a un'equazione un opportuno multiplo di un'altra si può azzerare un coefficiente, cioè eliminare un'incognita da quell'equazione. Ripetendo, si porta la matrice (dei coefficienti + termini noti, detta matrice completa) in forma a scalini (triangolare): la prima equazione con tutte le incognite, la seconda con una in meno, e così via, fino a un'ultima equazione con una sola incognita.
A quel punto si procede a sostituzione all'indietro (back-substitution): l'ultima equazione dà subito l'ultima incognita; sostituendola nella penultima si trova la penultima; e così a ritroso fino alla prima. Il metodo è meccanico (sempre gli stessi passi), universale (funziona per qualsiasi sistema, anche non quadrato) e completo (rivela da solo se le soluzioni sono una, infinite o nessuna).
🧩 Esempio. Sistema . Eliminiamo dalla seconda: alla riga 2 sottraiamo la riga 1, ottenendo , cioè . Sostituzione all'indietro nella prima: . Soluzione unica: .
Il rango di una matrice
Perché conta: il rango è il numero che quantifica "quanta informazione indipendente" contiene una matrice; è la chiave del teorema di esistenza delle soluzioni.
Applicando Gauss, alcune righe possono annullarsi completamente (diventare ""): erano equazioni ridondanti, conseguenza delle altre, che non aggiungevano informazione. Questo porta a un concetto centrale: il rango di una matrice, indicato (o ), è il numero di righe non nulle che restano dopo la riduzione a scalini — cioè il numero di equazioni realmente indipendenti.
In modo equivalente (e più profondo, come si vedrà nel cap. 6), il rango è il numero massimo di righe — o di colonne — linearmente indipendenti. È una misura di "quanta informazione non ridondante" c'è nella matrice. Il rango non può superare né il numero di righe né quello di colonne: . Per una matrice quadrata , il rango è massimo () esattamente quando : rango pieno e invertibilità sono la stessa cosa.
Il rango si calcola proprio con Gauss (conta gli scalini) e si può anche legare ai determinanti: è la dimensione della più grande sottomatrice quadrata con determinante non nullo. Ma l'idea da tenere è semplice: il rango conta le equazioni che "contano davvero".
Il teorema di Rouché-Capelli
Perché conta: è il teorema che decide, prima ancora di risolvere, se un sistema ha soluzioni e quante; sintetizza tutta la teoria in una condizione sul rango.
Quando ha soluzione un sistema ? La risposta completa è il teorema di Rouché-Capelli. Servono due matrici: la matrice dei coefficienti e la matrice completa (la stessa con in più la colonna dei termini noti). Il teorema dice:
Il sistema ha soluzioni se e solo se (i due ranghi coincidono).
E in caso affermativo, il numero di soluzioni dipende dal confronto con (numero di incognite). Riassumendo i tre casi possibili:
- → sistema impossibile (nessuna soluzione): compare un'equazione contraddittoria del tipo "" con ;
- (= numero di incognite) → sistema determinato: una sola soluzione;
- → sistema indeterminato: infinite soluzioni, dipendenti da parametri liberi (i "gradi di libertà").
Questo teorema è potentissimo perché permette di classificare un sistema (quante soluzioni ha) prima di risolverlo, semplicemente confrontando due ranghi. E dà un'immagine geometrica chiara: le soluzioni di un sistema sono l'intersezione di tanti iperpiani (uno per equazione); possono incontrarsi in un punto (unica), lungo una retta/piano (infinite) o non incontrarsi affatto (impossibile).
⚠️ Attenzione. Il caso "infinite soluzioni" non significa "qualsiasi valore va bene": le soluzioni formano un insieme ben preciso, descritto da parametri (es. una retta nello spazio). E attenzione al sistema omogeneo (): non è mai impossibile (ha sempre ), ma ha soluzioni non banali — cioè infinite — se e solo se (in particolare, per quadrata, se ). Questo fatto tornerà centrale negli autovettori (cap. 8).
🗺️ Come si collega il tutto
Il sistema lineare, scritto , riunisce tutti gli strumenti visti finora: la matrice dei coefficienti (cap. 2), il determinante per il caso quadrato invertibile (, cap. 3). L'eliminazione di Gauss con le operazioni elementari è l'algoritmo universale di soluzione e definisce il rango (numero di equazioni indipendenti). Il teorema di Rouché-Capelli decide esistenza e numero di soluzioni confrontando i ranghi di e della completa. Il concetto di rango come "righe/colonne indipendenti" prepara direttamente l'idea di indipendenza lineare e dimensione negli spazi vettoriali (cap. 5-6); i sistemi omogenei con soluzioni non banali saranno la porta d'ingresso agli autovettori (cap. 8). Il passo successivo è astrarre: dalle liste di numeri di alla struttura generale di spazio vettoriale (cap. 5).
🔑 Concetti chiave
| Termine | In una frase | Da non confondere con |
|---|---|---|
| Sistema | Equazioni di 1° grado in forma matriciale | Equazione non lineare (con , prodotti…) |
| Omogeneo | : ha sempre la soluzione banale | Non omogeneo (può essere impossibile) |
| Eliminazione di Gauss | Operazioni elementari → forma a scalini → sostituzione all'indietro | (è un metodo, non una formula) |
| Rango | N° di equazioni/righe realmente indipendenti (scalini) | N° di incognite (il confronto decide il tipo) |
| Rouché-Capelli | Soluzioni $\iff \operatorname{rg}A=\operatorname{rg}[A | \mathbf b]$ |
| Determinato/indeterminato/impossibile | 1 / ∞ / 0 soluzioni | (dipendono dai ranghi e da ) |
📝 Riepilogo
- Un sistema lineare ( equazioni di 1° grado, incognite) si scrive in forma matriciale : coefficienti, incognite, termini noti. Se è quadrata e invertibile, (soluzione unica). Se è omogeneo (ha sempre ).
- L'eliminazione di Gauss risolve qualsiasi sistema: con le operazioni elementari (scambio, moltiplicazione, somma di righe) si porta la matrice completa a forma a scalini (triangolare), poi si risolve per sostituzione all'indietro. Metodo meccanico e universale.
- Il rango è il numero di righe non nulle dopo la riduzione = numero di equazioni/righe (o colonne) indipendenti. Per quadrata: rango massimo invertibile.
- Rouché-Capelli: il sistema ha soluzioni . Tre casi: ranghi diversi → impossibile; ranghi uguali → determinato (1 soluzione); ranghi uguali → indeterminato ( soluzioni, parametri). Prossimo passo: gli spazi vettoriali (cap. 5).
Geometria e Algebra Lineare
Hai letto. Ora impara.
L'AI trasforma questo modulo in strumenti di studio personalizzati.
Spazi vettoriali
In breve
Fin qui i vettori erano frecce o liste di numeri in . Ma il salto concettuale che dà all'algebra lineare la sua straordinaria potenza è l'astrazione: uno spazio vettoriale è qualsiasi insieme in cui si possano sommare gli elementi e moltiplicarli per uno scalare, rispettando poche regole naturali. Con questa definizione, scoprono di essere "vettori" oggetti che non hanno nulla di una freccia: i polinomi, le matrici, le funzioni. Tutti obbediscono alle stesse leggi, e quindi tutti i teoremi dimostrati per i vettori valgono automaticamente anche per loro. Questo capitolo introduce la definizione astratta di spazio vettoriale, i sottospazi e i concetti che preparano la nozione di dimensione: combinazione lineare, generatori, indipendenza lineare.
🎯 Alla fine di questo capitolo saprai: la definizione astratta di spazio vettoriale e perché è così potente; cos'è un sottospazio e come riconoscerlo; il significato di combinazione lineare, span (insieme generato), generatori; e la nozione cruciale di indipendenza lineare.
L'idea di spazio vettoriale
Perché conta: l'astrazione permette di trattare con un'unica teoria oggetti diversissimi (vettori, polinomi, matrici, funzioni); è ciò che rende l'algebra lineare universale.
Cosa hanno in comune le frecce nel piano, i polinomi e le matrici? Che con tutti si possono fare due operazioni: sommarli tra loro e moltiplicarli per un numero (uno scalare), ottenendo sempre un oggetto dello stesso tipo. Due polinomi sommati danno un polinomio; una matrice moltiplicata per 3 dà una matrice. L'algebra lineare astrae proprio questa struttura comune.
Uno spazio vettoriale (su ) è un insieme di oggetti — chiamati vettori, qualunque cosa siano — dotato di due operazioni, somma e prodotto per uno scalare, che soddisfano alcune regole naturali: la somma è commutativa e associativa, esiste un vettore nullo (elemento neutro), ogni vettore ha un opposto, e il prodotto per scalari si distribuisce bene rispetto alle somme (, ecc.). Non serve memorizzare l'elenco degli assiomi: l'idea è che siano le stesse proprietà che valgono per le frecce del cap. 1.
La forza di questa definizione è che, una volta verificato che un certo insieme è uno spazio vettoriale, tutti i teoremi dell'algebra lineare valgono automaticamente per esso. Esempi di spazi vettoriali oltre a : i polinomi di grado (si sommano, si moltiplicano per scalari); le matrici ; le funzioni continue su un intervallo. Tutti "spazi di vettori", benché nessuno sia fatto di frecce.
🔗 Analogia. "Spazio vettoriale" è come la parola "veicolo": astrae ciò che accomuna automobili, biciclette, navi e aerei (trasportano, si muovono, hanno una direzione), ignorando le differenze. Chi dimostra un teorema sui "veicoli" (es. "consumano energia per spostarsi") lo dimostra in un colpo solo per tutti. Allo stesso modo, un teorema sugli "spazi vettoriali" vale simultaneamente per frecce, polinomi, matrici e funzioni.
Sottospazi
Perché conta: i sottospazi sono gli "spazi dentro lo spazio"; riconoscerli è essenziale per descrivere soluzioni di sistemi, nuclei e immagini di applicazioni.
Dentro uno spazio vettoriale vivono spesso spazi più piccoli, che sono a loro volta spazi vettoriali: i sottospazi. Un sottospazio di è un sottoinsieme che è "chiuso" rispetto alle due operazioni, cioè: sommando due elementi di resti in , e moltiplicando un elemento di per uno scalare resti in . In formule, è sottospazio se: (1) contiene il vettore nullo ; (2) ; (3) .
L'intuizione geometrica in è limpida: i sottospazi sono le rette e i piani passanti per l'origine (più l'origine da sola e tutto ). Una retta non passante per l'origine non è un sottospazio: non contiene , e sommando due suoi punti si esce dalla retta. La condizione "passa per l'origine" è esattamente la traduzione geometrica della chiusura rispetto alle operazioni.
I sottospazi sono ovunque nel corso: l'insieme delle soluzioni di un sistema omogeneo è sempre un sottospazio (cap. 4); il nucleo e l'immagine di un'applicazione lineare (cap. 7) sono sottospazi. Riconoscere che un certo insieme è un sottospazio significa poter applicare a esso tutta la teoria (basi, dimensione, ecc.).
Combinazioni lineari, span, generatori
Perché conta: lo span descrive "tutto ciò che si può costruire" da alcuni vettori; è il modo in cui si generano i sottospazi e si arriva alle basi.
Riprendiamo il concetto-chiave del cap. 1: la combinazione lineare. Dati dei vettori di uno spazio , una loro combinazione lineare è (allunga ciascuno e somma). Ora facciamo variare tutti i coefficienti in tutti i modi possibili: l'insieme di tutte le combinazioni lineari ottenibili si chiama span (o sottospazio generato), scritto .
Lo span è sempre un sottospazio (il più piccolo che contiene quei vettori). Geometricamente: lo span di un vettore non nullo è la retta per l'origine su cui giace; lo span di due vettori non paralleli è il piano per l'origine che essi individuano. Aggiungendo vettori, lo span cresce (o resta uguale, se il nuovo vettore era già combinazione dei precedenti).
Diciamo che sono un insieme di generatori di uno spazio se , cioè se ogni vettore di si può scrivere come loro combinazione lineare. I generatori sono un "kit di montaggio" con cui costruire tutto lo spazio. Per esempio, i tre vettori , , generano tutto : ogni .
Indipendenza lineare
Perché conta: l'indipendenza lineare distingue i vettori "essenziali" da quelli ridondanti; è la seconda metà (con i generatori) del concetto di base.
Un insieme di generatori può contenere vettori superflui: se uno di essi è già combinazione lineare degli altri, lo si può togliere senza ridurre lo span (non aggiungeva nulla di nuovo). Il concetto che cattura questa idea è l'indipendenza lineare, forse la nozione più importante del capitolo.
I vettori si dicono linearmente indipendenti se nessuno di essi è combinazione lineare degli altri — cioè se ciascuno porta informazione "nuova", una direzione non ottenibile dagli altri. La definizione formale è elegante: sono indipendenti se l'unica combinazione lineare che dà il vettore nullo è quella con tutti i coefficienti nulli: Se invece esiste una combinazione non banale (con qualche ) che dà , i vettori sono linearmente dipendenti: almeno uno è "di troppo", esprimibile tramite gli altri.
Geometricamente: due vettori sono dipendenti se paralleli (uno è multiplo dell'altro); tre vettori sono dipendenti se complanari (stanno tutti su uno stesso piano). Come si verifica in pratica? Si impone , che è un sistema omogeneo nelle incognite : i vettori sono indipendenti se e solo se il sistema ha solo la soluzione banale — cioè (cap. 4) se il rango della matrice che ha quei vettori come colonne è massimo (pari al loro numero). Per vettori in , sono indipendenti il determinante della matrice che li affianca è .
🧩 Esempio. I vettori e in sono dipendenti: il secondo è volte il primo (paralleli); infatti è una combinazione non banale nulla. Invece e sono indipendenti: costringe . Non a caso, il determinante \det\begin{psmallmatrix}1&2\\2&4\end{psmallmatrix}=0 (dipendenti), mentre \det\begin{psmallmatrix}1&0\\0&1\end{psmallmatrix}=1\neq0 (indipendenti).
🗺️ Come si collega il tutto
Lo spazio vettoriale astrae la struttura "somma + prodotto per scalare" vista sulle frecce (cap. 1), estendendola a polinomi, matrici, funzioni: un'unica teoria per oggetti diversissimi. I sottospazi (rette/piani per l'origine, soluzioni di sistemi omogenei, nuclei e immagini del cap. 7) sono gli spazi "interni". Riprendendo la combinazione lineare, lo span descrive tutto ciò che si può generare, e i generatori sono il kit che costruisce l'intero spazio. L'indipendenza lineare — verificabile con un sistema omogeneo o un determinante (cap. 3-4) — distingue i vettori essenziali da quelli ridondanti. Mettendo insieme "generatori" e "indipendenti" si ottiene il concetto di base e il numero magico della dimensione: è il cap. 6, cuore della teoria.
🔑 Concetti chiave
| Termine | In una frase | Da non confondere con |
|---|---|---|
| Spazio vettoriale | Insieme con somma e prodotto per scalare (regole del cap. 1) | (i "vettori" possono essere polinomi, matrici, funzioni) |
| Sottospazio | Sottoinsieme chiuso rispetto alle operazioni (contiene ) | Sottoinsieme qualsiasi (una retta fuori dall'origine non lo è) |
| Span | Insieme di tutte le combinazioni lineari di certi vettori | Un singolo vettore (lo span è un intero sottospazio) |
| Generatori | Vettori il cui span è tutto : costruiscono ogni elemento | Base (generatori indipendenti, cap. 6) |
| Indipendenti | Nessuno è combinazione degli altri; tutti | Dipendenti (esiste combinazione non banale nulla) |
📝 Riepilogo
- Uno spazio vettoriale è un insieme con due operazioni (somma e prodotto per scalare) che rispettano le regole naturali del cap. 1 (vettore nullo, opposti, distributività…). La potenza sta nell'astrazione: sono spazi vettoriali anche i polinomi, le matrici, le funzioni, e ogni teorema vale per tutti insieme.
- Un sottospazio è un sottoinsieme chiuso rispetto alle operazioni (e contiene ): in sono rette/piani per l'origine. Le soluzioni di un sistema omogeneo, nucleo e immagine (cap. 7) sono sottospazi.
- La combinazione lineare genera, al variare dei coefficienti, lo span (sottospazio generato). Dei vettori sono generatori di se il loro span è tutto (ogni vettore è loro combinazione).
- I vettori sono linearmente indipendenti se nessuno è combinazione degli altri, cioè se forza tutti i ; altrimenti dipendenti (paralleli, complanari…). Si verifica con un sistema omogeneo / determinante. Unendo generatori + indipendenza si ottiene la base (cap. 6).
Geometria e Algebra Lineare
Hai letto. Ora impara.
L'AI trasforma questo modulo in strumenti di studio personalizzati.
Basi, dimensione e rango
In breve
Se i generatori costruiscono tutto lo spazio (ma possono avere vettori superflui) e l'indipendenza lineare garantisce che non ce ne siano di superflui (ma potrebbero non bastare a generare tutto), la base è la sintesi perfetta: un insieme di vettori che è insieme generatore e indipendente, cioè il "minimo indispensabile" per costruire ogni vettore in un unico modo. Il fatto sorprendente è che tutte le basi di uno stesso spazio hanno lo stesso numero di vettori: questo numero è la dimensione, l'invariante fondamentale che dice "quanto è grande" uno spazio. Questo capitolo definisce base e dimensione, mostra le coordinate rispetto a una base, e chiude il cerchio con il rango e il teorema della dimensione.
🎯 Alla fine di questo capitolo saprai: cos'è una base e perché ogni vettore ha coordinate uniche; il concetto di dimensione (numero invariante di elementi di una base); la base canonica di ; il significato del rango come dimensione dello spazio generato; il teorema di nullità più rango.
Che cos'è una base
Perché conta: la base è il sistema di riferimento di uno spazio vettoriale; permette di dare coordinate a ogni vettore e di ridurre lo spazio a numeri.
Abbiamo due qualità desiderabili per un insieme di vettori: generare tutto lo spazio (non manca nulla) ed essere indipendenti (non c'è nulla di superfluo). Un insieme che possiede entrambe le proprietà è una base:
Una base di uno spazio vettoriale è un insieme di vettori che sono linearmente indipendenti e generano .
È il "kit di montaggio perfetto": abbastanza vettori da costruire tutto, ma nessuno di troppo. La proprietà che rende la base così preziosa è l'unicità delle coordinate: se è una base, allora ogni vettore dello spazio si scrive in uno e un solo modo come loro combinazione lineare: I coefficienti — univocamente determinati — sono le coordinate di rispetto a quella base. La generazione garantisce che almeno una scrittura esista; l'indipendenza garantisce che ce ne sia al massimo una: insieme, danno l'unicità.
Questo è ciò che permette di ridurre l'algebra lineare astratta a conti con numeri: scelta una base, ogni vettore diventa una lista di coordinate, e ogni operazione diventa un calcolo. La base è, in sostanza, un sistema di riferimento.
🔗 Analogia. Una base è come le coordinate GPS (latitudine, longitudine): due numeri di riferimento con cui ogni punto della Terra ha un indirizzo unico. Cambiare base è come passare a un altro sistema di coordinate (es. UTM): lo stesso luogo, numeri diversi. Le direzioni "nord" ed "est" sono i vettori di base; ogni spostamento si scompone in modo unico lungo di esse.
La base canonica e la dimensione
Perché conta: la dimensione è l'invariante che misura "la taglia" di uno spazio; il fatto che tutte le basi abbiano lo stesso numero di elementi è un teorema profondo e onnipresente.
In c'è una base privilegiata, la base canonica: i vettori , , ..., , ciascuno con un 1 in una posizione e 0 altrove. Rispetto a essa, le coordinate di un vettore sono semplicemente le sue componenti: comodissima. Ma non è l'unica base: infinite altre scelte di vettori indipendenti vanno bene.
Ed ecco il teorema centrale: tutte le basi di uno stesso spazio vettoriale hanno lo stesso numero di vettori. Questo numero, indipendente dalla base scelta, si chiama dimensione dello spazio, . È l'invariante fondamentale che misura "quanti gradi di libertà" ha lo spazio, quante direzioni indipendenti contiene:
- (la base canonica ha vettori);
- una retta per l'origine ha dimensione 1, un piano dimensione 2;
- lo spazio dei polinomi di grado ha dimensione (base );
- lo spazio delle matrici ha dimensione .
La dimensione dà anche criteri pratici potentissimi. In uno spazio di dimensione : qualsiasi insieme di più di vettori è necessariamente dipendente (non c'è "spazio" per tanti vettori indipendenti); qualsiasi insieme di meno di vettori non può generare lo spazio. E soprattutto: vettori indipendenti in uno spazio di dimensione formano automaticamente una base (non serve verificare anche la generazione — c'è "gratis"). Questo dimezza il lavoro in innumerevoli esercizi.
Rango, righe e colonne
Perché conta: il rango, già incontrato coi sistemi, si rivela ora come una dimensione; unifica sistemi lineari, indipendenza e applicazioni lineari.
Torniamo al rango di una matrice (cap. 4), ora con occhi nuovi. Le colonne di una matrice () sono vettori di : il loro span è un sottospazio, lo spazio delle colonne. Analogamente le righe generano lo spazio delle righe. Il fatto notevole — non ovvio — è che questi due spazi hanno sempre la stessa dimensione, e tale dimensione è esattamente il rango:
Così il rango si rivela per quello che è davvero: il numero massimo di righe (o colonne) linearmente indipendenti, cioè la dimensione dello spazio che generano. Questo unifica tutto ciò che abbiamo visto: il rango conta le equazioni indipendenti (cap. 4), misura l'indipendenza dei vettori (cap. 5), e — vedremo — dà la dimensione dell'immagine di un'applicazione (cap. 7). Un unico numero, tre volti.
Per una matrice quadrata , le condizioni "rango ", "colonne indipendenti", "", "invertibile", "il sistema ha soluzione unica" sono tutte equivalenti: dicono la stessa cosa da angolazioni diverse. È il "teorema fondamentale" implicito che tiene insieme l'intero corso.
Il teorema della dimensione (nullità + rango)
Perché conta: lega la dimensione dello spazio di partenza a quelle di nucleo e immagine; è uno dei risultati più usati, ponte verso le applicazioni lineari.
Chiudiamo con un teorema che anticipa il cap. 7 ma si formula già qui, perché è pura questione di dimensioni. Data una matrice di tipo (che manda vettori di in vettori di ), consideriamo due sottospazi:
- il nucleo (kernel): l'insieme delle soluzioni del sistema omogeneo ; la sua dimensione si chiama nullità;
- l'immagine: lo spazio delle colonne, cioè tutti i raggiungibili come ; la sua dimensione è il rango.
Il teorema della dimensione (o teorema di nullità più rango, rank-nullity) afferma: dove è il numero di colonne (la dimensione dello spazio di partenza). L'interpretazione è bellissima: le dimensioni di partenza si ripartiscono tra ciò che viene "schiacciato a zero" (il nucleo) e ciò che "sopravvive" nell'immagine. Più cose la trasformazione appiattisce (nucleo grande), meno ne restano in uscita (immagine piccola), e viceversa. È una legge di conservazione: le dimensioni non si creano né si distruggono, si distribuiscono.
🧩 Esempio. Sia una matrice con . Allora l'immagine ha dimensione 2 (un piano in ) e, per il teorema, la nullità è : il nucleo è una retta. Il sistema omogeneo ha quindi infinite soluzioni dipendenti da 1 parametro (una retta di soluzioni), coerente con Rouché-Capelli. Un solo teorema collega rango, nucleo e struttura delle soluzioni.
⚠️ Attenzione. Non confondere le due dimensioni in gioco: il rango vive nello spazio di arrivo (dimensione dell'immagine), la nullità nello spazio di partenza (dimensione del nucleo). La somma fa il numero di colonne (, dimensione di partenza), non il numero di righe. Sbagliare quale dimensione usare è l'errore più comune.
🗺️ Come si collega il tutto
La base unisce le due qualità del cap. 5 — generare ed essere indipendenti — dando a ogni vettore coordinate uniche: è il sistema di riferimento dello spazio. Il numero (invariante) di vettori di una base è la dimensione, che misura i gradi di libertà () e fornisce criteri rapidi (in dim : indipendenti base). Il rango si rivela come dimensione dello spazio di righe/colonne, unificando sistemi lineari (cap. 4), indipendenza (cap. 5) e — col teorema nullità + rango — nucleo e immagine delle applicazioni lineari (cap. 7). Per matrici quadrate, "rango pieno = det ≠ 0 = invertibile = soluzione unica" sono la stessa cosa. Il passo successivo è studiare le trasformazioni che mandano uno spazio in un altro rispettando la struttura lineare: le applicazioni lineari (cap. 7).
🔑 Concetti chiave
| Termine | In una frase | Da non confondere con |
|---|---|---|
| Base | Insieme generatore e indipendente: coordinate uniche per ogni vettore | Generatori (possono avere vettori superflui) |
| Coordinate | I coefficienti (unici) di rispetto a una base | Componenti (coordinate nella base canonica) |
| Dimensione | N° (invariante) di vettori di una base = gradi di libertà | Rango (dimensione di un sottospazio specifico) |
| Base canonica | di (un 1, resto 0) | (è una base, non l'unica) |
| Rango | dello spazio di righe = di colonne = immagine | Nullità (dim del nucleo) |
| Nullità + rango = n | Le dim di partenza si dividono tra nucleo e immagine | ( = n° colonne, non righe) |
📝 Riepilogo
- Una base è un insieme generatore e linearmente indipendente: il minimo per costruire tutto. La sua proprietà cardine è l'unicità delle coordinate — ogni vettore si scrive in un solo modo come combinazione dei vettori di base. La base è il sistema di riferimento dello spazio.
- Tutte le basi di uno spazio hanno lo stesso numero di vettori: la dimensione (invariante). ; polinomi grado → ; matrici → . In dimensione : vettori sono sempre dipendenti; vettori indipendenti sono automaticamente una base.
- Il rango di una matrice è la dimensione dello spazio delle colonne (= delle righe) = n° massimo di righe/colonne indipendenti. Per matrici quadrate: rango pieno invertibile soluzione unica (tutte equivalenti).
- Teorema della dimensione: nullità + rango = n (n° colonne). Le dimensioni di partenza si ripartiscono tra nucleo (dim = nullità, ciò che va a zero) e immagine (dim = rango, ciò che sopravvive). Prossimo passo: le applicazioni lineari (cap. 7).
Geometria e Algebra Lineare
Hai letto. Ora impara.
L'AI trasforma questo modulo in strumenti di studio personalizzati.
Applicazioni lineari
In breve
Fin qui abbiamo studiato spazi vettoriali e i loro elementi. Ora studiamo le funzioni tra spazi vettoriali — ma non funzioni qualsiasi: quelle che rispettano la struttura lineare, cioè trasformano somme in somme e multipli in multipli. Sono le applicazioni lineari (o trasformazioni lineari), e sono l'oggetto più importante di tutto il corso, perché rappresentano tutte le trasformazioni "geometricamente regolari" dello spazio: rotazioni, dilatazioni, proiezioni, riflessioni. Il fatto centrale è che ogni applicazione lineare si rappresenta con una matrice: ecco finalmente svelato il secondo volto della matrice (cap. 2). Studieremo il nucleo e l'immagine di un'applicazione, che dicono cosa "schiaccia" e cosa "raggiunge".
🎯 Alla fine di questo capitolo saprai: cos'è un'applicazione lineare e le due proprietà che la definiscono; perché ogni applicazione lineare è una matrice; cosa sono nucleo e immagine e cosa dicono su iniettività/suriettività; come la composizione corrisponde al prodotto di matrici.
Che cos'è un'applicazione lineare
Perché conta: le applicazioni lineari sono le trasformazioni "compatibili" con la struttura vettoriale; catturano rotazioni, proiezioni, dilatazioni e stanno al centro di ogni applicazione.
Una funzione tra due spazi vettoriali si dice applicazione lineare (o trasformazione lineare) se rispetta le due operazioni degli spazi vettoriali, cioè soddisfa due condizioni: La prima dice che "trasformare la somma è come sommare le trasformate"; la seconda che "trasformare un multiplo è come moltiplicare la trasformata". In una formula sola: — l'applicazione commuta con le combinazioni lineari. Una conseguenza immediata: ogni applicazione lineare manda il vettore nullo nel vettore nullo, (l'origine resta ferma).
Geometricamente, sono lineari tutte le trasformazioni che mandano l'origine in sé e trasformano rette in rette (senza "piegarle"): rotazioni attorno all'origine, dilatazioni/contrazioni, riflessioni, proiezioni su una retta o un piano, scorrimenti (shear). Non sono lineari, invece, le traslazioni (spostano l'origine: ) né qualsiasi trasformazione "curva". La linearità è precisamente la condizione che rende una trasformazione "regolare" e trattabile con le matrici.
🔗 Analogia. Un'applicazione lineare è come una fotocopiatrice con lente: può ingrandire, ruotare, specchiare o schiacciare l'immagine, ma non può "incurvarla" né spostare l'origine del foglio. Se fotocopi due disegni sovrapposti, il risultato è la sovrapposizione delle due fotocopie (rispetto della somma): la macchina tratta ogni parte in modo coerente, senza deformazioni capricciose.
Ogni applicazione lineare è una matrice
Perché conta: è il teorema che collega il mondo astratto (funzioni) al mondo del calcolo (matrici); spiega perché studiamo le matrici.
Ecco il risultato che dà senso a tutto il corso e svela il secondo volto della matrice. Ogni applicazione lineare è rappresentata da un'unica matrice (di tipo ), nel senso che Come si costruisce questa matrice? Con un'idea semplice e potente: le colonne di sono le immagini dei vettori della base canonica. Cioè la -esima colonna di è . Perché funziona? Perché ogni vettore è combinazione lineare della base, e per linearità : basta dunque sapere dove finiscono i vettori di base per sapere dove finisce tutto. Una trasformazione di infiniti vettori è completamente determinata da soli dati (le immagini della base).
Questo chiarisce definitivamente perché nel cap. 2 dicevamo che una matrice "è una trasformazione": moltiplicare per è applicare . Le due nozioni — matrice e applicazione lineare — sono la stessa cosa vista da due lati. E questo dà anche il significato profondo del prodotto di matrici: se ha matrice e ha matrice , l'applicazione composta ("prima , poi ") ha matrice . La regola riga-per-colonna del cap. 2 è esattamente ciò che serve perché i conti tornino nella composizione: comporre trasformazioni = moltiplicare matrici.
🧩 Esempio. La rotazione di 90° in senso antiorario nel piano manda in e in . Mettendo queste immagini come colonne, la matrice della rotazione è . Verifica su un vettore qualsiasi: R\begin{psmallmatrix}2\\3\end{psmallmatrix} = \begin{psmallmatrix}-3\\2\end{psmallmatrix}, che è appunto ruotato di 90°. ✓
Nucleo e immagine
Perché conta: nucleo e immagine descrivono cosa la trasformazione "perde" e cosa "raggiunge"; determinano iniettività e suriettività e si legano al teorema della dimensione.
A ogni applicazione lineare si associano due sottospazi che ne raccontano il comportamento.
Il nucleo (kernel), , è l'insieme dei vettori che vengono mandati nel vettore nullo: . È ciò che la trasformazione "schiaccia a zero", l'informazione che va perduta. Coincide con le soluzioni del sistema omogeneo (cap. 4) ed è un sottospazio dello spazio di partenza. Fatto chiave: è iniettiva (input diversi → output diversi, nessuna informazione persa) se e solo se il nucleo è ridotto al solo (). Un nucleo più grande di significa che più vettori collassano nello stesso punto: iniettività persa.
L'immagine, , è l'insieme di tutti i valori effettivamente raggiunti: . Coincide con lo spazio delle colonne di (le colonne sono , e il loro span è tutto ciò che si raggiunge) ed è un sottospazio dello spazio di arrivo. La sua dimensione è il rango (cap. 6). Fatto chiave: è suriettiva (raggiunge tutto lo spazio d'arrivo) se e solo se l'immagine coincide con esso, cioè se il rango è massimo.
Questi due sottospazi sono legati dal teorema della dimensione (cap. 6): , cioè nullità + rango = dimensione di partenza. Un'unica legge governa iniettività, suriettività e "quanto" la trasformazione schiaccia.
⚠️ Attenzione. Nucleo e immagine vivono in spazi diversi: il nucleo è nello spazio di partenza (i vettori che entrano e vengono azzerati), l'immagine nello spazio di arrivo (i valori che escono). Un'applicazione è biiettiva (invertibile) solo se e la matrice è invertibile (): allora nucleo banale e immagine piena coincidono.
🗺️ Come si collega il tutto
L'applicazione lineare è la funzione tra spazi vettoriali che rispetta somma e prodotto per scalare (cap. 5): cattura rotazioni, proiezioni, dilatazioni — tutte le trasformazioni "regolari". Il teorema centrale ("ogni applicazione lineare è una matrice", con colonne ) chiude il cerchio col cap. 2: matrice e trasformazione sono la stessa cosa, e il prodotto di matrici è la composizione di applicazioni. Il nucleo (ciò che si azzera, → iniettività) e l'immagine (ciò che si raggiunge, → suriettività, dim = rango) si legano col teorema nullità + rango (cap. 6) e coi sistemi omogenei (cap. 4). Il passo successivo è la domanda più feconda su una trasformazione: esistono direzioni privilegiate che essa lascia invariate (a meno di allungamento)? Sono gli autovettori (cap. 8).
🔑 Concetti chiave
| Termine | In una frase | Da non confondere con |
|---|---|---|
| Applicazione lineare | , | Traslazione (sposta l'origine, non è lineare) |
| Matrice di | Colonne = immagini della base ; | (ogni applicazione lineare ne ha una sola) |
| Nucleo | Vettori mandati in ; nello spazio di partenza | Immagine (nello spazio di arrivo) |
| Immagine | Valori raggiunti = span colonne; rango | Nucleo (ciò che si azzera) |
| Iniettiva | (niente collassa) | Suriettiva ( immagine piena) |
| Composizione | Matrice : "prima , poi " | (l'ordine conta: ) |
📝 Riepilogo
- Un'applicazione lineare rispetta le operazioni: e (quindi ). Geometricamente: rotazioni, dilatazioni, riflessioni, proiezioni (non le traslazioni). Commuta con le combinazioni lineari.
- Ogni applicazione lineare è una matrice: , con le colonne di = immagini della base canonica . Basta sapere dove va la base per conoscere tutta . La composizione ha matrice (comporre = moltiplicare).
- Il nucleo (spazio di partenza) è ciò che viene azzerato: iniettiva . L'immagine (spazio di arrivo) è ciò che si raggiunge (= span colonne, rango): suriettiva immagine piena.
- Vale nullità + rango = (dim di partenza). Un'applicazione è biiettiva/invertibile solo se quadrata con . Prossimo passo: le direzioni invarianti, gli autovettori (cap. 8).
Geometria e Algebra Lineare
Hai letto. Ora impara.
L'AI trasforma questo modulo in strumenti di studio personalizzati.
Autovalori e autovettori
In breve
Data una trasformazione lineare, in generale ogni vettore viene ruotato e allungato in modo complicato. Ma quasi ogni trasformazione ha alcune direzioni speciali che essa non ruota: vettori che, applicando la matrice, restano sulla stessa retta — solo allungati o accorciati (eventualmente invertiti). Questi vettori privilegiati sono gli autovettori, e il fattore di allungamento associato è l'autovalore. Sono i concetti più profondi e più applicativi di tutto il corso: descrivono i "modi propri" di vibrazione di una struttura, la stabilità di un sistema, gli assi principali di una rotazione, il funzionamento di Google (PageRank) e della meccanica quantistica. Questo capitolo definisce autovalori e autovettori e mostra come calcolarli con il polinomio caratteristico.
🎯 Alla fine di questo capitolo saprai: cosa sono autovalore e autovettore e il loro significato geometrico; l'equazione ; come si calcolano gli autovalori con il polinomio caratteristico (); come si trovano gli autovettori (autospazi); cosa sono molteplicità algebrica e geometrica.
L'idea di autovettore
Perché conta: gli autovettori sono le direzioni "invarianti" di una trasformazione; individuarli semplifica enormemente lo studio del sistema e ne rivela la struttura profonda.
Applichiamo una matrice a vari vettori: di solito ciascuno viene mandato in una direzione diversa, ruotato in modo imprevedibile. Ma per certe direzioni speciali succede qualcosa di semplice: il vettore trasformato resta parallelo a quello di partenza — la trasformazione lo allunga o accorcia, senza deviarlo dalla sua retta. Questi sono gli autovettori.
Formalmente: un vettore è un autovettore di se esiste un numero tale che Il numero è l'autovalore associato: è il fattore di allungamento lungo quella direzione. L'equazione dice: "applicare a equivale a moltiplicarlo per il numero ". La trasformazione, su quella direzione, si comporta come una semplice moltiplicazione. Se , l'autovettore raddoppia; se , si dimezza; se , si inverte (stessa retta, verso opposto); se , resta fermo; se , viene schiacciato nell'origine (e sta nel nucleo!).
Perché sono così importanti? Perché rivelano la struttura intrinseca della trasformazione, indipendente dal sistema di coordinate. Gli autovettori sono gli "assi naturali" lungo cui la trasformazione agisce nel modo più semplice possibile. In un ponte che vibra, sono i modi propri di oscillazione; in un sistema dinamico, le direzioni di crescita o decadimento; il segno e il modulo degli autovalori dicono se il sistema è stabile o esplode.
🔗 Analogia. Immagina di impastare e stirare un foglio di gomma (la trasformazione). Quasi ogni linea disegnata sul foglio viene sia allungata sia ruotata. Ma ci sono alcune direzioni "magiche" lungo cui una linea viene solo stirata, senza cambiare inclinazione: quelle sono gli autovettori, e di quanto viene stirata è l'autovalore. Trovare quelle direzioni significa capire "come funziona davvero" la deformazione, al netto delle apparenze.
Calcolo degli autovalori: il polinomio caratteristico
Perché conta: trasforma un problema geometrico ("quali direzioni sono invarianti?") in un problema algebrico risolvibile (una equazione polinomiale).
Come si trovano autovalori e autovettori? Partiamo dall'equazione e riscriviamola portando tutto a sinistra. Usando l'identità : Questo è un sistema lineare omogeneo nella matrice . Ora, cerchiamo autovettori : vogliamo cioè che questo sistema omogeneo abbia soluzioni non banali. Ma sappiamo (cap. 3-4) che un sistema omogeneo quadrato ha soluzioni diverse da zero se e solo se la matrice dei coefficienti ha determinante nullo. Quindi la condizione sugli autovalori è:
Questa è l'equazione caratteristica. Sviluppando il determinante si ottiene un polinomio in di grado (per una matrice ), il polinomio caratteristico . Le sue radici sono esattamente gli autovalori di . Il problema geometrico è così ridotto a: scrivere un polinomio e trovarne le radici.
Una matrice ha quindi al più autovalori (le radici di un polinomio di grado ). Attenzione: alcune radici possono essere complesse (una rotazione nel piano non ha autovettori reali — nessuna direzione reale resta invariata!) oppure ripetute. La molteplicità di come radice del polinomio si chiama molteplicità algebrica.
🧩 Esempio. Sia . Allora , e . Ponendo : gli autovalori sono e . (Per le matrici triangolari, gli autovalori sono comodamente gli elementi sulla diagonale.)
Autospazi e molteplicità
Perché conta: a ogni autovalore corrisponde tutto un sottospazio di autovettori; il confronto tra le due molteplicità decide se la matrice è diagonalizzabile (cap. 9).
Trovato un autovalore , come si trovano i suoi autovettori? Si risolve il sistema omogeneo (ora con numero noto): le sue soluzioni non nulle sono gli autovettori. L'insieme di tutte le soluzioni (autovettori più il vettore nullo) forma un sottospazio, l'autospazio relativo a . È il nucleo della matrice , e quindi (cap. 5) un sottospazio a tutti gli effetti: se è autovettore, lo è anche ogni suo multiplo (la stessa direzione), e le combinazioni di autovettori dello stesso sono ancora autovettori di .
Entrano ora in gioco due molteplicità associate a ciascun autovalore, la cui distinzione è decisiva:
- la molteplicità algebrica : quante volte è radice del polinomio caratteristico;
- la molteplicità geometrica : la dimensione dell'autospazio (quanti autovettori indipendenti ha ).
Vale sempre la disuguaglianza : la geometrica non supera mai l'algebrica. Il caso in cui sono uguali per ogni autovalore è quello "buono" (la matrice sarà diagonalizzabile, cap. 9); il caso è quello "difettoso", in cui mancano autovettori. Un fatto utile che useremo: autovettori relativi ad autovalori diversi sono sempre linearmente indipendenti — direzioni con fattori di allungamento diversi non possono essere allineate.
⚠️ Attenzione. L'autovettore per definizione è non nullo (): soddisfa banalmente per qualsiasi , quindi non individua nessuna direzione ed è escluso. L'autovalore invece può essere (significa che l'autospazio è il nucleo di : la matrice schiaccia quella direzione). Non confondere: "autovettore nullo" non esiste, "autovalore nullo" sì.
🗺️ Come si collega il tutto
Gli autovettori sono le direzioni che una trasformazione (cap. 7) lascia invariate (solo allungate del fattore autovalore): . Il calcolo riduce la geometria all'algebra: la condizione di soluzioni non banali del sistema omogeneo (cap. 4) è (cap. 3), il polinomio caratteristico, le cui radici sono gli autovalori. Gli autospazi sono nuclei (cap. 5-7), e il confronto tra molteplicità algebrica e geometrica decide la questione del prossimo capitolo: quando esiste una base di soli autovettori, in cui la trasformazione diventa banalmente una moltiplicazione lungo ogni asse? È la diagonalizzazione (cap. 9), il coronamento della teoria.
🔑 Concetti chiave
| Termine | In una frase | Da non confondere con |
|---|---|---|
| Autovettore | con : direzione invariante | Vettore qualsiasi (viene ruotato) |
| Autovalore | Fattore di allungamento lungo l'autovettore | Autovettore (è la direzione, non il fattore) |
| Polinomio caratteristico | ; le radici sono gli autovalori | (grado → al più autovalori) |
| Autospazio | Sottospazio degli autovettori di (= ) | Un solo autovettore (l'autospazio è tutta la retta/piano) |
| Molt. algebrica | Quante volte è radice di | Molt. geometrica (; ) |
📝 Riepilogo
- Un autovettore è una direzione invariante di : tale che (la trasformazione lo allunga senza ruotarlo). L'autovalore è il fattore di allungamento ( fermo, invertito, schiacciato nel nucleo). Rivelano la struttura intrinseca della trasformazione (modi propri, stabilità).
- Gli autovalori si trovano dal polinomio caratteristico (deriva dal richiedere soluzioni non banali del sistema omogeneo ). È di grado : al più autovalori, eventualmente complessi o ripetuti. Per matrici triangolari, sono gli elementi diagonali.
- Gli autovettori di si trovano risolvendo ; formano l'autospazio (un sottospazio = nucleo di ). Autovettori di autovalori diversi sono indipendenti.
- Due molteplicità: algebrica (radice di ) e geometrica , con . L'autovettore è sempre , ma l'autovalore può essere . Prossimo passo: la diagonalizzazione (cap. 9).
Geometria e Algebra Lineare
Hai letto. Ora impara.
L'AI trasforma questo modulo in strumenti di studio personalizzati.
Diagonalizzazione
In breve
Se una matrice ha "abbastanza" autovettori indipendenti da formare una base, allora — visti in quel sistema di riferimento — la trasformazione diventa banale: si limita a moltiplicare ogni asse per il suo autovalore. In termini matriciali, questo significa scrivere la matrice come una matrice diagonale, a meno di un cambio di base: è la diagonalizzazione, il coronamento di tutta la teoria vista finora. Una matrice diagonalizzata è una miniera: si calcolano immediatamente le sue potenze (utile per sistemi dinamici e catene di Markov), si risolvono equazioni differenziali, si capisce la struttura del sistema. Questo capitolo spiega quando una matrice è diagonalizzabile, come si diagonalizza (), e il caso d'oro delle matrici simmetriche.
🎯 Alla fine di questo capitolo saprai: cosa significa diagonalizzare una matrice e perché è utile; il criterio di diagonalizzabilità (base di autovettori / molteplicità); la formula e come costruire e ; il teorema spettrale per le matrici simmetriche; l'uso per calcolare potenze .
Che cosa significa diagonalizzare
Perché conta: diagonalizzare significa trovare il sistema di coordinate in cui la trasformazione è più semplice possibile; è il traguardo verso cui puntava tutto il corso.
Una matrice diagonale (tutti zeri fuori dalla diagonale) rappresenta la trasformazione più semplice che esista: moltiplica ogni asse coordinato per un numero, in modo indipendente dagli altri. Non c'è mescolamento tra le coordinate. Sarebbe magnifico se ogni trasformazione fosse così: purtroppo una matrice generica mescola le coordinate. Ma — ed è l'idea centrale — spesso esiste un sistema di riferimento diverso, fatto di autovettori, in cui la stessa trasformazione diventa diagonale.
Una matrice si dice diagonalizzabile se esiste una base dello spazio fatta interamente di autovettori di . In quella base, applicare significa semplicemente allungare ciascun vettore di base per il suo autovalore: la matrice, letta in quelle coordinate, è la matrice diagonale degli autovalori. Diagonalizzare = trovare il "punto di vista" giusto in cui la trasformazione si sbroglia e mostra la sua natura semplice.
🔗 Analogia. Diagonalizzare è come raddrizzare gli assi di un'ellisse storta. Un'ellisse disegnata di traverso ha un'equazione complicata (con termini misti ); ma se ruoti gli assi allineandoli con gli assi propri dell'ellisse, l'equazione si semplifica (, niente termine misto). Gli autovettori sono quegli assi naturali: cambiare base per allinearsi a essi è come girare la testa finché l'oggetto storto appare dritto.
Il criterio di diagonalizzabilità
Perché conta: dà una condizione operativa esatta per sapere, prima di procedere, se una matrice si può diagonalizzare.
Non tutte le matrici sono diagonalizzabili: serve che esistano abbastanza autovettori indipendenti da formare una base (cioè per una matrice ). Ci sono due criteri equivalenti, uno "di conteggio" e uno più fine basato sulle molteplicità (cap. 8):
Criterio pratico. Una matrice è diagonalizzabile se e solo se la somma delle molteplicità geometriche degli autovalori è — cioè se, mettendo insieme gli autovettori indipendenti di tutti gli autospazi, si arriva a (una base intera).
Criterio con le molteplicità. Poiché autovettori di autovalori diversi sono indipendenti, la condizione si traduce così: è diagonalizzabile per ogni autovalore la molteplicità geometrica è uguale a quella algebrica (), e il polinomio caratteristico ha tutte le radici nel campo considerato (in , tutti gli autovalori reali).
Due casi particolari, molto comodi negli esercizi:
- se una matrice ha autovalori distinti, è automaticamente diagonalizzabile (ogni autovalore ha molteplicità 1, quindi , e i loro autovettori sono indipendenti). È il caso "generico";
- se invece qualche autovalore ha (autospazio "troppo piccolo", mancano autovettori), la matrice non è diagonalizzabile: si dice difettosa.
Come si diagonalizza: A = PDP⁻¹
Perché conta: è la formula operativa che realizza il cambio di base e permette tutti i calcoli successivi (potenze, esponenziali di matrici).
Supponiamo diagonalizzabile. La diagonalizzazione si scrive con una formula precisa: dove:
- è la matrice diagonale che ha sulla diagonale gli autovalori ;
- è la matrice che ha per colonne gli autovettori corrispondenti (nello stesso ordine degli autovalori in );
- è la sua inversa.
La matrice è la matrice del cambio di base: traduce dalle coordinate "naturali" (autovettori) a quelle standard e viceversa. La formula si legge da destra a sinistra come "trasforma nelle coordinate degli autovettori (), lì applica la trasformazione semplice (), poi torna alle coordinate standard ()". Perché sia invertibile occorre — ecco di nuovo il criterio — che le sue colonne (gli autovettori) siano indipendenti, cioè che formino una base: esattamente la condizione di diagonalizzabilità.
L'utilità pratica esplode nel calcolo delle potenze. Calcolare direttamente (moltiplicando per sé stessa volte) è lunghissimo; ma con la diagonalizzazione i fattori si semplificano a catena e resta: e è banale — basta elevare a ciascun elemento diagonale (). Questo rende immediati i calcoli su sistemi dinamici, catene di Markov (evoluzione di probabilità nel tempo), successioni ricorsive (es. Fibonacci) e stabilità: il comportamento a lungo termine è dominato dall'autovalore di modulo più grande.
🧩 Esempio. Riprendiamo (autovalori , , distinti → diagonalizzabile). Gli autovettori: per , dà ; per , dà . Quindi D=\begin{psmallmatrix}2&0\\0&3\end{psmallmatrix} e P=\begin{psmallmatrix}1&1\\0&1\end{psmallmatrix} (autovettori in colonna). Allora , e per esempio A^{10}=P\begin{psmallmatrix}2^{10}&0\\0&3^{10}\end{psmallmatrix}P^{-1} — calcolabile a mano, mentre moltiplicare dieci volte sarebbe proibitivo.
Il teorema spettrale (matrici simmetriche)
Perché conta: garantisce che una classe importantissima di matrici — le simmetriche — è sempre diagonalizzabile, e per di più con autovettori ortogonali; è il ponte verso il prossimo capitolo.
C'è una classe di matrici per cui la diagonalizzazione è sempre garantita, senza bisogno di verifiche: le matrici simmetriche (, cap. 2). Lo assicura uno dei teoremi più belli e usati dell'algebra lineare, il teorema spettrale:
Ogni matrice simmetrica reale è diagonalizzabile; inoltre i suoi autovalori sono tutti reali e gli autovettori (di autovalori diversi) sono ortogonali tra loro. Si può quindi diagonalizzare con una base ortonormale di autovettori.
È un risultato eccezionale per due motivi. Primo: elimina ogni incertezza — se la matrice è simmetrica, è diagonalizzabile, punto. Secondo: gli autovettori si possono scegliere ortogonali (perpendicolari) e di norma 1, cioè formano una base ortonormale (cap. 10). In quel caso la matrice del cambio di base è ortogonale (, comodissimo) e si scrive . Le matrici simmetriche compaiono ovunque nelle applicazioni (matrici di inerzia, forme quadratiche, matrici di covarianza in statistica, hessiane in ottimizzazione), e il teorema spettrale è ciò che permette di "diagonalizzarle" trovando gli assi principali — il tema che collega direttamente al prodotto scalare (cap. 10) e alle coniche (cap. 12).
⚠️ Attenzione. Diagonalizzabilità e invertibilità sono indipendenti: una matrice può essere diagonalizzabile ma non invertibile (se ha tra gli autovalori, ha uno zero in diagonale → non invertibile, ma resta diagonalizzabile); e viceversa una matrice invertibile può non essere diagonalizzabile. Non confondere i due concetti: l'invertibilità dipende da , la diagonalizzabilità dal numero di autovettori indipendenti.
🗺️ Come si collega il tutto
La diagonalizzazione corona la teoria: usando gli autovettori (cap. 8) come base (cap. 6), la trasformazione (cap. 7) diventa una banale moltiplicazione asse per asse, cioè una matrice diagonale . Il criterio ( per ogni autovalore, ossia autovettori indipendenti) e i casi comodi ( autovalori distinti → diagonalizzabile) rendono la verifica operativa. La formula (con = autovettori in colonna, cambio di base del cap. 6) permette di calcolare potenze , chiave per sistemi dinamici. Il teorema spettrale garantisce che le matrici simmetriche sono sempre diagonalizzabili con autovettori ortogonali: da qui il passo naturale al prodotto scalare, all'ortogonalità e alle basi ortonormali (cap. 10), e poi agli assi principali delle coniche (cap. 12).
🔑 Concetti chiave
| Termine | In una frase | Da non confondere con |
|---|---|---|
| Diagonalizzabile | Esiste una base di autovettori: | Invertibile (; concetti indipendenti) |
| Matrice diagonale degli autovalori | (colonne = autovettori) | |
| Cambio di base: autovettori in colonna (dev'essere invertibile) | (i valori, non le direzioni) | |
| Criterio | Diagonalizzabile per ogni (n autovettori indip.) | ( autovalori distinti ⇒ sempre sì) |
| Potenze facili: sulla diagonale | (moltiplicare volte è molto più lungo) | |
| Teorema spettrale | Simmetrica ⇒ diagonalizzabile, autovalori reali, autovettori ortogonali | (vale per , non in generale) |
📝 Riepilogo
- Diagonalizzare significa trovare una base di autovettori in cui la trasformazione diventa la matrice diagonale degli autovalori (moltiplica ogni asse per il suo ): il sistema di coordinate in cui tutto si semplifica.
- Criterio: () è diagonalizzabile ha autovettori indipendenti per ogni autovalore (con tutti gli autovalori nel campo). Caso comodo: autovalori distinti ⇒ automaticamente diagonalizzabile. Se : difettosa, non diagonalizzabile.
- Formula: , con = autovalori in diagonale e = autovettori in colonna (matrice del cambio di base). Applicazione principale: potenze (solo ) per sistemi dinamici, Markov, ricorrenze, stabilità.
- Teorema spettrale: ogni matrice simmetrica reale è diagonalizzabile, con autovalori reali e autovettori ortogonali (base ortonormale, ). Diagonalizzabilità e invertibilità sono concetti indipendenti. Prossimo passo: prodotto scalare e ortogonalità (cap. 10).
Geometria e Algebra Lineare
Hai letto. Ora impara.
L'AI trasforma questo modulo in strumenti di studio personalizzati.
Prodotto scalare e ortogonalità
In breve
L'algebra lineare "pura" (spazi, basi, applicazioni) non parla di lunghezze e angoli: sa combinare vettori, ma non sa dire quanto sono lunghi o se sono perpendicolari. Per introdurre la geometria metrica serve il prodotto scalare, incontrato sui vettori del piano nel cap. 1 e qui elevato a strumento generale. Con esso definiamo norma, distanza, angolo e soprattutto l'ortogonalità. Da qui nascono le basi ortonormali — i sistemi di riferimento perfetti, in cui ogni conto si semplifica — e la proiezione ortogonale, l'operazione che trova "l'ombra" di un vettore su un sottospazio e sta alla base del metodo dei minimi quadrati, onnipresente in ingegneria e statistica.
🎯 Alla fine di questo capitolo saprai: cos'è il prodotto scalare come struttura generale e cosa induce (norma, angolo); il concetto di ortogonalità e basi ortonormali; il vantaggio di lavorare con basi ortonormali; la proiezione ortogonale e il suo legame con i minimi quadrati.
Il prodotto scalare come struttura
Perché conta: è ciò che aggiunge lunghezze e angoli a uno spazio vettoriale, trasformando l'algebra in geometria.
Nel cap. 1 il prodotto scalare era una formula sulle componenti; ora lo vediamo per quello che è: la struttura che dota uno spazio vettoriale di una geometria metrica. Un prodotto scalare su uno spazio è un'operazione che a due vettori associa un numero (scritto anche ), con tre proprietà: è simmetrico (), lineare in ciascun argomento, e definito positivo ( per ). In quello standard è .
Da questa struttura discende tutta la geometria:
- la norma (lunghezza): ;
- la distanza tra due vettori: ;
- l'angolo: .
Uno spazio vettoriale dotato di prodotto scalare si chiama spazio euclideo: è lo spazio in cui la geometria (Pitagora, angoli, perpendicolarità) ha pieno diritto di cittadinanza. Una disuguaglianza fondamentale che tiene tutto insieme è quella di Cauchy-Schwarz, , che garantisce proprio che sia sempre compreso tra e (l'angolo esiste davvero).
Ortogonalità e basi ortonormali
Perché conta: le basi ortonormali sono i sistemi di riferimento ideali; in esse i calcoli (coordinate, proiezioni, lunghezze) diventano immediati.
Il concetto-cardine è l'ortogonalità: due vettori sono ortogonali (perpendicolari) se il loro prodotto scalare è nullo, . È la traduzione algebrica del "formare un angolo retto", e il fatto più usato dell'intero capitolo.
Un insieme di vettori a due a due ortogonali (e non nulli) è automaticamente linearmente indipendente: direzioni perpendicolari non possono essere combinazioni l'una dell'altra. Se poi tali vettori generano lo spazio, formano una base ortogonale. E se in più sono tutti di norma 1 (versori), formano una base ortonormale — il sistema di riferimento perfetto. La base canonica di è l'esempio principe: sono a due a due ortogonali e di lunghezza 1.
Perché le basi ortonormali sono così preziose? Perché in esse ogni calcolo si semplifica drasticamente. Le coordinate di un vettore rispetto a una base ortonormale si trovano con un semplice prodotto scalare, senza risolvere sistemi: Ogni coordinata è la "quantità di lungo quella direzione", ottenuta proiettando. In una base qualsiasi servirebbe risolvere un sistema lineare (cap. 4); in una ortonormale basta un prodotto scalare per coordinata. Esiste anche un procedimento, l'ortogonalizzazione di Gram-Schmidt, che trasforma una base qualsiasi in una ortonormale, garantendo che una tale base esista sempre.
🔗 Analogia. Una base ortonormale è come i punti cardinali Nord/Est su una mappa: perpendicolari e di "lunghezza unitaria". Per sapere quanto sei spostato a Est basta guardare la componente Est, indipendentemente da quella Nord — le due direzioni non "interferiscono". Con assi obliqui (base non ortogonale) dovresti fare conti incrociati per districare le due direzioni; con assi perpendicolari, ogni direzione si legge da sola.
Proiezione ortogonale e minimi quadrati
Perché conta: la proiezione ortogonale trova il punto di un sottospazio più vicino a un vettore dato; è il fondamento dei minimi quadrati, il metodo più usato per adattare modelli ai dati.
Data una direzione (o un sottospazio) e un vettore esterno, la proiezione ortogonale di è la sua "ombra" su quel sottospazio: il vettore del sottospazio più vicino a . Su una direzione data da un versore , la proiezione è . La caratteristica geometrica decisiva: il "residuo" (ciò che avanza) è ortogonale al sottospazio. È il principio del filo a piombo: la distanza minima da un piano si misura lungo la perpendicolare.
Questa idea genera uno dei metodi più importanti della matematica applicata: i minimi quadrati. Il problema tipico: un sistema non ha soluzione (più equazioni che incognite, dati sperimentali affetti da rumore, come sempre nella pratica). Non potendo risolverlo esattamente, si cerca la che rende il più vicino possibile a , cioè che minimizza l'errore (la somma dei quadrati degli scarti — da cui il nome). La soluzione è geometrica: deve essere la proiezione ortogonale di sull'immagine di . Imponendo che il residuo sia ortogonale alle colonne di si ottengono le equazioni normali , che si risolvono sempre.
È il fondamento della regressione lineare (la "retta che meglio approssima" una nube di punti), usata in statistica, econometria, machine learning, elaborazione dei segnali, taratura di strumenti: ovunque si debba adattare un modello a dati imperfetti, si sta calcolando una proiezione ortogonale.
🧩 Esempio. Proiettiamo sulla direzione dell'asse , cioè su (già un versore). La proiezione è : l'ombra di sull'asse . Il residuo è perpendicolare all'asse (è verticale). ✓ È esattamente ciò che fa la regressione, ma in dimensioni più alte.
⚠️ Attenzione. "Ortogonale" (prodotto scalare nullo) non significa "indipendente" in senso generico: l'ortogonalità è più forte dell'indipendenza (vettori ortogonali non nulli sono sempre indipendenti, ma vettori indipendenti possono non essere ortogonali). E una matrice ortogonale (colonne ortonormali, , ) è un'altra cosa ancora: rappresenta le trasformazioni che conservano lunghezze e angoli (rotazioni e riflessioni).
🗺️ Come si collega il tutto
Il prodotto scalare aggiunge agli spazi vettoriali (cap. 5) la geometria metrica: norma, distanza, angolo e soprattutto l'ortogonalità (). Le basi ortonormali sono i sistemi di riferimento ideali — generalizzano la base canonica (cap. 6) e rendono immediate le coordinate (un prodotto scalare ciascuna). La proiezione ortogonale trova il punto più vicino in un sottospazio e fonda i minimi quadrati (equazioni normali ), il metodo della regressione. Tutto questo si salda col teorema spettrale (cap. 9): le matrici simmetriche si diagonalizzano in una base ortonormale di autovettori — gli "assi principali", che nel cap. 12 raddrizzeranno le coniche. Il passo successivo è tornare alla geometria concreta: rette e piani nello spazio (cap. 11).
🔑 Concetti chiave
| Termine | In una frase | Da non confondere con |
|---|---|---|
| Prodotto scalare | : simmetrico, lineare, definito positivo → norma, angolo | Prodotto vettoriale (dà un vettore, solo in ) |
| Ortogonali | : perpendicolari (più forte di indipendenti) | Indipendenti (non implica perpendicolari) |
| Base ortonormale | Vettori a due a due ortogonali, di norma 1: coordinate = prodotti scalari | Base qualsiasi (coordinate via sistema lineare) |
| Proiezione ortogonale | "Ombra" di : il punto più vicino nel sottospazio | (il residuo è perpendicolare al sottospazio) |
| Minimi quadrati | Miglior soluzione approssimata: | Soluzione esatta (qui il sistema non ne ha) |
| Matrice ortogonale | : conserva lunghezze/angoli (rotazioni, riflessioni) | Prodotto scalare nullo tra due vettori (concetto diverso) |
📝 Riepilogo
- Il prodotto scalare (simmetrico, lineare, definito positivo) dota lo spazio di geometria metrica: norma , distanza , angolo (). Spazio con prodotto scalare = spazio euclideo; vale Cauchy-Schwarz.
- Ortogonalità: . Vettori ortogonali (non nulli) sono indipendenti; se ortogonali, di norma 1 e generatori → base ortonormale (come la canonica). Vantaggio: le coordinate sono semplici prodotti scalari, (Gram-Schmidt ne garantisce l'esistenza).
- La proiezione ortogonale è l'"ombra" di sul sottospazio (il punto più vicino); il residuo è perpendicolare. Fonda i minimi quadrati: quando non ha soluzione, si minimizza → equazioni normali (regressione lineare, adattamento di modelli a dati).
- "Ortogonale" è più forte di "indipendente"; una matrice ortogonale () conserva lunghezze e angoli (rotazioni/riflessioni). Legame col teorema spettrale: le simmetriche si diagonalizzano in base ortonormale. Prossimo passo: rette e piani (cap. 11).
Geometria e Algebra Lineare
Hai letto. Ora impara.
L'AI trasforma questo modulo in strumenti di studio personalizzati.
Geometria analitica: rette e piani
In breve
L'algebra lineare astratta trova ora la sua incarnazione più concreta: la geometria analitica dello spazio. Rette e piani — oggetti geometrici — si descrivono con equazioni (algebra), e le loro relazioni (parallelismo, incidenza, distanza, angolo) diventano conti su vettori. È la realizzazione del programma di Cartesio: tradurre la geometria in numeri. In questo capitolo impariamo a scrivere una retta e un piano in vari modi (parametrico e cartesiano), a interpretare i coefficienti come vettori direzione e vettori normali, e a risolvere i problemi tipici: quando due rette si incontrano, l'angolo tra due piani, la distanza di un punto da un piano. Tutti gli strumenti dei capitoli precedenti (prodotto scalare, vettoriale, sistemi) confluiscono qui.
🎯 Alla fine di questo capitolo saprai: rappresentare una retta e un piano in forma parametrica e cartesiana; il ruolo del vettore direzione e del vettore normale; determinare posizioni reciproche (parallele, incidenti, sghembe); calcolare angoli e distanze.
La retta nel piano e nello spazio
Perché conta: la retta è l'oggetto geometrico più semplice; capirne le due forme (parametrica e cartesiana) è il modello di tutta la geometria analitica.
Una retta si può descrivere in due modi complementari, entrambi importanti.
Forma parametrica. Una retta è individuata da un punto per cui passa e da un vettore direzione che ne dà l'inclinazione. Ogni punto della retta si ottiene partendo da e spostandosi di un multiplo di : Al variare del parametro (un numero reale), percorre tutta la retta. È la descrizione "cinematica": è la posizione iniziale, la velocità, il tempo. Nello spazio, scrivendo le componenti, diventa un sistema di tre equazioni , , .
Forma cartesiana. In alternativa, la retta è l'insieme dei punti che soddisfano una o più equazioni. Nel piano, una retta è una singola equazione lineare . Nello spazio, invece, una retta è l'intersezione di due piani, quindi si scrive come sistema di due equazioni lineari. Questo riflette un fatto dimensionale: nello spazio (3D) una sola equazione individua un piano (2D); per scendere a una retta (1D) servono due equazioni (due vincoli).
Le due forme sono equivalenti e si convertono l'una nell'altra: dalla parametrica si elimina il parametro per ottenere la cartesiana; dalla cartesiana si risolve il sistema per ottenere la parametrica. Saper passare dall'una all'altra è un'abilità di base.
🔗 Analogia. La forma parametrica è come le istruzioni di un navigatore: "parti da qui e vai dritto in questa direzione". La forma cartesiana è come una descrizione per vincoli: "la strada dove la distanza da A è uguale alla distanza da B". Due modi di indicare la stessa strada: uno dice come percorrerla, l'altro quale condizione la caratterizza.
Il piano e il vettore normale
Perché conta: il vettore normale è la chiave per angoli e distanze; l'equazione cartesiana del piano nasconde proprio il vettore perpendicolare al piano.
Un piano nello spazio si descrive anch'esso in due modi. In forma parametrica, serve un punto e due vettori direzione indipendenti (che "giacciono" sul piano): , con due parametri (il piano è bidimensionale, servono due gradi di libertà).
Ma la forma più illuminante è quella cartesiana: Qui c'è un fatto bellissimo e utilissimo: i coefficienti sono le componenti di un vettore, il vettore normale , che è perpendicolare al piano. Il piano è precisamente l'insieme dei punti tali che il vettore (che giace sul piano) è ortogonale a : la condizione , sviluppata, dà proprio . Il vettore normale determina l'orientazione del piano: leggere i coefficienti dell'equazione significa leggere direttamente la direzione perpendicolare.
Questa dualità retta/piano ↔ direzione/normale è il cuore operativo della geometria analitica: una retta è caratterizzata dal suo vettore direzione (ciò lungo cui va), un piano dal suo vettore normale (ciò a cui è perpendicolare). Quasi ogni problema si risolve identificando questi vettori e facendone prodotti scalari o vettoriali.
Posizioni reciproche, angoli e distanze
Perché conta: sono i problemi concreti della geometria analitica, e si risolvono tutti riducendoli a prodotti scalari e vettoriali tra direzioni e normali.
Con direzioni e normali in mano, i problemi geometrici classici diventano conti sistematici.
Posizioni reciproche. Due rette nello spazio possono essere: incidenti (si incontrano in un punto), parallele (stessa direzione, non si incontrano), coincidenti, o sghembe (non si incontrano e non sono parallele — caso possibile solo in 3D). Si distinguono confrontando i vettori direzione (paralleli se proporzionali) e verificando se il sistema delle loro equazioni ha soluzione (Rouché-Capelli, cap. 4). Due piani sono paralleli se hanno normali proporzionali, altrimenti si intersecano in una retta. Una retta e un piano sono paralleli se la direzione della retta è ortogonale alla normale del piano ().
Angoli. L'angolo tra due rette si calcola dai loro vettori direzione col prodotto scalare (, cap. 1/10); in particolare sono perpendicolari se . L'angolo tra due piani si calcola allo stesso modo usando i loro vettori normali. Tutto si riduce all'angolo tra i vettori caratteristici.
Distanze. La distanza di un punto da un piano ha una formula compatta che usa il vettore normale: Concettualmente è la lunghezza della proiezione dello scarto lungo la normale (cap. 10): la distanza minima si misura sempre lungo la perpendicolare. Formule analoghe (spesso con il prodotto vettoriale, cap. 1) danno la distanza punto-retta e retta-retta.
🧩 Esempio. Distanza del punto dal piano . Qui , . Numeratore: . Distanza . Il vettore normale ha fatto tutto il lavoro.
⚠️ Attenzione. Il numero di equazioni dipende dalla dimensione: nel piano (2D) la retta è una equazione; nello spazio (3D) il piano è una equazione ma la retta ne richiede due (intersezione di piani). Errore tipico: scrivere una retta nello spazio come singola equazione — quella descrive un piano. Ricorda: n° equazioni cartesiane = (dimensione ambiente) − (dimensione oggetto).
🗺️ Come si collega il tutto
La geometria analitica realizza il programma dell'intero corso: tradurre oggetti geometrici (rette, piani) in equazioni e ridurre i problemi a conti su vettori. La forma parametrica () usa il vettore direzione; la cartesiana () nasconde il vettore normale , perpendicolare al piano. Posizioni reciproche, angoli e distanze si risolvono con prodotto scalare (angoli, ortogonalità, cap. 1/10), prodotto vettoriale (distanze, cap. 1) e sistemi lineari (intersezioni, Rouché-Capelli, cap. 4). La distanza punto-piano è una proiezione lungo la normale (cap. 10). Il passo finale del corso applica questi stessi strumenti a curve di secondo grado — le coniche (cap. 12) — dove autovalori e assi principali (cap. 8-9) tornano a raddrizzare equazioni complicate.
🔑 Concetti chiave
| Termine | In una frase | Da non confondere con |
|---|---|---|
| Forma parametrica | : punto + direzione (retta), + 2 direzioni (piano) | Forma cartesiana (equazioni/vincoli) |
| Forma cartesiana | Equazioni lineari: nel piano retta = 1 eq.; nello spazio retta = 2 eq. | (n° eq. = dim ambiente − dim oggetto) |
| Vettore direzione | La direzione lungo cui va una retta | Vettore normale (perpendicolare a un piano) |
| Vettore normale | dell'eq. del piano: perpendicolare al piano | Direzione (giace *sull'*oggetto) |
| Sghembe | Rette (in 3D) né incidenti né parallele | Parallele (stessa direzione) / incidenti (si toccano) |
| Distanza punto-piano | $\dfrac{ | \mathbf n\cdot P+d |
📝 Riepilogo
- Una retta si scrive in forma parametrica (: punto + vettore direzione) o cartesiana (nel piano: 1 equazione ; nello spazio: 2 equazioni, intersezione di piani). Le due forme si convertono eliminando/introducendo il parametro.
- Un piano è (parametrica, 2 direzioni) o (cartesiana). I coefficienti sono il vettore normale, perpendicolare al piano: leggere l'equazione = leggere l'orientazione.
- Dualità operativa: la retta è data dalla sua direzione, il piano dalla sua normale. Posizioni reciproche (incidenti/parallele/sghembe), angoli e ortogonalità si risolvono con prodotto scalare tra direzioni/normali; intersezioni coi sistemi (Rouché-Capelli).
- Distanze: punto-piano (proiezione lungo la normale, cap. 10). N° di equazioni cartesiane = dim ambiente − dim oggetto (attenzione: retta nello spazio = 2 equazioni!). Prossimo passo: le coniche (cap. 12).
Geometria e Algebra Lineare
Hai letto. Ora impara.
L'AI trasforma questo modulo in strumenti di studio personalizzati.
Le coniche
In breve
Chiudiamo il corso unendo tutti i fili: le coniche — ellisse, parabola, iperbole — sono le curve descritte da equazioni di secondo grado in due variabili, e il loro studio è il trionfo dell'algebra lineare applicata alla geometria. Sono curve antichissime (le studiavano i greci come sezioni di un cono) ma governano il mondo moderno: le orbite dei pianeti sono ellissi, le traiettorie dei proiettili parabole, i profili delle antenne paraboloidi. Il problema centrale è: data un'equazione di secondo grado complicata (con termini misti ), come si riconosce di quale conica si tratta e come si "raddrizza"? La risposta usa autovalori e diagonalizzazione (cap. 8-9): è la sintesi conclusiva di tutto il corso.
🎯 Alla fine di questo capitolo saprai: cosa sono le coniche e la loro equazione generale di 2° grado; le tre coniche fondamentali (ellisse, parabola, iperbole) e le forme canoniche; come classificarle con la matrice associata e gli autovalori; il legame con diagonalizzazione e assi principali.
Che cosa sono le coniche
Perché conta: le coniche sono le curve di secondo grado, le più semplici dopo le rette; compaiono ovunque in fisica e ingegneria (orbite, traiettorie, ottica).
Le coniche sono le curve che si ottengono sezionando un cono con un piano: a seconda dell'inclinazione del taglio si ottiene un'ellisse (taglio "chiuso", di cui la circonferenza è caso particolare), una parabola (taglio parallelo a una generatrice del cono) o un'iperbole (taglio "aperto" a due rami). Questa origine geometrica, nota dall'antichità, spiega perché le tre curve, così diverse in apparenza, siano imparentate: sono facce dello stesso oggetto.
Dal punto di vista algebrico — quello dell'algebra lineare — una conica è l'insieme dei punti del piano che soddisfano un'equazione di secondo grado generale: Compaiono i termini quadratici (), quelli lineari () e il termine noto. Il termine misto è quello "fastidioso": segnala che la conica è ruotata rispetto agli assi cartesiani. Se non ci fosse (e senza termini lineari) l'equazione sarebbe subito riconoscibile; la sfida è proprio gestire quel termine misto — ed è qui che entra in gioco tutto il macchinario di autovalori e diagonalizzazione.
🔗 Analogia. Le coniche sono come le ombre di una torcia puntata su un muro. Tieni la torcia dritta e vedi un cerchio; inclinala un po' e diventa un'ellisse; inclinala fino a che il cono di luce è parallelo al muro e l'ombra si "apre" in una parabola; oltre, in un'iperbole. Un unico cono di luce, infinite curve a seconda dell'angolo: esattamente le sezioni coniche.
Le tre coniche e le forme canoniche
Perché conta: le forme canoniche sono le equazioni "pulite" da cui si leggono a colpo d'occhio tutte le proprietà della curva.
Quando una conica è "ben posizionata" (centrata nell'origine e con gli assi allineati agli assi cartesiani), la sua equazione assume la forma canonica, semplice e parlante:
Ellisse: . Curva chiusa e limitata, simmetrica rispetto a entrambi gli assi; e sono i semiassi. Se è una circonferenza di raggio . Proprietà focale: la somma delle distanze da due punti fissi (i fuochi) è costante. Le orbite dei pianeti sono ellissi con il Sole in un fuoco (prima legge di Keplero).
Iperbole: . Due rami aperti che si allontanano avvicinandosi a due rette, gli asintoti. Proprietà focale: la differenza (in valore assoluto) delle distanze da due fuochi è costante. Governa i sistemi di navigazione e le traiettorie di fuga.
Parabola: (o ). Un solo ramo aperto, simmetrico rispetto a un asse; ogni punto è equidistante da un fuoco e da una retta (direttrice). È la traiettoria di un proiettile (moto sotto gravità) e la forma che concentra i raggi paralleli in un punto — da cui antenne paraboliche, fari, specchi dei telescopi.
Il segno dei termini quadratici distingue i tre casi: entrambi positivi (stesso segno) → ellisse; segni opposti → iperbole; uno dei due assente (manca o ) → parabola. Riconoscere la conica dalla forma canonica è immediato; il problema è ricondurvi un'equazione generale.
Classificazione con gli autovalori
Perché conta: è il punto in cui tutta l'algebra lineare del corso (matrici simmetriche, autovalori, diagonalizzazione) converge per risolvere un problema geometrico concreto.
Come si classifica e si "raddrizza" una conica generale con il termine misto ? Con l'algebra lineare. La parte quadratica si scrive in forma matriciale usando una matrice simmetrica: (Il coefficiente fuori diagonale distribuisce il termine misto in modo simmetrico.) Ora si applica il teorema spettrale (cap. 9): essendo simmetrica, è diagonalizzabile con autovettori ortogonali. I suoi autovalori e i suoi autovettori danno tutto:
- gli autovettori individuano gli assi principali della conica (le direzioni "naturali" lungo cui è simmetrica): ruotando gli assi per allinearli a essi, il termine misto sparisce;
- gli autovalori diventano i coefficienti dei termini quadratici nella forma canonica, e il loro segno classifica la conica.
La regola di classificazione (per coniche non degeneri) si legge dagli autovalori — equivalentemente dal determinante di , che è :
- (autovalori stesso segno) → ellisse (o circonferenza);
- (autovalori segni opposti) → iperbole;
- (un autovalore nullo) → parabola.
Diagonalizzare la matrice della conica è ruotare gli assi per raddrizzare la curva: l'operazione astratta del cap. 9 ha qui un significato geometrico tangibile. È la dimostrazione più elegante che l'algebra lineare non è un formalismo fine a sé stesso, ma lo strumento che risolve problemi geometrici reali.
🧩 Esempio. Conica . La matrice è ; . Autovalori: e , di segni opposti: è un'iperbole. Nel riferimento degli assi principali (autovettori) l'equazione diventa , forma canonica pulita, senza termine misto. ✓
⚠️ Attenzione. Esistono anche coniche degeneri: quando l'equazione di 2° grado si "spezza" in casi limite (una coppia di rette, una retta doppia, un punto, o l'insieme vuoto). Si riconoscono perché la matrice completa (che include anche i termini lineari e noto) ha determinante nullo. La classificazione con gli autovalori di () distingue ellisse/parabola/iperbole; il determinante della matrice completa distingue conica non degenere da degenere.
🗺️ Come si collega il tutto
Le coniche (ellisse, parabola, iperbole) sono le curve di secondo grado e chiudono il corso riunendone i temi. La geometria analitica (cap. 11) fornisce il linguaggio equazione↔curva; la matrice simmetrica della parte quadratica invoca il teorema spettrale (cap. 9): i suoi autovalori (cap. 8) classificano la conica ( = : ellisse, iperbole, parabola) e i suoi autovettori danno gli assi principali lungo cui diagonalizzare = ruotare = raddrizzare la curva, eliminando il termine misto. Il prodotto scalare e l'ortogonalità (cap. 10) garantiscono che gli assi principali siano perpendicolari. Le coniche sono così la sintesi finale: mostrano che matrici, determinanti, autovalori e diagonalizzazione, nati come strumenti astratti, risolvono un problema geometrico concreto e antichissimo — il coronamento di Geometria e Algebra Lineare.
🔑 Concetti chiave
| Termine | In una frase | Da non confondere con |
|---|---|---|
| Conica | Curva di 2° grado: sezione di un cono | Retta (1° grado, cap. 11) |
| Ellisse | : chiusa; autovalori stesso segno () | Circonferenza (ellisse con ) |
| Iperbole | : 2 rami, asintoti; autovalori opposti () | Parabola (un autovalore nullo) |
| Parabola | : 1 ramo; un autovalore nullo () | Iperbole (due rami, ) |
| Termine misto | Segnala conica ruotata; sparisce diagonalizzando | (assente ⇒ assi già allineati) |
| Assi principali | Direzioni degli autovettori di : raddrizzano la conica | (diagonalizzare = ruotare a questi assi) |
📝 Riepilogo
- Le coniche sono le curve di secondo grado , ottenute sezionando un cono: ellisse (chiusa; circonferenza se ), parabola (un ramo, traiettorie/ottica), iperbole (due rami con asintoti). Il termine misto indica che la conica è ruotata.
- Le forme canoniche (curva centrata e allineata) si leggono a colpo d'occhio: ellisse , iperbole , parabola . Il segno dei termini quadratici distingue i casi.
- Classificazione: la parte quadratica si scrive con la matrice simmetrica A=\begin{psmallmatrix}a&b/2\\b/2&c\end{psmallmatrix}; per il teorema spettrale i suoi autovalori classificano (): ellisse, iperbole, parabola. Gli autovettori sono gli assi principali: diagonalizzare = ruotare per eliminare il termine misto.
- Le coniche degeneri (coppie di rette, punti…) si riconoscono dal determinante nullo della matrice completa . Le coniche sono la sintesi conclusiva del corso: autovalori e diagonalizzazione (cap. 8-9), astratti, risolvono un problema geometrico concreto.
Geometria e Algebra Lineare
Hai finito il corso. Ora studia davvero.
Usa l'AI per consolidare tutto quello che hai studiato.