EN IT

AI & Lavoro — Osservatorio settimanale · 4–11 settembre 2026

La settimana in cui gli annunci hanno incontrato le prove: i valutatori indipendenti misurano GPT-6 Astra e ne ridimensionano il valore sul lavoro reale, mentre il rapporto Anthropic mostra un cybercrimine ormai alla portata di chiunque. E i dati di Stanford colpiscono i più giovani.

AI & Lavoro — Osservatorio settimanale · 4–11 settembre 2026
Resta aggiornato
Non perderti il prossimo Osservatorio Mondo
Ricevi una email a ogni nuovo Osservatorio Mondo. Gratis, disiscrizione in un clic.
Solo aggiornamenti Osservatorio.
Fatto! Controlla la tua email per confermare l'iscrizione.
Qualcosa è andato storto. Riprova tra poco.
Vuoi anche l'Osservatorio Mondo via email?
Sei già con noi: aggiungi l'Osservatorio Mondo alle tue email dalle preferenze.
Gestisci le tue email →
Osservatorio Mondo · AI & Lavoro
AI & Lavoro — Osservatorio settimanale · 4–11 settembre 2026
11 settembre 2026 — Fabio Gentili observatoryAI & Lavoro
Editoriale
Se la settimana scorsa era stata quella delle dichiarazioni — tre modelli di frontiera in settantadue ore e l'“era dell'AGI” proclamata a voce alta —, questa è stata la settimana in cui le dichiarazioni hanno incontrato le prove. Due documenti datati hanno fatto da perno al periodo. Il 9 settembre i valutatori indipendenti di Artificial Analysis hanno misurato GPT-6 Astra: potente e insolitamente economico — pareggia Claude Fable 5.1 su entrambi gli indici a una frazione del costo e dimezza le allucinazioni — ma più debole del proprio predecessore su GDPval-AA, il test più vicino al lavoro economico reale. Il 10 settembre il rapporto di Anthropic sull'abuso dei modelli ha certificato che questa classe di capacità è già uno strumento pronto all'uso per il cybercrimine. E i dati di Stanford collocano il vero danno occupazionale non nei licenziamenti eclatanti, ma nei posti d'ingresso che non vengono più offerti. La settimana non smentisce la precedente: la mette alla prova. Capacità, valore e pericolo cominciano finalmente a essere misurati.

Blocchi tematici della settimana
🤖
01 · AI
Evoluzione dell'AI — i principali sviluppi
Tensione media
Le prove indipendenti arrivano su GPT-6 Astra: più economico e affidabile, ma il primato è conteso
Artificial Analysis (9 set): Astra pareggia Claude Fable 5.1 su entrambi gli indici principali — a circa il 40% del costo per compito (Intelligence) e al 60% (Coding Agent). Guadagna 6 punti su GPT-5.6 Sol; al massimo sforzo usa ~27.000 token contro i 78.000 di Fable 5.1 per lo stesso punteggio.
Balzo di affidabilità: le allucinazioni scendono “from 92% to 51% at max effort” (“dal 92% al 51% al massimo sforzo”, Artificial Analysis), con l'accuratezza in aumento di 4 punti; +90 punti Elo su AA-Briefcase (lavoro intellettuale di settimane).
In testa sull'automazione: Terminal-Bench v4.0 al 59% e AutomationBench-AA al 69% (flussi di lavoro in stile Zapier).
Cautela sui confronti: l'indice è stato aggiornato durante la settimana (v4.2 il 4 set, v4.3 il 7 set): i nuovi punteggi non sono confrontabili con quelli di sette giorni fa. Meglio leggere i piazzamenti relativi che i valori assoluti.
La frontiera non si ferma: il 7 settembre il laboratorio cinese OpenBMB ha rilasciato il compatto MiniCPM5-2B.
💼
02 · LAVORO
AI e lavoro — sostituzione e trasformazione
Tensione alta
Primato nei benchmark ≠ sostituzione del lavoro reale — e il gradino d'ingresso continua a sparire
Il segnale in controtendenza: su GDPval-AA v2 (compiti economicamente rilevanti in 44 professioni) Astra perde ~45 punti Elo rispetto a Sol — primeggia sugli indici di intelligenza e programmazione ma arretra sul lavoro d'ufficio vero, usando molti meno passaggi (24 contro i 45 di Sol e i 60 di Fable/Opus). La fretta si paga.
Aggiornamento Stanford (fino a giugno 2026): i 22-25enni nelle professioni più esposte all'AI sono oggi il 19% sotto i coetanei meno esposti, dal 13% di un anno prima. Meccanismo: mancata assunzione, non licenziamenti. (Brynjolfsson, Chandar, Chen; oltre 26 milioni di buste paga.)
La distinzione decisiva: dove l'AI automatizza, l'occupazione d'ingresso cala; dove potenzia, tiene o cresce. La scelta — rimpiazzare o rafforzare — è umana, non tecnologica.
Perché conta: il gradino d'ingresso è dove si impara il mestiere; eroderlo mette a rischio la classe dirigente di domani, non solo i posti di oggi.
🎓
03 · COMPETENZE
Automazione e riqualificazione
Tensione media
La riqualificazione deve spostarsi a monte, mentre si rompe la scala del «si impara sul campo»
Le proporzioni (OCSE / WEF): il 59% della forza lavoro mondiale (~120 milioni) va riqualificato entro il 2030; circa l'11% rischia di non riceverne. Il 74% delle imprese dichiara piani, ma solo un terzo dei dipendenti ha avuto formazione in sei mesi; il 61% ne vorrebbe di più.
Il cambio di natura: se le imprese smettono di assumere i giovani perché i compiti elementari sono automatizzati, la formazione non può più arrivare tardi — deve entrare in scuola e università e puntare su giudizio, supervisione, capacità di dirigere i sistemi.
Segnale dal pubblico: l'Ufficio europeo per l'AI ha aperto il reclutamento per ~40 figure (scadenza 8 set), portando l'organico a ~165: lo Stato ora contende al mercato le stesse figure ibride, metà tecniche e metà regolatorie.
🚀
04 · RUOLI
Nuove professioni e opportunità
Tensione bassa
L'AI engineer resta il ruolo n.1 — e la difesa informatica in chiave AI è il filone che cresce più in fretta
Il mercato centrale: l'AI engineer è il titolo a più rapida crescita negli USA (+143% su base annua); i ruoli AI/ML/dati superano le 49.200 posizioni (+163%). Le professioni con competenze AI crescono ~8 volte il mercato; premio retributivo ~62%.
Il fronte emergente: il forward deployed engineer cresce di circa l'800% (gen-set); addestratori e valutatori umani +25-35% l'anno; si consolidano governance dell'AI e operazioni sui modelli.
Il filone della settimana: il rapporto Anthropic rende la supervisione degli agenti e la difesa informatica AI-native una funzione di massa — riconoscere, isolare e contenere campagne condotte da agenti.
Il nodo irrisolto: le opportunità più ricche si aprono in alto (esperienza, supervisione) mentre il gradino d'ingresso che costruisce quell'esperienza si assottiglia.
⚖️
05 · ETICA
Etica e temi etici
Tensione alta
L'Ufficio europeo per l'AI passa all'azione — nel mirino gli algoritmi di assunzione, credito e sanità
Prima ondata di ispezioni (settembre): CNIL, BfDI e AESIA si concentrano su selezione dei curriculum (HR), merito creditizio (credito al dettaglio) e triage clinico — gli algoritmi quotidiani che decidono chi ottiene un colloquio, un prestito o una corsia preferenziale.
La tensione: le norme sui sistemi ad alto rischio nel reclutamento sono rinviate a dicembre 2027, ma i regolatori indagano già sugli strumenti di selezione — la vigilanza precede la scadenza sanzionatoria per mappare il terreno.
Parallelo globale: il Senato brasiliano è atteso al voto sul disegno di legge 2338/2023 il 16 settembre (ancora da venire mentre scriviamo).
Il dilemma della divulgazione: il rapporto Anthropic lo riapre — rendere pubblico il pericolo è la prima difesa, ma non è mai un gesto neutro.
⚠️
06 · RISCHI
I rischi dell'AI
Tensione alta
Il rapporto Anthropic: cybercrimine «con la pressione di un pulsante»
Il rapporto (10 set): abusi neutralizzati fra dicembre 2025 e agosto 2026 in sette aree di danno; attività legate ad affiliati di ShinyHunters, al gruppo russo Midnight Blizzard e ad attori statali cinesi — alcune campagne condotte in larga parte in autonomia dagli agenti.
Il cambiamento economico: gli attacchi sofisticati non richiedono più operatori sofisticati — il modello accompagna l'aggressore lungo ricognizione, strumenti, sfruttamento ed esfiltrazione. Klein: “literally with the click of a button, and then with minimal human interaction” (“letteralmente con la pressione di un pulsante, e poi con un'interazione umana minima”).
La controprova: è la «soglia critica» cyber di Astra, astratta la settimana scorsa, resa concreta — e la lettera dei 116 firmatari di agosto che si avvera.
Sullo sfondo: il 92% dei professionisti della sicurezza è preoccupato per gli agenti (Darktrace); l'agenzia britannica NCSC emana linee guida formali. L'attacco corre ancora più veloce della difesa.
🎙️
07 · VOCI
Voci autorevoli
Tensione media
Klein sugli attacchi «a un clic» · Artificial Analysis sulla misura · i «canarini» di Brynjolfsson
Jacob Klein (Anthropic): attacchi “literally with the click of a button, and then with minimal human interaction” (“con la pressione di un pulsante, e poi con un'interazione umana minima”) — gli attacchi sofisticati non richiedono più aggressori sofisticati.
Artificial Analysis: Astra “ties Claude Fable 5.1 at ~40% of the cost per task” (“pareggia Fable 5.1 a circa il 40% del costo per compito”), allucinazioni “from 92% to 51%” — ma arretra su GDPval-AA, il test più vicino al lavoro reale.
Erik Brynjolfsson (Stanford): i giovani come “canaries in the coal mine” (“canarini nella miniera”); l'AI che automatizza riduce l'occupazione, quella che potenzia la preserva.
Geoffrey Hinton (sfondo): nessuna nuova dichiarazione databile; tesi ricorrente — “massive unemployment and a huge rise in profits” (“disoccupazione di massa e un enorme aumento dei profitti”), attribuita non alla tecnologia ma al sistema capitalistico.
Altman e Amodei (sfondo, 28 lug): la lettera “Pacing the Frontier” — “we may have to pace the rate of AI development” (Altman) — oggi suona quasi descrittiva.

Focus / Approfondimento
Focus
Misurata, non proclamata: la settimana in cui le promesse dell'AI hanno incontrato le prove
Benchmark indipendenti, un arretramento sul lavoro reale, la stretta sui giovani e un rapporto sull'AI usata per attaccare tirano tutti nella stessa direzione.

La settimana scorsa l'AI si è dichiarata; questa è stata misurata. Artificial Analysis ha confermato che GPT-6 Astra è davvero potente e insolitamente economico, ma più debole del predecessore sul test più vicino al lavoro economico reale. Anthropic ha mostrato che la stessa classe di capacità è già uno strumento pronto all'uso per il cybercrimine. E i dati di Stanford collocano il vero danno occupazionale non nei licenziamenti eclatanti, ma nei posti d'ingresso che non vengono più offerti.

GPT-6 Astra (Artificial Analysis, 9 set): pareggia Fable 5.1 sui due indici a ~40%/~60% del costo · allucinazioni 92%→51% · +90 Elo AA-Briefcase · Terminal-Bench v4.0 59% · AutomationBench-AA 69% · −45 Elo GDPval-AA v2 · 24 turni contro 45/60 · Stanford: 22-25enni esposti all'AI 19% sotto la media (era 13%) · rapporto Anthropic 10 set: 7 aree di danno, dic 2025–ago 2026
Literally with the click of a button, and then with minimal human interaction. — Jacob Klein, responsabile threat intelligence, Anthropic, rapporto del 10 settembre 2026 (“con la pressione di un pulsante, e poi con un'interazione umana minima”)

Da tenere d'occhio nei prossimi sette giorni: (1) ulteriori repliche indipendenti dei benchmark di Astra e verifiche sul lavoro reale (stile GDPval); (2) la portata delle ispezioni dell'Ufficio europeo per l'AI su HR, credito e sanità; (3) il voto del Senato brasiliano del 16 settembre sul ddl 2338; (4) le conseguenze del rapporto Anthropic ed eventuali divulgazioni analoghe; (5) i dati Challenger di ottobre dopo l'agosto più tiepido sui licenziamenti da AI; (6) l'adozione di Astra a 10/50 dollari nelle imprese.


Conclusioni
Che cosa dice la settimana, e cosa guardare adesso

La settimana 4-11 settembre 2026 è quella in cui le proclamazioni dei giorni precedenti sono state messe alla prova. La valutazione indipendente ha confermato GPT-6 Astra come modello potente e straordinariamente efficiente sul piano dei costi — ma più debole del predecessore sul benchmark più vicino al lavoro economico reale, a ricordare che dominare le classifiche non equivale a svolgere un mestiere.

Sul lavoro, il segnale si è spostato dai licenziamenti eclatanti al gradino d'ingresso che scompare: i dati di Stanford mostrano i più giovani a pagare il conto attraverso la mancata assunzione, con la scelta fra automazione e potenziamento — rimpiazzare o rafforzare — saldamente in mani umane. Sul rischio, il rapporto Anthropic ha trasformato l'astratta «soglia critica» cyber della settimana scorsa in un mercato documentato, dove gli attacchi sofisticati non richiedono più aggressori sofisticati.

Da guardare adesso: le verifiche indipendenti di Astra sul lavoro reale; le ispezioni europee su assunzioni, credito e sanità; il voto brasiliano del 16 settembre; e i dati macro di ottobre.


Fonti e riferimenti
01
Artificial Analysis — Benchmarking GPT-6 Astra
9 settembre 2026
https://artificialanalysis.ai/articles/benchmarking-gpt-6-astra
02
Artificial Analysis — Intelligence Index v4.3
7 settembre 2026
https://artificialanalysis.ai/articles/artificial-analysis-intelligence-index-v4-3
03
Artificial Analysis — Intelligence Index v4.2
4 settembre 2026
https://artificialanalysis.ai/articles/artificial-analysis-intelligence-index-v4-2
04
WinBuzzer — GPT-6 Astra: accesso a fasi, dubbi sui benchmark
4 settembre 2026
https://winbuzzer.com/2026/09/04/gpt-6-astra-arrives-with-major-gains-staged-access-and-new-questions-about-its-benchmarks-xcxwbn/
05
Anthropic — Detecting and countering misuse of AI: September 2026
10 settembre 2026
https://www.anthropic.com/threat-intelligence-report-september-2026
06
The Next Web — Anthropic's Claude misuse report
10 settembre 2026
https://thenextweb.com/news/anthropic-claude-misuse-threat-intelligence-report
07
Rappler — Anthropic disrupts Russian, Chinese AI campaigns
10 settembre 2026
https://www.rappler.com/technology/anthropic-threat-intelligence-report-september-2026/
08
Stanford — Canaries in the Coal Mine? (aggiornamento)
agosto 2026
https://digitaleconomy.stanford.edu/publications/canaries-in-the-coal-mine/
09
Slashdot — AI Is Hitting Entry-Level Jobs Hardest, Stanford Study Finds
25 agosto 2026
https://slashdot.org/story/26/08/25/1756243/ai-is-hitting-entry-level-jobs-hardest-stanford-study-finds
10
OCSE — AI and skills (rapporto completo)
2026
https://www.oecd.org/en/publications/ai-and-skills_f843b352-en/full-report.html
11
Forkast — EU AI Office Hiring 40 Enforcement Staff
settembre 2026
https://forkast.news/eu-ai-office-hiring-40-enforcement-staff-signals-q4-crackdown/
12
Cubbbix — AI Regulation News September 2026
settembre 2026
https://cubbbix.com/blog/ai-regulation-september-2026-global-update
13
herohunt.ai — Fastest Growing AI Roles in 2026
2026
https://www.herohunt.ai/blog/fastest-growing-ai-roles-in-2026-data-and-rankings/
14
Mercor — New Jobs & Roles Emerging Due to AI in 2026
2026
https://www.mercor.com/resources/experts/new-artificial-intelligence-job-opportunities/
15
Darktrace — State of AI Cybersecurity 2026 (92% preoccupati dagli agenti)
2026
https://www.darktrace.com/blog/state-of-ai-cybersecurity-2026-92-of-security-professionals-concerned-about-the-impact-of-ai-agents
16
TechCrunch — Sam Altman is ready to decelerate
28 luglio 2026
https://techcrunch.com/2026/07/28/sam-altman-is-ready-to-decelerate/
17
Fortune — «Godfather of AI» predicts mass unemployment
settembre 2026
https://fortune.com/article/godfather-of-ai-geoffrey-hinton-massive-unemployment-warning-big-tech-replacing-workers/
Fonti e classificazione: fonti pubbliche del 4-11 settembre 2026, con antecedenti datati (l'aggiornamento Stanford di agosto 2026; la lettera “Pacing the Frontier” del 28 luglio; la lettera dei 116 firmatari di fine agosto; il rilascio di GPT-6 Astra del 3 settembre, trattato la settimana scorsa). Redatto l'11 settembre 2026, ore 08:01 CEST (06:01 UTC; 23:01 PT del 10 set); ogni evento citato come avvenuto è anteriore a quell'istante. L'ambiente di calcolo della sessione (bash) non era disponibile per un problema noto di sistema: gli orari sono stati verificati manualmente e non con il comando date. Le dichiarazioni in inglese sono citate in originale con glossa italiana; nessuna citazione tradotta è spacciata per originale. CONFIRMED: l'analisi Artificial Analysis (9 set) e gli aggiornamenti dell'indice (v4.2 4 set, v4.3 7 set); il rapporto Anthropic (10 set) e la dichiarazione di Klein; il reclutamento dell'Ufficio europeo per l'AI. REPORTED: lo studio di Stanford; i dati OCSE/WEF sulla riqualificazione; i dati sulle nuove professioni; l'ondata di ispezioni europee; il dato Darktrace; le dichiarazioni ricorrenti di Hinton. EXPECTED: il voto brasiliano del 16 settembre; ulteriori repliche dei benchmark. Il documento non costituisce consulenza di investimento, legale o regolatoria.
Share WhatsApp Telegram Gmail LinkedIn