News on cloud, AI and the tech world I think is worth knowing: a few short cards — some technical, some for everyone — always with a link to the source.
How it works: an automated pipeline with public source code (GitHub Actions + Gemini) pulls news from the sources, summarizes it and opens a Pull Request; I approve, discard or add a note. Nothing publishes itself. (Cards are written in Italian.)
AI & LLM
AWS & Cloud
Trends
Each dot is a pick: the closer to the center, the more recent. Click a dot to jump to its card.
Amazon ha aumentato i prezzi dei suoi prodotti Echo, Fire TV e Kindle fino al 60%, citando significativi aumenti dei costi dei componenti di memoria e archiviazione. I prodotti più economici, come l'Echo Dot, sono stati i più colpiti dall'aumento.
AWS Glue 6.0 è ora disponibile, offrendo una riduzione del 30% sui prezzi e introducendo il supporto completo per Apache Iceberg v3. Questa versione include anche il supporto per versioni più recenti di Apache Hudi e Delta Lake, migliorando la produttività degli sviluppatori.
Amazon SageMaker AI Studio ora offre raccomandazioni di inferenza per l'Intelligenza Artificiale Generativa, fornendo una guida a basso o nessun codice per trovare la migliore configurazione di inferenza. Questo estende l'infrastruttura di benchmarking API-based a team che preferiscono un flusso di lavoro visivo.
Amazon DynamoDB ha introdotto la ricerca vettoriale in tempo reale, una nuova funzionalità per indicizzare e cercare vettori su larga scala. Questa novità permette di gestire dataset di miliardi o trilioni di vettori senza sacrificare velocità, scalabilità o accuratezza.
Meta ha ampliato la sua offerta di strumenti di coding basati su AI con il lancio di Muse Code, un nuovo agente. Questo strumento promette di gestire compiti complessi all'interno di software altrettanto complessi, migliorando l'efficienza degli sviluppatori.
Jeff Dean, figura leggendaria di Google, e altri importanti ricercatori AI stanno lasciando l'azienda per fondare una propria startup. Il loro obiettivo è utilizzare l'intelligenza artificiale per accelerare il processo di scoperta scientifica.
Amazon Bedrock ha annunciato una significativa riduzione dei prezzi per i modelli GPT-5.6 Luna e GPT-5.6 Terra di OpenAI. A partire dal 30 luglio 2026, i prezzi per l'inferenza on-demand di GPT-5.6 Luna saranno ridotti dell'80%, mentre quelli per GPT-5.6 Terra diminuiranno del 20%.
Amazon CloudWatch ora supporta la raccolta di metriche Prometheus dalla tua infrastruttura AWS tramite collector completamente gestiti. Questo permette di monitorare carichi di lavoro su Amazon EKS, EC2, ECS, MSK e OpenSearch Service senza dover implementare o gestire agenti.
Hank Green, noto YouTuber, ha espresso rammarico per l'uso intensivo dei modelli linguistici di grandi dimensioni (LLM), definendolo "non salutare" per sé e per il mondo. Ha descritto l'interazione con l'AI come una fonte di dopamina eccessiva, indicando un potenziale impatto negativo sulla salute mentale.
AWS ha annunciato la ricerca preliminare di aws-bench, un benchmark open source progettato per misurare l'accuratezza e l'efficienza degli agenti AI nello svolgere attività reali su AWS. Questo strumento fornisce un modo oggettivo e riproducibile per valutare le prestazioni e diagnosticare i fallimenti degli agenti che operano sull'infrastruttura AWS.
Le biblioteche statunitensi stanno organizzando workshop molto richiesti su come 'evitare l'AI', in risposta alla crescente insoddisfazione del pubblico verso le grandi aziende tecnologiche. Questi incontri offrono ai cittadini strumenti e conoscenze per navigare un mondo sempre più influenzato dall'intelligenza artificiale, permettendo loro di fare scelte più consapevoli.
AWS ha reso disponibile Claude Opus 5, il modello Opus più avanzato, che offre miglioramenti significativi nella programmazione, nella gestione di agenti a lungo termine e in lavori professionali complessi. Questo modello è compatibile con la 'zero data retention' (ZDR), garantendo maggiore privacy e sicurezza per i dati degli utenti.
AWS Network Load Balancer (NLB) ora permette di definire regole per instradare il traffico in base al tipo di indirizzo IP sorgente. Questo consente a un singolo NLB dual-stack di gestire traffico IPv4 e IPv6, mantenendo l'indirizzo IP originale del client.
Cactus Hybrid ha sviluppato un sistema che permette a Gemma 4, un modello di linguaggio, di identificare quando le sue risposte sono errate. Questo progetto mira a migliorare l'affidabilità dei modelli di intelligenza artificiale.
Science Corporation ha ottenuto l'approvazione nell'Unione Europea per il suo chip che mira a ripristinare la vista. L'azienda punta a generare 100 milioni di dollari di ricavi annuali in questo settore.
Amazon S3 ha eliminato il requisito minimo di 30 giorni per la transizione a S3 Standard-Infrequent Access (S3 Standard-IA) e S3 One Zone-Infrequent Access (S3 One Zone-IA). Ora è possibile spostare gli oggetti in queste classi di storage a basso costo (fino al 40% in meno) non appena vengono creati, rendendole ideali per backup e log.
Netflix ha acquisito InterPositive, una startup co-fondata da Ben Affleck, per 587 milioni di dollari in contanti. Questa mossa suggerisce un crescente interesse delle grandi aziende di intrattenimento nell'integrare l'intelligenza artificiale (AI) nei processi di produzione cinematografica.
xAI ha rilasciato Grok Build, un ambiente di sviluppo per agenti di coding che offre un'interfaccia utente testuale (TUI) a schermo intero e interattiva. Scritto in Rust, questo strumento è progettato per essere estensibile e facilitare lo sviluppo di agenti AI per la programmazione.
AWS Lambda ora supporta l'utilizzo di bucket Amazon S3 gestiti direttamente dagli utenti per l'archiviazione del codice. Questo elimina i limiti di storage e riduce i tempi di attivazione delle funzioni, rimuovendo il passaggio di copia intermedio.
Le istanze Amazon EC2 G7e, accelerate dalle GPU NVIDIA RTX PRO 6000 Blackwell Server Edition, sono ora disponibili in nuove regioni AWS, tra cui Europa (Francoforte, Stoccolmo) e Asia Pacifico (Mumbai). Queste istanze offrono prestazioni di inferenza fino a 2.3 volte superiori rispetto alle G6e, ideali per modelli linguistici di grandi dimensioni (LLM) e AI agentica.
OpenAI ha rilasciato una tastiera illuminata, pensata per essere abbinata alla sua applicazione di coding assistita da intelligenza artificiale, Codex. Questa novità arriva mentre l'azienda è coinvolta in una disputa legale con Apple riguardo a presunti furti di proprietà intellettuale hardware.
My note
Il gadget in sé è una tiratura limitata da 230 dollari, ma la manopola che dosa quanto deve
«ragionare» l’agente mi piace parecchio: è l’interazione con l’AI che diventa un oggetto fisico
sulla scrivania. Da capire se resta una trovata di marketing o se apre un filone.
AWS Database Migration Service (DMS) Schema Conversion supporta ora l'automazione tramite agenti AI. Gli sviluppatori possono connettere agenti di coding come Kiro, Claude Code e Cursor a DMS Schema Conversion per eseguire flussi di lavoro di migrazione completi usando il linguaggio naturale direttamente dall'IDE.
Colibri è un progetto che permette di eseguire il modello GLM-5.2 (744B MoE) su macchine consumer con soli 25GB di RAM. È scritto in puro C, senza dipendenze, e carica gli 'expert' del modello direttamente dal disco, rendendo possibile l'esecuzione di un modello immenso su hardware limitato.
My note
Bello il concetto di gerarchia unificata VRAM→RAM→disco, ma a 0.1 token/s resta un esperimento: lo tengo d’occhio come pattern, non come tool.
Amazon EMR on EKS ora include un agente di troubleshooting per Apache Spark. Questo agente permette ai data engineer di diagnosticare i fallimenti dei job tramite linguaggio naturale, ottenendo analisi delle cause e raccomandazioni di codice PySpark senza dover navigare manualmente i log distribuiti.
Amazon RDS per Oracle supporta ora Oracle Database 26ai, l'ultima release Long Term Support di Oracle, con integrazione diretta con Amazon Bedrock. Questo permette di sfruttare la funzione Select AI di Oracle per generare query SQL da linguaggio naturale, accedendo a modelli come Anthropic Claude e Amazon Nova.
My note
Interessante il pattern più che l’annuncio: l’integrazione con l’LLM si sposta dentro il database gestito invece di stare nel codice applicativo. Per chi come me costruisce piattaforme GenAI su AWS, vuol dire un pezzo di RAG/text-to-SQL in meno da mantenere a mano.
Amazon S3 Vectors è ora disponibile nelle regioni AWS GovCloud (US), offrendo uno storage vettoriale dedicato per agenti AI, inferenza, RAG e ricerca semantica. È progettato per fornire la stessa elasticità e durabilità di Amazon S3 con API specifiche per i vettori.
My note
Lo storage vettoriale direttamente su S3 mi incuriosisce soprattutto per i costi: per tanti casi d’uso RAG un vector DB dedicato è sovradimensionato. E l’arrivo in GovCloud è il segnale che AWS lo considera pronto anche per ambienti regolamentati.
AWS Builder Center offre ora ambienti sandbox gratuiti e a tempo limitato per i workshop, eliminando la necessità di un account AWS personale o di una carta di credito. Questo permette a sviluppatori di ogni livello di sperimentare in sicurezza senza preoccuparsi dei costi.
My note
Da segnalare a chiunque stia studiando per una certificazione AWS: sperimentare senza account personale né carta di credito toglie l’ansia della bolletta a fine mese. L’avrei voluto quando ho iniziato io.
AWS
Cloud
Formazione
Sviluppatori
Ask Matteo
I'm a small RAG indexed on everything Matteo has built — including myself. Ask me about his projects, the stack he uses, or what he can do.
Answers are generated with Google Gemini. Don't enter personal data.