Deep Reinforcement Learning: cos’è e come funziona l’apprendimento per rinforzo profondo
Cos'è il deep reinforcement learning e come funziona: ciclo agente-ambiente, algoritmi da DQN ad AlphaGo, applicazioni reali e limiti da conoscere.
Cos'è il deep reinforcement learning e come funziona: ciclo agente-ambiente, algoritmi da DQN ad AlphaGo, applicazioni reali e limiti da conoscere.
Meta entra nella guerra degli agenti di coding con Muse Code, che lavora da terminale, e il nuovo modello Muse Spark 1.2 con un tier a…
Demis Hassabis lascia la guida quotidiana di Google DeepMind e diventa chief scientist di Alphabet. Jeff Dean e altri big fondano Discovery Loop.
Dal 4 settembre 2026 Google inizia a rimuovere Assistant da Android, Wear OS e Android Auto: al suo posto arriva Gemini. Ecco cosa cambia per te.
Cloudflare lancia Wallets e cloudflare.pay: identità stabile e portafogli in stablecoin per far pagare gli agenti AI in autonomia, entro limiti di spesa.
Nvidia investe in Safe Superintelligence, il laboratorio di Ilya Sutskever: accesso alla piattaforma Vera Rubin e potenza di calcolo moltiplicata per dieci.
Microsoft introduce budget di token per divisione e sceglie un modello di default più economico. Jay Parikh: il tokenmaxxing non è l'obiettivo.
Uno studio su oltre 2.500 lettori mostra che le storie scritte dall'AI vengono giudicate migliori, ma solo se non sai che le ha prodotte una macchina.
Elon Musk anticipa Grok 4.6 e Grok 4.7: 1.500 e 2.100 miliardi di parametri, una nuova fase di post-training e un rilascio a cadenza serrata.
Mistral rilascia Shieldstral, un classificatore di sicurezza open da 3 miliardi di parametri che valuta testo e immagini adattandosi alle policy.
La startup del cloud AI Volta esce dallo stealth con 300 milioni raccolti, una valutazione da 2,4 miliardi e un contratto da 10 miliardi con Anthropic.
OpenAI risponde pubblicamente alla causa di Apple sui presunti segreti commerciali rubati: ecco cosa sostiene e perché accusa Apple di sbagliare.
Anaconda acquisisce Enkrypt AI e integra red teaming, guardrail e conformità nella piattaforma per proteggere gli agenti AI in azienda.