NovitàHiggs Audio v3: voce sintetica open in italiano, gratis
Boson AI ha pubblicato Higgs Audio v3, un modello text-to-speech open da 4 miliardi di parametri: voci espressive in oltre cento lingue, italiano incluso, e clonazione vocale.
Nuovi modelli, prodotti, funzioni, aggiornamenti e strumenti di intelligenza artificiale: tutto quello che esce di nuovo, raccontato ogni giorno.
NovitàBoson AI ha pubblicato Higgs Audio v3, un modello text-to-speech open da 4 miliardi di parametri: voci espressive in oltre cento lingue, italiano incluso, e clonazione vocale.
NovitàIl 9 giugno Anthropic ha rilasciato Claude Fable 5, lo stesso modello del riservato Mythos ma per tutti: benchmark da record, prezzi più bassi e come provarlo subito.
NovitàNVIDIA apre Cosmos 3, un modello che simula e comprende il mondo fisico per addestrare robot e veicoli autonomi: arriva nelle versioni Super e Nano, ecco come provarlo.
NovitàAnthropic aggiorna il suo modello di punta a Opus 4.8 e porta in Claude Code i dynamic workflows: centinaia di sub-agenti in parallelo per migrazioni di codice su larga scala.
NovitàNVIDIA apre Nemotron 3 Ultra, modello da 550 miliardi di parametri pensato per gli agenti che lavorano a lungo: pesi aperti su Hugging Face e API gratuite per provarlo.
NovitàOpenAI introduce un interruttore di sicurezza che disattiva web, agenti e download per bloccare l'esfiltrazione dei dati. Cosa fa, come si attiva e i suoi limiti.
NovitàGoogle rilascia il Colab CLI open source: esegui codice Python su GPU e TPU remote dalla shell, anche tramite agenti IA come Claude Code e Codex.
NovitàIdeogram pubblica il suo primo modello a pesi aperti: 9,3 miliardi di parametri, prompting in JSON e testo nelle immagini. Ecco come provarlo e scaricarlo.
NovitàAl Computex Perplexity ha mostrato un orchestratore ibrido: un piccolo modello sul PC decide cosa tenere in locale e cosa mandare ai modelli in cloud. In arrivo a luglio.
NovitàGoogle ha rilasciato Gemma 4 12B, modello aperto e multimodale che capisce testo, immagini, audio e video e gira su un portatile con 16GB. Licenza Apache 2.0 e download libero.
NovitàOpenAI ha lanciato Dreaming V3, l'architettura di memoria che consolida i ricordi di ChatGPT nei momenti di inattività. Più contesto, più continuità e nuovi controlli sulla privacy.
NovitàOpenAI potenzia GPT-Rosalind, il modello per le scienze della vita: più capace in genomica e chimica, con plugin disponibili a tutti in Codex e accesso aperto nel mondo.
NovitàCon Speech Engine, ElevenLabs trasforma qualsiasi chatbot in un assistente vocale in tempo reale: tu porti l'LLM, lei gestisce ascolto, turni e voce. Ecco come funziona.
NovitàH Company ha rilasciato Holo3.1, famiglia open di agenti 'computer use' da 0,8 a 35 miliardi di parametri. Ecco cosa fa, i benchmark e come provarlo.
NovitàMiniMax M3 e' il primo modello a pesi aperti che unisce coding di frontiera, contesto da 1 milione di token e multimodalita'. Come provarlo e quanto costa.
NovitàMicrosoft presenta MAI-Image 2.5: generazione ed editing di immagini gia' dentro PowerPoint e su Foundry, con testo nelle immagini piu' leggibile.
NovitàxAI lancia Grok Imagine Video 1.5: clip fino a 15 secondi con audio sincronizzato e primo posto nell'arena image-to-video. Dove e come provarlo.
NovitàJetBrains, l'azienda di IntelliJ e PyCharm, ha pubblicato Mellum2: un modello aperto per la programmazione con licenza Apache. Specifiche, prestazioni e come usarlo.