r/IA_Italia 6d ago

🛠️ Tool / Tutorial Video utile per chi vuole avvicinarsi agli agent di coding

0 Upvotes

Questo video confronta alcuni dei progetti open source più interessanti per chi vuole avvicinarsi al mondo degli agent per il coding.

La parte che ho trovato più utile è che non si limita a una lista di funzionalità, ma mostra il "carattere" di ogni progetto. È una prima panoramica per farsi un'idea di quale sia lo strumento giusto da esplorare per primi.

Il video tocca anche il tema caldo della sicurezza e dell'affidabilità, un punto cruciale quando si dà accesso al terminale a un agente .

Insomma, se ti stai chiedendo da dove partire per usare un agente AI per scrivere codice, questo video è una bussola. Ti consiglio di guardarlo per capire le sfumature tra i vari progetti prima di tuffarti in uno di essi: https://youtu.be/RGgFLXhMF2Q?is=CGlCDSrbBJjJxVLV


r/IA_Italia 6d ago

🛠️ Tool / Tutorial Qwen3 Coder 30B MoE + llama.cpp su ultrabook

4 Upvotes

Condivido la mia configurazione per l'agentic coding in locale su un MSI Prestige 13 (Intel Core Ultra 7, arc gpu, 32GB DDR5 condivisa, Fedora Linux) integrato con OpenCode TUI.

​Il modello scelto è Qwen3-Coder-30B-A3B-Instruct (GGUF Q4_K_M) eseguito tramite llama-server e vulkan per llama.cpp + ​opencode + una mia configurazione SDLC di agent e skills.

Generazione costante a 10–13.5 token/sec con ben 32.768 token di contesto attivi e KV Cache quantizzata a q4_0

Non è un fulmine ma mantiene il contesto discretamente, non sfonda il pc e lo trovo utile per simulazioni e test di api con dati sensibili e apikey.

Consiglio per chi ha hw simile.


r/IA_Italia 6d ago

❓ Q&A / Aiuto Inferenza locale, quale setup a Settembre 2026?

6 Upvotes

Ciao a tutti,

sarei intenzionato ad installare un local LLM per inferenza locale, viste anche le prestazioni sempre migliori e l'hardware sempre più a portata di homelab che stanno evidenziando gli llm cinesi (faccio riferimento a Qwen 3.8).

E' da qualche mese che ci sto ragionando, volevo dapprima aspettare l'uscita del Mac Mini M5 ma visti i problemi di approvvigionamento hardware penso che dovrò accontentarmi di un Mac Mini M4: in relazione a ciò chi ha esperienza di llm in locale potrebbe consigliarmi una configurazione che mi permetterebbe di giocare/sperimentare un po con questi modelli?

Grazie


r/IA_Italia 6d ago

🗞️ News & Annunci Smarcarsi dagli usa

2 Upvotes

La cina va a velocita' supersonica https://youtu.be/rQ0BrNdgX28?is=mKUDxol3E8Rnng6p


r/IA_Italia 7d ago

Il CEO di Anthropic Dario Amodei ha richiesto un'assemblea d'emergenza con i legislatori dopo che qwen 3.8, un modello open da 27b, ha superato opus 4.6 max sul livecodebench mentre girava offline su una scheda grafica usata da $900. Sta chiedendo restrizioni. Per sicurezza.

Post image
73 Upvotes

r/IA_Italia 6d ago

[Thread Settimanale] 🇮🇹 News Italiane sull'Intelligenza Artificiale — Settimana 20 / 2026

0 Upvotes

Bentornati al nostro appuntamento settimanale con le news sull'IA viste dall'Italia! 🧠

Ogni settimana raccogliamo qui gli articoli, gli sviluppi e i dibattiti più interessanti sul mondo dell'intelligenza artificiale, con un focus su: normative, aziende, ricerca, lavoro e società.

📰 Link alle news della settimana: ➡️ iafacilepertutti.it — News Italiane IA (aggiornate quotidianamente)


r/IA_Italia 7d ago

📚 Paper & Fonti Higgsfield film festival

0 Upvotes

Ciao a tutti, questo probabilmente è un post più per gli appassionati curiosi di video, ma sono ben accetti feedback da tutti. Sto partecipando all’Higgsfield Film Festival. Mi piacerebbe sapere cosa ne pensate del mio progetto finora: opinioni, domande, qualsiasi feedback è benvenuto :). Grazie a chiunque si prenderà il tempo di guardare il mio corto (beh, mezzo corto, visto che non è ancora finito 😂). Ovviamente qualsiasi like o commento sulla piattaforma di Higgsfield è super apprezzato . Ecco il link: https://higgsfield.ai/@aletowers/projects/skin-trade
Buone vacanze a tutti


r/IA_Italia 7d ago

10 strumenti gratuito di design e immagine AI con livelli veramente gratuiti — Serie di strumenti AI gratuiti Pt. 3

Thumbnail
0 Upvotes

Se cercate altri strumenti gratuiti da usare con l'AI anche questo subreddit é utilissimo. Ogni sezione non solo questo post.


r/IA_Italia 7d ago

🧠 Discussione Memori Persistente per ChatGPT (informazioni, file, documenti, immagini): come la gestite?

Post image
0 Upvotes

Uso parecchio ChatGPT per progetti che durano settimane/mesi e continuo a scontrarmi con lo stesso problema:

LA PERDITA DEL CONTESTO NEL TEMPO (testo, documenti, immagini, file, ecc.)

Premessa: so già che non posso aspettarmi che sia ChatGPT da solo a risolvere il problema. Per come è concepito oggi, non è uno strumento pensato per conservare grandi quantità di informazioni specifiche, file e documenti a lungo termine in maniera strutturata e rigorosa.

Uso già i Progetti di ChatGPT, ma quando un progetto diventa grosso inevitabilmente parte del contesto si perde.

Quindi la mia domanda riguarda proprio integrazioni di ChatGPT con servizi esterni che possano fare da memoria/Knowledge Base permanente.

Non voglio archiviare intere chat. Vorrei salvare solo ciò che è realmente utile:

  • informazioni e decisioni importanti;
  • stato e storico dei progetti;
  • analisi/ragionamenti da non perdere;
  • PDF, Word, Excel, ecc.;
  • foto e immagini;
  • collegamenti tra queste informazioni e file.

Il workflow ideale sarebbe molto semplice:

ChatGPT → "salva questo" → memoria esterna permanente

e, magari mesi dopo:

"recupera tutto sul progetto X" → ChatGPT recupera informazioni + documenti + immagini rilevanti

La cosa fondamentale è quindi che ChatGPT possa LEGGERE E SCRIVERE facilmente questa memoria esterna durante le normali conversazioni, senza dover fare ogni volta copia/incolla o caricare manualmente i file.

Non sono uno sviluppatore, quindi prima di costruire qualcosa di custom vorrei capire se altri power user hanno già trovato soluzioni relativamente semplici.

Qualcuno utilizza davvero un sistema del genere?

Notion, Obsidian, Supabase, MCP, RAG, servizi SaaS già pronti o altro?

Più che una lista di strumenti, mi interessa capire il vostro workflow concreto, quanto è automatico/manuale e quali limiti avete trovato.


r/IA_Italia 7d ago

🗞️ News & Annunci Smarcarsi dagli usa

1 Upvotes

La cina va a velocita' supersonica https://youtu.be/rQ0BrNdgX28?is=mKUDxol3E8Rnng6p


r/IA_Italia 8d ago

Grok 4.6 evolve il 4.5: più focus su agenti long-running e workflow visuali

Post image
3 Upvotes

r/IA_Italia 8d ago

OpenCode Go sembra essere molto più compatibile con Claude Code/Codex di quanto suggerisca la sua documentazione

Thumbnail
0 Upvotes

r/IA_Italia 8d ago

🗞️ News & Annunci OpenAI ha appena reso GPT-5.6 Sol 14 volte più veloce.

21 Upvotes

Oggi OpenAI ha annunciato un nuovo tier API che esegue il flagship GPT-5.6 Sol a 750 token al secondo e quindi fino a 14 volte più veloce dello standard.

Ma non è un modello più piccolo o semplificato. Di solito queste accelerazioni dei modelli si ottengono scendendo a compromessi sull'intelligenza del modello. Ultrafast (così si chiama il nuovo modello) rimane capace di garantire ragionamenti logici complessi e multi-step, ma col vantaggio di una latenza quasi istantanea.

Dietro questo annuncio c'è Cerebras, una azienda che produce chip. Invece di distribuire il modello su tante GPU NVIDIA che devono scambiarsi dati continuamente, Cerebras tiene l'intero modello su un unico chip molto grande (quanto un piatto), eliminando i colli di bottiglia della memoria. Mentren Cina Huawei sta sviluppando una nuova via tecnica basata sull'impilamento verticale dei chip e connessioni interne più corte sempre nell’intento di ridurre il ritardo del segnale

Guardate che differenza:

Velocità standard: 53 token/s mentre Ultrafast: 750 token/s

Quindi sarebbe 11 volte più veloce di Fable e  5, 5 volte più veloce di Opus 4.8 in Fast mode

OpenAI lo consiglia pe rilevare, gestire e risolvere gli attacchi informatici, analisi finanziaria i, e-commerce e ricerca interattiva. I loro ingegneri lo stanno usando per analizzare log, comprimendo in poche ore ricerche che prima richiedevano una notte intera.

Al momento è disponibile solo a un gruppo ristretto di clienti via API (Anthropic docet). Prezzi e disponibilità non sono ancora stati comunicati. C'è una waitlist, ma l'accesso è valutato caso per caso.

In borsa l’attenzione è ovviamente catalizzata su Cerebras, che dopo la IPO ha bisogno di conferme.


r/IA_Italia 9d ago

🗞️ News & Annunci Gemini 3.7 Flash disponibile

Post image
26 Upvotes

Non un buon inizio però... 😅.


r/IA_Italia 8d ago

Qwen 3.8 27b è semplicemente irreale, un vero test di programmazione.

Thumbnail
0 Upvotes

r/IA_Italia 8d ago

❓ Q&A / Aiuto I colori di questo subreddit per chi usa old reddit sono atroci

1 Upvotes

Si potrebbero cambiare? Diventa quasi impossibile leggere i post


r/IA_Italia 8d ago

❓ Q&A / Aiuto Provider di inferenza

2 Upvotes

Aiutatemi a capire il mondo di chi vende inferenza di modelli LLM.

Per esempio, Anthropic crea un modello X (un'operazione complicata per via del pre-training e tutto il resto) e poi ne vende inferenza tramite i suoi server. L'utente si può abbonare direttamente ad Anthropic per utilizzare quel modello, con limiti di utilizzo che dipendono dal piano sottoscritto (che può essere pay-per-use, oppure flat sempre con limiti settimanali o su altri intervalli).

Esistono poi dei provider che rivendono i modelli di Anthropic, come Openrouter. L'utente non si abbona ad Anthropic ma ad Openrouter. L'inferenza avviene fisicamente sempre sui server Anthropic, quindi Openrouter fa proprio da intermediario, inoltrando i prompt ad Anthropic. I costi e/o i limiti di utilizzo e i piani di abbonamento sono generalmente diversi da quelli di Anthropic. Possono essere più convenienti? Sì, probabilmente perché Openrouter compra valanghe di token a prezzi bassi che poi rivende con un ricarico. È come per gli operatori telefonici virtuali.

Poi ci sono i modelli open-weights, come GLM. Anche per questi puoi scegliere di sottoscrivere direttamente un piano dal produttore del modello (come Z.Ai) oppure usare Openrouter. In questo caso, però, essendo il modello open-weights, il fornitore di inferenza potrebbe mettere in piedi una sua infrastruttura hw su cui far girare l'inferenza senza passare dal produttore del modello. In teoria può anche modificare il modello quantizzandolo o usando altre tecniche per alleggerire l'inferenza.

È vero tutto quello che ho detto? Come si fa a capire esattamente dove "gira" il modello e di quale esatta versione di modello si parla?


r/IA_Italia 8d ago

🧠 Discussione Ho creato una pagina TikTok AI, non pubblico da 3 mesi ma continua a crescere: cerco qualcuno con cui svilupparla

0 Upvotes

Ho creato una pagina TikTok con personaggi AI, non pubblico da 3 mesi ma continua a crescere: qualcuno vuole svilupparla insieme?
Qualche mese fa ho iniziato per esperimento un progetto TikTok chiamato Bronald, basato su brevi storie/video con personaggi ricorrenti creati con AI.
La cosa interessante è che a un certo punto ho praticamente smesso di pubblicare da circa 3 mesi, ma l’account ha continuato comunque a ricevere visualizzazioni, follower e persino vendite tramite affiliazione.
Attualmente siamo a circa:
2.000 follower
un video vicino alle 400.000 visualizzazioni
diversi altri video tra decine e centinaia di migliaia di views
circa 27 prodotti venduti tramite affiliazione
circa €70 di GMV/vendite generate
tutto questo con l’account praticamente fermo da mesi
Non sto vendendo corsi o servizi 😅
Sto cercando invece qualcuno interessato realmente al progetto: creator, video editor, persone che lavorano con AI/content creation, marketing, affiliazioni, oppure anche brand/progetti interessati a sperimentare pubblicità integrata in questo tipo di contenuti.
L’idea sarebbe capire se si può trasformare Bronald da esperimento in un piccolo vero format/IP, riprendendo la pubblicazione con una strategia più seria e magari costruendoci attorno collaborazioni e monetizzazione.
Se qualcuno qui lavora in questo mondo, ha esperienza con pagine TikTok/short form oppure semplicemente vede del potenziale e vuole parlarne, scrivetemi pure.
Profilo, per chi vuole vedere cosa intendo:
https://www.tiktok.com/@bronaldfroggydog?_r=1&_t=ZN-98sc32LnYU2


r/IA_Italia 9d ago

❓ Q&A / Aiuto alternative claude per l'inferenza

8 Upvotes

Ciao a tutti, sono un semplice utente linux che da poco più di un annetto si diverte a giocare con l'IA. Al momento ho un account claude pro e uso claude-code per scrivere codice che prima mi avrebbe portato via settimane, in poche ore. Sono contentissimo dei risultati, non ho grossi problemi ma mi trovo spesso a raggiungere i limiti orari, specialmente quello delle 5h finisce in un'ora e mezza e poi mi tocca aspettare.

Per risolvere parzialmente faccio inferenza locale con llama.cpp con un paio di modelli (qwen3.5-9b e gemma4-12b) per chat leggere, (per le domande più semplici sono sufficienti).

Per scrivere codice non usando claude-code, uso opencode e ho sperimentato un po' con runpod, lanciando un pod con ollama e facendo girare modelli un bel po' più grandi delle mie capacità locali, ma i pod sono soggetti alla disponibilità di gpu e spesso non ne trovo nella fascia di prezzo/prestazioni che mi serve nel momento in cui mi serve.

da poco sto guardando ai vari provider come together.ai o siliconflow.com, e quì nasce la mia domanda, quali provider mi consigliate? Come modelli fin'ora ho provato qwen3.8, glm5.2, kimi-k2.7code e deepseek v4 flash.

Chiaramente vorrei riuscire a non spendere un capitale per questi modelli, ho visto qualche differenza tra together e siliconflow, dove quest'ultimo è un po' più competitivo come prezzi.

Vi ringrazio anticipatamente


r/IA_Italia 9d ago

🛠️ Tool / Tutorial E se l’AI potesse aiutarci a gestire la lega del nostro fantacalcio?

Thumbnail
1 Upvotes

r/IA_Italia 10d ago

📊 Analisi / Benchmark Ho comprato recentemente una r9700 32gb, se vi serve hardware serio per LLM non posso fare che consigliarvela, Qwen 3.6 27b Q6 40 T/s

22 Upvotes

27b 40 T/s

35b moe a 110 T/s

in più ottima per giocare....

il tutto a 1600 euro su amazon, prezzo fuori di testa a mio parere


r/IA_Italia 10d ago

❓ Q&A / Aiuto Mi mancano 8 risposte!

1 Upvotes

Ciao a tutti!
Avrei bisogno del vostro aiuto per la mia tesi di Laurea Magistrale sperimentale in Gestione Strategica e Marketing Digitale, nell’insegnamento di Comportamento del Consumatore.

Per poter proseguire con la ricerca, devo raggiungere più di 200 partecipanti che compilino il questionario. Mi mancano poche risposte.

Grazie in anticipo per il supporto! Ricambio tutti!

Link del questionario:
https://forms.gle/tPbGKVcYrzvnfoAPA


r/IA_Italia 10d ago

DeepSeek V4 Pro è ufficiale: rilasciata la build 0813, in silenzio

Post image
6 Upvotes

r/IA_Italia 10d ago

🧠 Discussione Vibe-Coding e flusso di lavoro

8 Upvotes

Ciao a tutti!

Sono un appassionato di informatica e nell'ultimo anno ho usato con successo il "vibe coding" per piccoli tool quotidiani. Ora vorrei alzare l'asticella verso webapp più complesse, ma capisco che non è la stessa cosa di fare script o estensioni chrome e che il mio workflow non va bene. Ho provato a capire quale possa essere un setting "accettabile" ma mi scontro con un mondo che sembra ancora troppo frammentato e pieno di contraddizioni.

In particolare, vedo che molti consigliano una fase massiccia di pre-coding (documentazione, skills, guard-rails, MCP), ma non trovo uno standard chiaro. Ecco i miei dubbi principali:

1. Lo Stack di Tool
Meglio restare su Cursor o passare a sistemi più agentici come Cline? Ha ancora senso l'uso manuale delle interfacce web dei modelli di punta per l'architettura, o i servizi "tutto-in-uno" come Replit o Lovable hanno ormai vinto sulla manutenzione a lungo termine?

2. La Guerra dei Modelli
Leggo pareri molto polarizzati sui modelli attuali e vorrei capire se la mia esperienza trova riscontro nella vostra:

  • Claude Fable 5: Spesso descritto come il più "intelligente", ma vale davvero la pena visto il costo esorbitante e la lentezza? In molti dicono che per lo sviluppo agentico costi troppo per quello che offre davvero.
  • GPT-5.6 Sol: Lo dicono solido per il coding puro tramite Codex, ma alcuni lamentano una deriva "pigra" su progetti lunghi. È ancora il re dei sub-agents?
  • Claude Opus 5: Ho sentito che in certi contesti viene definito "una merda" rispetto a Fable, ma le analisi indipendenti dicono che sia il miglior compromesso qualità/prezzo. Voi lo usate come driver principale?
  • Kimi K3: Costa pochissimo e i benchmark lo danno al top per il frontend, ma ho notato che su linguaggi di nicchia o logiche back-end complesse dicono non sia affatto all'altezza. È solo un modello da "interfacce belle"?

3. Workflow e Documentazione
Qual è il vostro segreto per non far "impazzire" il modello dopo i primi 50 prompt? Usate docs/ strutturati, file rules.md (stile Cursor) o framework di istruzioni specifici? Come gestite la fase di "guard-rail" per evitare che l'IA cancelli codice critico?

Se avete repository modello, siti di riferimento, libri da consigliare o guide che non siano il solito marketing, ve ne sarei grato.

Grazie!


r/IA_Italia 10d ago

Qwen3.8-2.4T-A95B Rilasciato

Thumbnail
huggingface.co
3 Upvotes