Modelli Claude di Anthropic su Google Cloud

I modelli Anthropic Claude su Google Cloud offrono modelli serverless e completamente gestiti come API. Per utilizzare un modello Claude su Agent Platform, invia una richiesta direttamente all'endpoint API Agent Platform. Poiché i modelli Anthropic Claude utilizzano un'API gestita, non è necessario eseguire il provisioning o gestire l'infrastruttura.

Puoi trasmettere in streaming le risposte di Claude per ridurre la percezione della latenza dell'utente finale. Una risposta in streaming utilizza gli eventi inviati dal server (SSE) per trasmettere in streaming in modo incrementale la risposta.

Paghi i modelli Claude man mano che li utilizzi (pagamento a consumo) oppure paghi una tariffa fissa quando utilizzi il throughput di cui è stato eseguito il provisioning. Per i prezzi del pagamento a consumo, consulta la pagina Modelli Anthropic Claude nella Google Cloud pagina dei prezzi.

Modelli Claude disponibili su Google Cloud

I seguenti modelli sono disponibili da Anthropic per l'utilizzo in Gemini Enterprise Agent Platform. Per accedere a un modello Claude su Google Cloud , vai alla relativa scheda del modello in Model Garden.

I modelli Claude di Anthropic supportano il logging di richiesta/risposta di Agent Platform. Attiva la registrazione delle richieste e delle risposte per 30 giorni della tua attività di prompt e completamento per monitorare eventuali utilizzi impropri del modello da parte dei tuoi utenti. Per saperne di più, consulta Registrare richieste e risposte.

Modelli Claude Fable

cognizione Claude Fable 5.1 su Google Cloud Ottimizzato per il lavoro autonomo di conoscenza e la programmazione, gestisce attività complesse, asincrone e di lunga durata.
cognition Claude Fable 5 su Google Cloud Ottimizzato per il lavoro autonomo di conoscenza e la programmazione, gestisce attività complesse, asincrone e di lunga durata con agenti.

Modelli Claude Opus

Claude Opus 5.5 su Google Cloud Il modello Opus più avanzato di Anthropic, che supporta agenti a esecuzione continua e offre miglioramenti nella programmazione e nel lavoro professionale.
Claude Opus 5 su Google Cloud Un modello ad alta intelligenza di Anthropic, creato per la programmazione, gli agenti e il lavoro professionale.
Claude Opus 4.8 su Google Cloud Un modello Opus di alta intelligenza creato per la programmazione e gli agenti, con un ragionamento approfondito per i workflow aziendali.
Claude Opus 4.7 su Google Cloud Ottimizzato per la programmazione, gli agenti aziendali, la progettazione dell'interfaccia utente e i workflow aziendali di più giorni.
Claude Opus 4.6 su Google Cloud Ottimizzato per la programmazione, gli agenti aziendali, i workflow operativi in tempo reale e il lavoro professionale.
Claude Opus 4.5 su Google Cloud Ottimizzato per la programmazione, gli agenti, l'utilizzo del computer e i workflow aziendali complessi.
Claude Opus 4.1 su Google Cloud Leader del settore per le funzionalità di codifica e degli agenti, in particolare per la ricerca agentica e la risoluzione di problemi complessi.
Claude Opus 4 su Google Cloud Modello allo stato dell'arte per la programmazione, la ricerca con agenti e le attività a lungo termine che richiedono un ragionamento prolungato.

Modelli Claude Sonnet

Claude Sonnet 5.5 su Google Cloud Creato per la programmazione, gli agenti e il lavoro professionale su larga scala.
Claude Sonnet 5 su Google Cloud Creato per la programmazione, gli agenti e il lavoro professionale su larga scala.
Claude Sonnet 4.6 su Google Cloud Offre un'intelligenza all'avanguardia su larga scala, pensata per programmazione, agenti, cybersicurezza e workflow aziendali.
Claude Sonnet 4.5 su Google Cloud Progettato per potenziare gli agenti del mondo reale con solide funzionalità di programmazione, utilizzo del computer e file di Office.
Claude Sonnet 4 su Google Cloud Offre prestazioni di codifica eccezionali con la giusta velocità e il giusto costo per i casi d'uso ad alto volume.

Modelli Claude Haiku

Claude Haiku 4.5 su Google Cloud Prestazioni quasi di frontiera con la velocità e l'efficienza dei costi per alimentare prodotti senza costi ed esperienze sensibili alla latenza su larga scala.