> ## Documentation Index
> Fetch the complete documentation index at: https://docs.squarecloud.app/llms.txt
> Use this file to discover all available pages before exploring further.

# AI

> Chiama l'AI Gateway di Square Cloud da @squarecloud/api con api.ai.chat(): chat completion compatibili con OpenAI, senza streaming.

`api.ai.chat(request)` chiama l'[AI Gateway](/en/api-reference/ai-gateway), un endpoint di chat completion **compatibile con OpenAI**. Richiede lo scope `ai:chat` e un piano Standard o superiore.

```typescript theme={"system"}
const completion = await api.ai.chat({
    model: "cubic",
    messages: [
        { role: "system", content: "You are a helpful assistant." },
        { role: "user", content: "What is Square Cloud?" },
    ],
    max_tokens: 512,
});

console.log(completion.choices[0].message.content);
console.log(completion.usage.total_tokens);
```

## Richiesta

| Campo                   | Descrizione                                                                                         |
| ----------------------- | --------------------------------------------------------------------------------------------------- |
| `model`                 | `cubic`. Accettato per compatibilità: non esiste un altro modello                                   |
| `messages`              | `{ role, content?, tool_call_id?, tool_calls? }`, con `role` `system`, `user`, `assistant` o `tool` |
| `tools` / `tool_choice` | Function calling di OpenAI                                                                          |
| `max_tokens`            | Numero massimo di token della risposta                                                              |
| `temperature`           | Temperatura di campionamento                                                                        |

La risposta ha la forma di OpenAI: `id`, `object`, `created`, `model`, `choices` (`index`, `message`, `finish_reason`) e `usage`.

## Niente streaming

`ai.chat()` non effettua streaming: restituisce l'intera completion. `stream: true` produce 400 `stream_not_supported`.

## Timeout

Il gateway concede a ogni richiesta **90 secondi** in totale, poi risponde 503 `server_overloaded`. L'SDK attende almeno 120 s prima di andare in timeout, così ricevi la risposta del gateway.

## Errori

Gli errori dell'AI usano il formato di OpenAI, quindi i loro codici sono in **minuscolo**. Lanciano comunque un [`SquareCloudAPIError`](/it/sdks/js/errors), con `code` impostato sul codice di OpenAI (o sul suo `type` quando non c'è un codice):

```typescript theme={"system"}
import { SquareCloudAPIError } from "@squarecloud/api";

try {
    await api.ai.chat({ messages: [{ role: "user", content: "Hi" }] });
} catch (error) {
    if (error instanceof SquareCloudAPIError && error.code === "server_overloaded") {
        // safe to retry yourself
    }
}
```

| Status | Codice                                                                                                  | Quando                                                                   |
| ------ | ------------------------------------------------------------------------------------------------------- | ------------------------------------------------------------------------ |
| 400    | `stream_not_supported`                                                                                  | È stato inviato `stream: true`                                           |
| 400    | `invalid_messages`, `invalid_tools`, `invalid_tool_choice`, `invalid_temperature`, `invalid_max_tokens` | Un campo malformato                                                      |
| 400    | `context_length_exceeded`                                                                               | La conversazione supera la finestra di contesto del piano                |
| 401    | `access_denied`                                                                                         | Chiave API non valida                                                    |
| 403    | `upgrade_required`                                                                                      | Il piano non ha accesso all'AI Gateway                                   |
| 429    | `rate_limit_exceeded`, `concurrent_limit_reached`                                                       | Troppo veloce, o una richiesta già in corso                              |
| 429    | `daily_limit_reached`, `daily_request_limit_reached`, `daily_spend_limit_reached`                       | Un budget giornaliero è esaurito (si azzera alle 00:00 UTC)              |
| 503    | `server_overloaded`                                                                                     | Capacità piena o superato il limite di 90 s: puoi riprovare in sicurezza |
| 503    | `daily_capacity_reached`                                                                                | La capacità giornaliera della piattaforma è esaurita                     |

L'SDK **non ripete mai** gli errori dell'AI: la richiesta è un `POST` non idempotente. Vedi il [riferimento dell'AI Gateway](/en/api-reference/ai-gateway) per i limiti dei piani.
