Bitget App
Trade smarter
Acquista CryptoMercatiTradingPerpsStocksEarnAziendaIA e altro
Quattro Mac Studio superano un modello con mille miliardi di parametri: Apple lancia una sfida alla narrazione sull’inferenza di Nvidia.

Quattro Mac Studio superano un modello con mille miliardi di parametri: Apple lancia una sfida alla narrazione sull’inferenza di Nvidia.

华尔街见闻华尔街见闻2026/09/24 01:01
Mostra l'originale

Il responsabile dell’hardware di Apple ha sottolineato che, dopo l’acquisto dei dispositivi da parte delle aziende, non è necessario pagare tramite token, e che la convenienza della potenza di calcolo locale potrebbe essere superiore al noleggio a lungo termine di GPU cloud. JPMorgan ritiene che, se un numero maggiore di compiti di inferenza dovesse essere spostato verso i terminali, la quota di Nvidia nelle attività AI incrementali potrebbe risultare inferiore alle aspettative di mercato. Attualmente, la volatilità implicita di Nvidia è al minimo dai tempi pre-pandemici, e il prezzo delle opzioni quasi non contempla un premio di rischio per questo cambio di narrativa. JPMorgan consiglia quindi di acquistare opzioni put su Nvidia e allo stesso tempo posizionarsi long su Apple.

Apple sta rimodellando la competizione nel mercato dell’hardware AI con una logica di “inferenza locale”, puntando direttamente alla quota incrementale potenziale di NVIDIA nell’ambito dell’inferenza AI.

Il nuovo Mac Studio M5 Ultra di Apple sarà consegnato dal 22 settembre, supporta fino a 512GB di memoria unificata e permette di eseguire cluster multi-macchine per task di inferenza distribuita; Apple ha già dimostrato il funzionamento congiunto di quattro Mac Studio su un modello con un trilione di parametri.

Johny Srouji, responsabile hardware di Apple, ha dichiarato a Reuters che una volta che le aziende acquisiscono i dispositivi, non devono più pagare fee cloud per ogni richiesta di inferenza conteggiata a token; per i team con workload stabile, la convenienza della potenza di calcolo locale potrebbe superare quella del noleggio prolungato del GPU cloud.

Questa narrazione non riguarda tanto il togliere ordini a NVIDIA quanto una possibile riduzione della propria quota nella crescita dell’inferenza AI: se più task di inferenza migrano su device o macchine aziendali, la quota di NVIDIA nelle attività incrementali di AI potrebbe risultare inferiore alle attese del mercato.

Al momento il prezzo delle azioni Apple mostra forza dal punto di vista tecnico, mentre NVIDIA rimane in un ampio range senza una tendenza di medio periodo; alcuni analisti suggeriscono di esprimere visione bullish su Apple e bearish su NVIDIA tramite opzioni.

Quattro Mac Studio superano un modello con mille miliardi di parametri: Apple lancia una sfida alla narrazione sull’inferenza di Nvidia. image 0

Cambio di posizionamento: da “usare l’AI” a “eseguire l’AI”

Il posizionamento di Apple per Mac Studio sta cambiando radicalmente: si passa dalla vendita di macchine “capaci di usare l’AI” a quella di macchine “capaci di eseguire l’AI”.

Al centro di questa transizione c’è la differenza strutturale del costo di inferenza: gli utenti iPhone e Mac hanno già pagato per il chip, i task gestiti localmente non richiedono più costose richieste di inferenza cloud, e la stessa logica si estende ora al settore enterprise.

Il Mac Studio M5 Ultra supporta fino a 512GB di memoria unificata, una configurazione disponibile dalla fine di ottobre. L’ampia memoria consente agli utenti di caricare modelli che su una GPU standard non entrerebbero, mentre un cluster di più macchine può distribuire il peso di modelli con un trilione di parametri.

Apple ha già dimostrato come quattro Mac Studio siano in grado di eseguire localmente un modello con un trilione di parametri, rendendo tecnicamente possibile sostituire almeno in parte alcuni cluster cloud di GPU.

Tuttavia, la prova reale oltre la demo Apple sarà sul terreno della velocità di inferenza, della concorrenza degli utenti e del totale costo di possesso rispetto al noleggio cloud; sono queste le variabili chiave per le decisioni di acquisto aziendali.

NVIDIA resta nella filiera, ma la quota incrementale è incerta

Il Mac Studio non sostituirà le GPU dei data center per ogni tipo di workload; anche Apple, per alcuni task AI ad alta richiesta, utilizza GPU di NVIDIA su Google Cloud.

Ma NVIDIA non rischia di perdere gli ordini attuali; piuttosto, la narrazione cambia: se sempre più inferenze vengono spostate su device o macchine aziendali, la quota incrementale di NVIDIA nelle attività AI potrebbe essere inferiore alle ipotesi di mercato.

Le azioni NVIDIA restano prive di tendenza di medio periodo, bloccate in un ampio intervallo e trattate vicino al top del range, mentre la volatilità implicita è ai minimi dal pre-pandemia.

Quattro Mac Studio superano un modello con mille miliardi di parametri: Apple lancia una sfida alla narrazione sull’inferenza di Nvidia. image 1

La bassa volatilità di norma riflette un’elevata fiducia del mercato nella futura evoluzione dei prezzi, ma il potenziale cambiamento narrativo sull’inferenza è una variabile, e attualmente i prezzi delle opzioni praticamente non rispecchiano un rischio legato a una “migrazione locale” dell’inferenza.

Quattro Mac Studio superano un modello con mille miliardi di parametri: Apple lancia una sfida alla narrazione sull’inferenza di Nvidia. image 2

Per questo, secondo Goldman Sachs l’acquisto di opzioni put su NVIDIA è un modo a basso costo per esprimere questa potenziale svolta prima di eventuali revisioni al ribasso delle stime di profitto; in confronto, viene preferita una posizione call su Apple contro una put su NVIDIA.

Gli analisti suggeriscono di monitorare, dopo la consegna della configurazione da 512GB a fine ottobre, le velocità di inferenza misurate, il dato sul totale costo di possesso e il feedback della clientela enterprise sulla soluzione di inferenza locale.

0
0

Esclusione di responsabilità: il contenuto di questo articolo riflette esclusivamente l’opinione dell’autore e non rappresenta in alcun modo la piattaforma. Questo articolo non deve essere utilizzato come riferimento per prendere decisioni di investimento.

PoolX: Blocca per guadagnare
Almeno il 12% di APR. Sempre disponibile, ottieni sempre un airdrop.
Blocca ora!