Els primers resultats de Jalapeño mostren una velocitat i eficiència líders en la indústria en la inferència d'IA ↗
OpenAI ha publicat els primers resultats de rendiment de Jalapeño, el seu xip d'inferència personalitzat. A GPT-OSS 120B, diu que el xip va oferir aproximadament 1,9 vegades més rendiment màxim per quilowatt i una latència d'extrem a extrem aproximadament 1,7 vegades inferior que el sistema de comparació.
Els guanys també es van estendre a DeepSeek R1 i Kimi K2.5. OpenAI té previst implementar Jalapeño dins de la seva pròpia infraestructura informàtica, mentre que els dissenys de segona i tercera generació ja estan en marxa... així que sí, OpenAI s'està convertint cada cop més en una empresa de xips, d'alguna manera. (OpenAI)
Claude Cowork finalment recorda el que li vas dir a l'aplicació al xat ↗
Anthropic va unificar la memòria de Claude entre el xat normal i el Cowork. La informació apresa durant les converses ara pot seguir els usuaris en tasques d'agència, eliminant aquell ritual lleugerament boig d'explicar el mateix projecte una vegada i una altra.
Els usuaris poden inspeccionar, editar i suprimir temes recordats, mentre que els records s'actualitzen a mesura que les converses continuen. La funció està habilitada per defecte als plans Free, Pro i Max. (TechCrunch)
Google Cloud llança Gemini Enterprise per al sector jurídic ↗
Google Cloud ha presentat un paquet Gemini Enterprise dissenyat específicament per a advocats, que porta els seus agents més enllà del xat genèric i els porta a la revisió de contractes, la investigació legal, la supervisió normativa, les sol·licituds de privadesa i la redacció de documents.
Inclou connectors per a plataformes com Harvey, iManage, Docusign, RelativityOne i Thomson Reuters, alhora que preserva els controls d'accés i els murs ètics existents de les empreses. L'apropiació de terres per part d'agents d'IA ha arribat al departament legal... com era previsible, però encara força ràpid. (Google Cloud Press Corner)
Google Cloud llança Gemini Enterprise per a serveis financers ↗
Google també va llançar una oferta Gemini Enterprise específica per a finances, que inclou un agent de recerca financera gestionat, més de 50 habilitats especialitzades i 13 connectors a sistemes de dades financeres i de mercat.
La plataforma s'adreça a fluxos de treball que inclouen l'avaluació del risc de crèdit, el seguiment de carteres, la investigació KYC i l'anàlisi de mercat. CME Group i Deutsche Bank són algunes de les organitzacions que ja hi participen: els agents empresarials s'estan especialitzant cada cop més, gairebé com si el programari portés un vestit. (Google Cloud Press Corner)
NVIDIA anuncia l'ordinador robòtic Jetson Orin Nano 2 per redefinir la IA de nivell bàsic ↗
Nvidia va presentar el Jetson Orin Nano 2, un ordinador compacte destinat a robots, drons i altres sistemes d'IA física. Ofereix 78 bilions d'operacions per segon, 8 GB de memòria i una CPU Arm de vuit nuclis.
Nvidia diu que el rendiment d'inferència es duplica respecte a l'anterior Nano Super, mentre que igualar el seu rendiment pot requerir un 40% menys d'energia. Que els models més petits siguin realment capaços en maquinari compacte és la part interessant aquí: la IA ja no sempre necessita trucar al centre de dades gegant. (NVIDIA Newsroom)
Perplexity s'associa amb Nvidia per llançar Portable Computer, un agent d'IA totalment local amb zero costos de tokens ↗
Perplexity va llançar Portable Computer, portant la seva experiència d'ordinador agentiu al maquinari local amb tecnologia Nvidia. Els models, els fitxers i l'execució d'agents poden romandre a la màquina de l'usuari, i el treball realitzat localment no consumeix crèdits de facturació al núvol.
Les tasques comencen localment i el sistema demana permís abans de passar a un model de núvol de frontera. Es llança al voltant de sistemes Nvidia DGX Spark i Linux amb GPU RTX prou potents: la privadesa i el cost de sobte es converteixen en part de l'argument de venda de la IA local, no només la velocitat. (Venturebeat)
WSJ informa que Anthropic comunicarà als inversors que veu més de 30 bilions de dòlars en ingressos potencials ↗
Segons sembla, Anthropic es prepara per comunicar als inversors que el seu mercat potencial total podria superar els 30 bilions de dòlars. Una distinció important: aquesta és l'oportunitat teòrica anual si la IA capturés el treball rellevant, no Anthropic que prediu que arribarà a guanyar 30 bilions de dòlars. (Reuters)
L'enorme xifra ajuda a emmarcar la despesa en infraestructura d'Anthropic, la seva competència amb OpenAI i Google, i la història més àmplia dels inversors. És una xifra espectacularment gran... fins i tot per als estàndards numèrics de la indústria de la IA. (Reuters)
Preguntes freqüents
Què signifiquen els resultats del xip Jalapeño d'OpenAI per a la inferència d'IA?
OpenAI afirma que Jalapeño va oferir un rendiment màxim per quilowatt més alt i una latència de punta a punta més baixa que el seu sistema de comparació mentre executava GPT-OSS 120B. Es van reportar guanys similars amb DeepSeek R1 i Kimi K2.5. Els resultats suggereixen que OpenAI està dissenyant cada cop més maquinari al voltant de les demandes particulars d'eficiència i velocitat de la inferència d'IA a gran escala.
Com funciona la memòria compartida de Claude a través del xat i el coworking?
Ara, en Claude pot portar la informació apresa en converses habituals a les tasques de coworking, cosa que redueix la necessitat d'explicar el mateix projecte o context repetidament. Els usuaris poden inspeccionar, editar i suprimir temes recordats, mentre que aquests records poden continuar actualitzant-se a mesura que es desenvolupen les converses. Segons l'anunci que es tracta a l'article, la funció està habilitada per defecte als plans Free, Pro i Max.
Què pot fer Gemini Enterprise per a serveis legals i financers?
Les ofertes especialitzades de Gemini Enterprise de Google Cloud estan dirigides a fluxos de treball específics del sector en lloc de xats d'IA genèrics. El paquet legal cobreix àrees com la revisió de contractes, la recerca, el seguiment normatiu, les sol·licituds de privadesa i la redacció, mentre que la versió de serveis financers admet fluxos de treball que inclouen l'avaluació del risc de crèdit, el seguiment de carteres, la recerca KYC i l'anàlisi de mercat. Ambdues també es poden connectar amb sistemes de programari i dades professionals existents.
Per què la inferència d'IA local és cada cop més important?
La inferència d'IA local pot reforçar la privadesa, reduir la dependència de la infraestructura del núvol i potencialment disminuir els costos d'ús continu. El Jetson Orin Nano 2 d'Nvidia està dirigit a robots, drons i altres sistemes perimetrals, mentre que el Portable Computer de Perplexity manté els models, els fitxers i l'execució d'agents en maquinari local compatible. En molts fluxos de treball, els models del núvol es poden reservar per a tasques que requereixen una capacitat addicional.
Com decideix Perplexity Portable Computer quan utilitzar la IA al núvol?
Les tasques estan dissenyades per començar al maquinari local de l'usuari amb tecnologia Nvidia, mantenint l'execució del model i els fitxers compatibles a la màquina. Si un pas requereix un model de núvol fronterer, el sistema demana permís a l'usuari abans d'escalar-lo. La feina completada localment no consumeix crèdits de facturació al núvol, cosa que fa que l'enfocament sigui rellevant per als usuaris preocupats tant per la privadesa com pels costos d'inferència recurrents.
Què significa l'estimació d'Anthropic del mercat d'IA de 30 bilions de dòlars?
La xifra reportada fa referència a la visió d'Anthropic del mercat total potencial adreçable per a la IA, no a una predicció que la mateixa Anthropic generarà 30 bilions de dòlars en ingressos anuals. Representa el valor teòric del treball que la IA podria abordar potencialment a tota l'economia. L'estimació també ajuda a explicar per què les empreses líders en IA estan invertint tant en infraestructura i capacitats empresarials.