La nostra decisió sobre Cursor després de la seva adquisició per part de SpaceX ↗
OpenAI diu que rescindirà el seu acord de subministrament de models a Cursor després de l'adquisició de la plataforma de codificació per part de SpaceX. L'empresa diu que ja no pot estar segura que SpaceX utilitzarà la seva tecnologia dins dels termes d'OpenAI.
OpenAI també diu que no proporcionarà models futurs a Cursor. Això és una fractura força significativa, especialment per als desenvolupadors que han arribat a tractar Cursor més els models d'OpenAI com una pila de codificació gairebé per defecte. (OpenAI)
Tencent de la Xina llança un nou model d'IA de codi obert per a tasques de codificació i recerca ↗
Tencent ha publicat una vista prèvia de Hy4, un model de codi obert dirigit a l'enginyeria de programari, la recerca i l'anàlisi financera. Utilitza una arquitectura mixta d'experts amb un total de 770.000 milions de paràmetres, mentre que activa aproximadament 49.000 milions per cada sol·licitud de text.
Tencent té previst incorporar-lo a productes com ara CodeBuddy i WorkBuddy. L'empresa admet que la versió prèvia pot plantejar-se massa preguntes complexes i verificar-se a si mateixa amb massa entusiasme... identificable, a la seva manera. (Reuters)
Els investigadors automatitzats poden mitigar de manera fiable els errors d'alineació ↗
Anthropic va mostrar a Claude buscant recerca de manera autònoma, proposant tècniques d'entrenament, executant experiments i millorant models en 10 categories d'error d'alineació, incloent-hi l'engany, les evasions de la presó i l'adulació.
Els seus mètodes més potents van millorar tots els punts de referència objectiu sense degradar les capacitats mesurades per Anthropic, i alguns es van transferir a models fins a 4,7 vegades més grans. L'investigador automatitzat de Claude també va superar les propostes d'investigadors experimentats en seguretat humana sota la configuració de l'estudi.
Hi ha una trampa, és clar. Anthropic ha detectat comportaments fraudulents en una petita fracció de les investigacions automatitzades i subratlla que els seus punts de referència només cobreixen una petita part de les condicions d'alineació pràctiques. Així doncs... investigació d'IA automillora, amb una IA observant l'investigador d'IA. Coses molt normals. (Anthropic)
Un tribunal dictamina que Anthropic va ser inclòs il·legalment a la llista negra de l'administració Trump ↗
Un jutge federal va dictaminar que la decisió del Pentàgon d'incloure Anthropic a la llista negra com a risc de la cadena de subministrament era inconstitucional, qualificant l'acció de represàlia il·legal i considerant la designació arbitrària i capriciosa.
La lluita va sorgir a partir de la negativa d'Anthropic a retirar les restriccions contra l'ús de la seva IA per a la vigilància massiva dels nord-americans o armes autònomes letals sense supervisió humana. La sentència és una victòria important per a Anthropic, i un precedent força clar en la lluita sobre si els governs poden castigar els proveïdors d'IA per establir les seves pròpies línies de seguretat. (The Verge)
El Fons de l'Era de les Màquines ↗
Andreessen Horowitz va recaptar 1.100 milions de dòlars per a un nou Fons per a l'Era de les Màquines centrat en la infraestructura física subjacent a la IA: xips, memòria, xarxes, emmagatzematge, centres de dades, robòtica i fins i tot maquinari d'IA domèstic.
La tesi és bàsicament que el proper coll d'ampolla de la IA no és una altra característica intel·ligent del chatbot, sinó la física. L'alimentació, la refrigeració, l'ample de banda de la memòria i la xarxa necessiten escalar brutalment ràpid, i a16z vol un lloc a la taula del maquinari. (Andreessen Horowitz)
Google encara més enterra els resultats de cerca sota el mode IA ↗
Google ha començat a ampliar automàticament les Visions Generals d'IA per a algunes cerques. En lloc d'un breu resum seguit ràpidament d'enllaços tradicionals, els usuaris poden obtenir una resposta completa d'IA, un quadre "Pregunta el que vulguis" i, només llavors, els resultats web habituals.
Google diu que l'experiència ampliada apareix quan els seus sistemes creuen que serà particularment valuosa. Per als editors, però, la part incòmoda és òbvia: els enllaços ordinaris es desplacen encara més avall a la pàgina, mentre que la IA de Google esdevé cada cop més difícil de moure. (The Verge)
Preguntes freqüents
Per què OpenAI finalitza el seu acord model amb Cursor després de l'adquisició de SpaceX?
OpenAI diu que té previst reduir l'accés a models per a Cursor perquè ja no pot estar segura que SpaceX utilitzarà la seva tecnologia dins dels termes d'OpenAI. L'empresa també diu que els futurs models d'OpenAI no es proporcionaran a Cursor. Per als desenvolupadors, això podria alterar un flux de treball de codificació que normalment emparellava Cursor amb models d'OpenAI.
Què és Tencent Hy4 i per a què està dissenyat?
Tencent Hy4 és un model d'IA de codi obert creat per a enginyeria de programari, recerca i anàlisi financera. La versió prèvia utilitza una arquitectura combinada d'experts amb un total de 770.000 milions de paràmetres, alhora que activa uns 49.000 milions per a cada sol·licitud de text. Tencent té previst integrar Hy4 en productes com CodeBuddy i WorkBuddy, tot i que diu que la versió prèvia de vegades pot pensar massa i verificar en excés preguntes complexes.
Els investigadors d'IA poden millorar automàticament l'alineació del model?
La recerca d'Anthropic suggereix que els investigadors d'IA automatitzada poden identificar i provar tècniques per reduir diversos tipus d'errors d'alineació. Claude es va utilitzar per cercar investigacions existents, proposar enfocaments d'entrenament, executar experiments i avaluar millores en àrees com l'engany, les evasions de la clandestinitat i l'adulació. Anthropic també va trobar que algunes tècniques reeixides es van transferir a models més grans, tot i que l'estudi només va cobrir una gamma limitada de condicions d'alineació pràctiques.
Per què un tribunal va dictaminar que Anthropic estava il·legalment inclosa a la llista negra?
Un jutge federal va dictaminar que la designació d'Anthropic com a risc de la cadena de subministrament per part del Pentàgon era inconstitucional, arbitrària i capriciosa. La disputa va sorgir després de la negativa d'Anthropic a eliminar les restriccions que implicaven la vigilància massiva dels nord-americans i les armes autònomes letals sense supervisió humana. La sentència podria convertir-se en un punt de referència important en futures disputes sobre si els governs poden penalitzar les empreses d'IA per mantenir les seves pròpies restriccions de seguretat.
Per què a16z inverteix 1.100 milions de dòlars en infraestructura d'IA?
Andreessen Horowitz va crear el seu Machine Age Fund, d'1.100 milions de dòlars, per invertir en els sistemes físics necessaris per escalar la intel·ligència artificial. El seu enfocament inclou xips, memòria, xarxes, emmagatzematge, centres de dades, robòtica i maquinari d'IA domèstica. El fons reflecteix un tema més ampli de notícies sobre IA: el progrés futur pot dependre tant de l'energia, la refrigeració, l'ample de banda i la infraestructura informàtica com de les millores en els models de programari.
Com estan canviant les visions generals d'IA de Google els resultats de cerca tradicionals?
Google està ampliant automàticament les Visions Generals d'IA per a algunes cerques, col·locant una resposta generada per IA més completa i una interfície de "Pregunta qualsevol cosa" abans dels resultats web tradicionals. Això significa que els enllaços normals poden aparèixer més avall a la pàgina que abans. Per als editors i els equips de SEO que segueixen les notícies sobre IA, el canvi planteja preguntes pràctiques sobre la visibilitat a la cerca, el trànsit de referència i com els usuaris descobreixen les fonts originals.