Jalapeño se eerste resultate toon toon toonaangewende spoed en doeltreffendheid in KI-inferensie ↗
OpenAI het die eerste prestasieresultate vir Jalapeño, sy pasgemaakte inferensie-skyfie, gepubliseer. Op GPT-OSS 120B sê dit dat die skyfie ongeveer 1.9 keer meer piekdeurset per kilowatt en ongeveer 1.7 keer laer end-tot-end latensie as die vergelykingstelsel.
Die winste is ook oorgedra na DeepSeek R1 en Kimi K2.5. OpenAI beplan om Jalapeño binne sy eie rekenaarinfrastruktuur te ontplooi, terwyl tweede- en derdegenerasie-ontwerpe reeds aan die gang is... so ja, OpenAI word toenemend ook 'n soort skyfiemaatskappy. (OpenAI)
Claude Cowork onthou uiteindelik wat jy vir die app in die klets gesê het ↗
Antropies het Claude se geheue oor gereelde klets en Cowork verenig. Inligting wat tydens gesprekke geleer word, kan gebruikers nou in agenttake volg, wat daardie effens waansinnige ritueel om dieselfde projek oor en oor te verduidelik, uitskakel.
Gebruikers kan onthoude onderwerpe inspekteer, wysig en verwyder, terwyl herinneringe opdateer terwyl gesprekke steeds plaasvind. Die funksie is standaard geaktiveer vir Gratis-, Pro- en Maks-planne. (TechCrunch)
Google Cloud loods Gemini Enterprise vir Regspraktyke ↗
Google Cloud het 'n doelgeboude Gemini Enterprise-pakket vir prokureurs onthul, wat sy agente verder as generiese klets stoot en in kontrakhersiening, regsnavorsing, regulatoriese monitering, privaatheidsversoeke en dokumentopstel stoot.
Dit sluit konnektors in vir platforms soos Harvey, iManage, Docusign, RelativityOne en Thomson Reuters, terwyl firmas se bestaande toegangsbeheer en etiese mure behoue bly. Die KI-agent-grondgryp het die regsafdeling bereik... voorspelbaar, maar steeds redelik vinnig. (Google Cloud Press Corner)
Google Cloud loods Gemini Enterprise vir Finansiële Dienste ↗
Google het ook 'n finansiespesifieke Gemini Enterprise-aanbod bekendgestel, insluitend 'n bestuurde Finansiële Navorsingsagent, meer as 50 gespesialiseerde vaardighede en 13 verbindings met finansiële en markdatastelsels.
Die platform teiken werkvloeie, insluitend kredietrisikobepaling, portefeuljemonitering, KYC-navorsing en markanalise. CME Group en Deutsche Bank is van die organisasies wat reeds betrokke is - ondernemingsagente raak toenemend gespesialiseerd, amper soos sagteware wat 'n pak dra. (Google Cloud Press Corner)
NVIDIA kondig Jetson Orin Nano 2-robotrekenaar aan om intreevlak-edge-KI te herdefinieer ↗
Nvidia het Jetson Orin Nano 2 bekendgestel, 'n kompakte rekenaar wat gemik is op robotte, hommeltuie en ander fisiese KI-stelsels. Dit bied 78 triljoen bewerkings per sekonde, 8 GB geheue en 'n agtkern Arm-SVE.
Nvidia sê inferensieprestasie verdubbel teenoor die vorige Nano Super, terwyl dit 40% minder krag. Kleiner modelle wat werklik bekwaam word op kompakte hardeware is die interessante deel hier - die KI hoef nie altyd meer die reuse-datasentrum te bel nie. (NVIDIA Nuuskamer)
Perplexity werk saam met Nvidia om Portable Computer te loods, 'n volledig plaaslike KI-agent met geen tokenkoste nie ↗
Perplexity het Portable Computer bekendgestel, wat sy agentiese rekenaarervaring na Nvidia-aangedrewe plaaslike hardeware bring. Modelle, lêers en agentuitvoering kan op die gebruiker se masjien bly, met plaaslik voltooide werk wat geen wolkfaktureringskrediete.
Take begin plaaslik, en die stelsel vra toestemming voordat 'n stap na 'n grensverskuiwende wolkmodel geëskaleer word. Dit word rondom Nvidia DGX Spark- en Linux-stelsels met voldoende kragtige RTX GPU's bekendgestel - privaatheid en koste word skielik deel van die plaaslike KI-verkoopsrede, nie net spoed nie. (Venturebeat)
Anthropic sal na verwagting aan beleggers sê dat hulle meer as $30 triljoen in potensiële inkomste sien, berig WSJ ↗
Anthropic berei glo voor om beleggers te vertel dat sy totale aanspreekbare mark meer as $30 triljoen. Belangrike onderskeid - dit is die teoretiese jaarlikse geleentheid as KI die relevante werk vasgelê het, nie Anthropic wat voorspel dat dit $30 triljoen sal maak nie. (Reuters)
Die enorme syfer help om Anthropic se infrastruktuurbesteding, sy mededinging met OpenAI en Google, en die breër beleggersverhaal te raam. Dis 'n skouspelagtig groot getal... selfs volgens KI-bedryf-syferstandaarde. (Reuters)
Gereelde vrae
Wat beteken OpenAI se Jalapeño-skyfieresultate vir KI-inferensie?
OpenAI sê Jalapeño het hoër piekdeurset per kilowatt en laer end-tot-end latensie gelewer as sy vergelykingstelsel terwyl dit GPT-OSS 120B gebruik het. Soortgelyke winste is gerapporteer met DeepSeek R1 en Kimi K2.5. Die resultate dui daarop dat OpenAI toenemend hardeware ontwerp rondom die spesifieke doeltreffendheids- en spoedvereistes van grootskaalse KI-inferensie.
Hoe werk Claude se gedeelde geheue oor klets en Cowork?
Claude kan nou inligting wat in gereelde gesprekke geleer is, na Cowork-take oordra, wat die behoefte verminder om dieselfde projek of konteks herhaaldelik te verduidelik. Gebruikers kan onthoude onderwerpe inspekteer, wysig en verwyder, terwyl daardie herinneringe kan aanhou opdateer soos gesprekke ontwikkel. Volgens die aankondiging wat in die artikel gedek word, is die funksie standaard geaktiveer op Free-, Pro- en Max-planne.
Wat kan Gemini Enterprise vir Regs- en Finansiële Dienste doen?
Google Cloud se gespesialiseerde Gemini Enterprise-aanbiedinge is gemik op bedryfspesifieke werkvloeie eerder as generiese KI-klets. Die regspakket dek gebiede soos kontrakhersiening, navorsing, regulatoriese monitering, privaatheidsversoeke en opstel, terwyl die finansiëledienste-weergawe werkvloeie ondersteun, insluitend kredietrisikobepaling, portefeuljemonitering, KYC-navorsing en markanalise. Beide kan ook koppel aan bestaande professionele data- en sagtewarestelsels.
Waarom word plaaslike KI-inferensie belangriker?
Plaaslike KI-inferensie kan privaatheid versterk, afhanklikheid van wolkinfrastruktuur verminder en moontlik deurlopende gebruikskoste verlaag. Nvidia se Jetson Orin Nano 2 teiken robotte, hommeltuie en ander randstelsels, terwyl Perplexity se draagbare rekenaar modelle, lêers en agentuitvoering op versoenbare plaaslike hardeware hou. In baie werkvloeie kan wolkmodelle dan gereserveer word vir take wat addisionele vermoë vereis.
Hoe besluit Perplexity Portable Computer wanneer om wolk-KI te gebruik?
Take is ontwerp om op die gebruiker se plaaslike Nvidia-aangedrewe hardeware te begin, terwyl versoenbare modeluitvoering en lêers op die masjien gehou word. As 'n stap 'n grenswolkmodel vereis, vra die stelsel die gebruiker om toestemming voordat dit geëskaleer word. Werk wat plaaslik voltooi word, verbruik nie wolkfaktureringskrediete nie, wat die benadering relevant maak vir gebruikers wat bekommerd is oor beide privaatheid en herhalende afleidingskoste.
Wat beteken Anthropic se gerapporteerde $30 triljoen KI-markraming?
Die gerapporteerde syfer verwys na Anthropic se siening van die potensiële totale aanspreekbare mark vir KI, nie 'n voorspelling dat Anthropic self $30 triljoen in jaarlikse inkomste sal genereer nie. Dit verteenwoordig die teoretiese waarde van werk wat KI moontlik oor die ekonomie heen kan aanspreek. Die skatting help ook verduidelik waarom toonaangewende KI-maatskappye so swaar in infrastruktuur en ondernemingsvermoëns belê.