They believed AI even when it was wrong…51.3% of participants in long-video tasks did not check the original
Using AI increased video-search productivity by 3–35%, but reduced accuracy by up to 32%.
Modelli, agenti, applicazioni: l’intelligenza artificiale messa al lavoro su problemi reali.
Qui l’intelligenza artificiale si giudica sulle prove: che cosa fa, per chi, a quale costo. La rubrica segue i modelli e i loro progressi misurabili, gli agenti che eseguono compiti reali e soprattutto le adozioni sul campo — un ospedale che esamina più pazienti, una rete elettrica gestita meglio, un’amministrazione che risponde più in fretta. L’IA spettacolo, i round di finanziamento senza prodotto e le profezie non trovano posto.
Preferiamo i casi d’uso documentati, numeri alla mano: quanti esami, quale tasso d’errore, quale risparmio. Gli attori non occidentali — laboratori cinesi, indiani, emiratini — sono trattati come quelli americani, perché buona parte dell’adozione reale avviene lì. Ogni articolo cita le sue fonti e distingue il prototipo dal servizio in produzione.
Using AI increased video-search productivity by 3–35%, but reduced accuracy by up to 32%.
The number of Qwen derivative models on Hugging Face Hub reached 151,448.
Meshy 7 measures how closely a generated 3D model matches its source image.
Cloudflare wants to let AI agents pay for paid APIs using a wallet.
- A charged fluoropolymer surface lets a robot detect nearby objects without physical contact.
Maintaining its 700-billion-parameter scale, GLM-5.3 relies primarily on post-training to improve coding and agent capabilities.
- Zhipu released GLM-5.3 hours after its chief scientist teased “sooooooon.”
HyperOS 4 is Xiaomi’s first AIOS, with Super XiaoAI able to call on the system, apps and devices.
- DeepSeek has open-sourced a developer preview of Harness under the MIT license.
Razorpay is testing ChatGPT-native storefronts with around 50 brands.
X Square Robot's public demonstration says its dual-arm robot sorted 1,816 randomly mixed packages in one hour.