「自演进评测」共找到 1878 篇相关文章
英伟达H20,一个备胎的命运
8月22日消息称英伟达暂停H20芯片生产。H20自2023年底推出就备受争议,性能阉割、或有“后门”等问题不断。英伟达忙着开发新芯片,H20不到两年或“寿终正寝”,本文以其口吻写自白信。
夸克高考,背后藏着的其实是垂类场景「深度研究」方法论
夸克早在2019年就提供高考志愿填报服务,今年推出“志愿报告”功能。其“志愿报告”Agent已生成超1000万份报告,采用PDCA模式给出指导。夸克构建可信度体现在数据库和自研模型上,还降低了幻觉率。
Nanbeige4.2-3B:探索通用Agent小模型
在模型越做越大的当下,推理成本成了影响Agent大规模使用的关键因素。南北阁实验室推出Nanbeige4.2 - 3B,在架构、数据构造和训练pipeline层面做了系统工作,评测表现良好,还探索本地个人助手等应用。
林俊旸离职后首度发声:万字复盘,大模型下一站「智能体式思考」
前阿里千问负责人林俊旸离职后发文,复盘大模型行业演进,指出 AI 大模型未来主线是智能体式思考。文中分析推理模型崛起的启示,探讨思考与指令融合难题,还阐述智能体式思维含义、强化学习基础设施挑战等。
AST | 西工大马龙、邬晓敬等:几何特征知识驱动的代理优化方法
机器学习为气动外形设计提供新方法,但高效挖掘利用几何与气动数据知识是难题。本文提出气动监督自编码器架构,利用小样本气动数据监督学习几何特征,嵌入优化框架提升样本质量及优化效率,经翼型和机翼验证有效。
振臂一挥,大半个具身机器人圈都来了!智源研究院:别藏了,谁贡献数据多,谁的大脑就更好用
2025智源具身智能Open Day上,智源研究院院长邀厂商共享数据,称谁家贡献多,具身大脑在其机器人上更好用。智源无商业包袱,开源数据、统一评测,布局具身大小脑体系,欲做具身智能“安卓”。
32B 稠密模型推理能力超越 R1?中国秘密 AI 团队发布推理小模型 AM-Thinking-v1
2025年,国内神秘A - M - team在Hugging Face开源32B推理模型AM - Thinking - v1。它在多推理评测中击败DeepSeek - R1,与超大规模模型成绩相当。团队靠后训练方案挖掘32B模型潜力,探索小体量实现大能力路径。
半年3轮10亿,他们都投了这家已经把机器人卖到500个家庭的公司
未来不远机器人半年获3轮10亿融资,字节跳动等入局。其全产业链闭环强大,展会表现优,已进入500多家庭。靠全栈自研、贴合需求等策略,在赛道脱颖而出,认为家用机器人应重真实落地。
从WAIC上爆火的功夫机器人,看到这家央企的具身智能「真功夫」
今年4月“功夫boy”机器人出圈,3个月后的WAIC上它全新升级。其背后是中国电信人工智能研究院(TeleAI),由李学龙教授带领。他们技术栈全面,在硬件、软件、数据等方面全栈自研,还布局智传网,未来发展潜力大。
“英伟达显卡就是一坨*”!博主6000字檄文怒批:烧接口、缺单元、驱动变砖还威胁媒体
博主Sebin发布近6000字檄文批判英伟达,指出其显卡有烧接口、缺单元、驱动变砖等质量问题,销售策略存在库存少、黄牛多、捆绑销售等问题,还试图操控媒体及评测机构。文章在Hacker News引发大量讨论。