「专家级表现」共找到 3393 篇相关文章
今年诺奖成果曾遭质疑无用,但华人团队用它研制了未来芯片的「钥匙」
2025年诺贝尔化学奖成果MOF曾因稳定性差、成本高,实际应用寥寥。如今,海外华人科研团队用其造出纳米级液体芯片,能执行逻辑运算,有记忆效应,成果发表在Science子刊。
无Tokenizer时代真要来了?Mamba作者再发颠覆性论文,挑战Transformer
Mamba作者之一Albert Gu参与的论文提出分层网络H - Net,用动态分块取代tokenization。Tokenization虽能压缩序列但有缺点,H - Net在多方面表现出色,或预示无需Tokenizer训练时代到来。
直播预约 | Recursive Self-Improvement:当AI开始进化AI
2026年AI已能在无人类干预下自我进化。6月24日19:00 - 21:00,机器之心联合黄大年茶思屋举办直播,汇聚仉尚航等专家,呈现“AI如何自我超越”的技术路线与未来图景。
具身智能迈入下半场,RoboMemArena全面评测机器人记忆系统
香港科技大学(广州)等多机构打造具身智能评测基准 RoboMemArena,突破传统局限,构建综合评测体系,配套真机测评。它提供多模态标注,任务长程多样,开源资源易用,PrediMem 在其上表现出色。
60个量子比特顶百万倍内存:量子机器学习找到新的突破口
4月8日,加州理工学院等联合团队在arXiv发布论文,证明小型量子计算机处理部分机器学习任务时,可用指数级更少内存超越经典计算机。研究绕开QRAM,提出算法框架验证优势,但仍待真实硬件验证。
会解题不等于懂人心,腾讯混元提出Sentient Agent,提高高阶社交认知能力
过去评判LLM像考核‘做题家’,但会解题不等于懂人心。腾讯团队提出SAGE框架,用会闹情绪的agent评委评估模型高阶社交认知能力。实验显示不同模型表现差异大,未来需懂人心的AI。
马斯克Grok 4.1双冠封王,爆冲第一!AI王座一夜易主
马斯克携xAI推出Grok 4.1并免费开放。它在LMArena和EQ - Bench登顶,写作Elo提升600分、幻觉率降3倍。后训练RL规模扩大,还经盲测评估,在多方面表现出色。
史上最大IPO要来了
据英国《金融时报》,全球头部AI企业Anthropic最快10月上市,估值或达2万亿美元,将超SpaceX成史上最大IPO。其营收增长快,靠编程等企业级业务逆袭,还引得众多科技资本下注。
学术海报不用愁,一句话精准自动编辑,华东师大开源APEX
华东师范大学Planing Lab提出APEX框架,能通过自然语言指令实现学术海报局部可控编辑,引入「审查—调整」机制提升可靠性。还构建APEX - Bench评估,实验显示APEX优于其他方法。
抱歉了GPT-5,这次是中国AI「上岸」了
国家卫健委发布意见,将「AI+医疗」提升到国家层面,落地重点在基层。「未来医生AI工作室」以MedGPT为底座,经测评在安全性和有效性上领先,在实战盲测中也完胜GPT - 5等,为基层医生赋能。