「高被引科学家」共找到 3753 篇相关文章
南大团队直击大模型高分神话:人类90分,最强模型仅49分
南京大学傅朝友团队在Google Gemini评测团队邀约下推出视频理解新基准Video - MME - v2。它有创新的分层能力体系与组级非线性评分,经超3300人工时标注。评测显示模型与人类差距大,还揭示传统Acc指标虚高、‘Thinking’并非总增益等现象。
CVPR 2026 | ReFTA:打破张量化PEFT的「权重重建」瓶颈
随着大模型发展,全参数微调成本高,参数高效微调(PEFT)成主流。常见基于矩阵低秩分解的PEFT方法有局限,张量化PEFT虽有优势但存在权重重建问题。本文提出ReFTA方法解决该问题,有工程和理论优势。
聊聊钉钉的悟空:给一个还没人走路的市场卖跑鞋?
钉钉发布悟空,与其他大厂先面向个人用户不同,它走企业级路线,有四层Skill体系等,虽初期被认为‘太重’,但钉钉全产品CLI化等创新有潜力,且安全设计是企业刚需,适合特定人群关注。
480P的元宇宙入口:Midjourney不是在做视频,是在造"任意门"
Midjourney发布首个视频模型Video V1,它只能图生视频,操作便捷。虽分辨率仅480P,但采样率高。生成成本低,会员就能用。其美学表现好、生成速度快,不过在提示词理解等方面较弱。该公司有独特愿景。
海淀105款大模型背后:看这些AI玩家如何抢占内容生产制高点
在北京海淀文化沙龙上,大家探讨AI如何重塑内容生产。海淀有105款备案大模型,占全国五分之一。快手可灵月入超1亿,AI音乐大模型让创作大众化,投资人捕捉到AIGC创业潮,新的内容生产秩序正被改写。
英伟达开源9B参数小模型,比Qwen3快6倍
英伟达推出新型小型语言模型Nemotron Nano v2,在复杂推理基准测试上准确率与Qwen3 - 8B相当或更高,速度快6倍。它兼顾推理与非推理任务,支持“思考”预算控制,还开源了创建模型的绝大部分数据。
接入 MiniMax M2.7 后,我的 OpenClaw「超进化」了
作者实测 MiniMax 新模型 M2.7,其在基准测试、代码能力、多智能体协作等方面表现出色。接入 OpenClaw 后,能高效完成复杂任务。M2.7 指令遵循率高、长上下文处理能力强且价格低,有望提升 Agent 生态表现。
三天逆袭,Sora登顶美榜!15秒大片玩疯奥特曼,全网直呼真假难辨
上线三天,Sora APP登顶美国App Store榜首,Sora 2的「客串」功能和物理智能实现音画同步,奥特曼亲自下场被玩坏。Sora 2 Pro一次可拍15秒大片。奥特曼预告两大更新,Sora却带来视频造假隐患。
腾讯混元A13B用130亿参数达到千亿级效果,Flash Attention作者点赞
腾讯混元A13B模型仅130亿激活参数,却能和千亿级大模型竞争,获Flash Attention作者赞叹。它精准卡位性能与效率‘甜蜜点’,依托高质量预训练和结构化后训练,多方面表现突出且已全面开源。
DeepSeek-R2为什么还没发?
全网期待的DeepSeek - R2再次被曝推迟。The Information称因CEO不满其表现,且可能因缺英伟达H20芯片致研发慢。回顾其“难产”过程,网友看法不一,有人认为延迟值得,有人推测要等V4。