「AI 大模型」共找到 13974 篇相关文章
“AGI 五年内或将实现”:AI 教父 Bengio 呼吁中美达成共识,警惕 AI 沦为人类武器
AI 教父 Yoshua Bengio 在 2025 北京智源大会表示,AI 完成任务时长每七个月减半,约五年后或达人类水平,AGI 或将到来。他呼吁中美达成共识,警惕 AI 沦为武器,还提出构建“Scientist AI”等观点。
半夜被AI「吓醒」!57岁导师投奔24岁华人女学霸,打造「AI数学家」
57岁杰出数学家Ken Ono辞去终身教职,加入24岁学生Carina Hong创办的Axiom Math。Carina履历逆天,想打造「AI数学家」。Ken受研讨会冲击,看好AI数学潜力,将助力模型发展。
DeepSeek点燃大模型效率之争,阶跃火速接棒:JetSpec让大模型解码速度最高提升近10倍
近期,DeepSeek发布DSpark,阶跃星辰发表JetSpec论文,二者聚焦大模型推理效率。DSpark关注验证效率,JetSpec从Draft生成本身入手。结果显示,二者都有加速效果,共同表明推理效率正成Agent落地关键变量。
国产大模型「五强争霸」,决战AGI!
中国基础大模型市场形成「基模五强」格局,包括字节、阿里、阶跃星辰、智谱和DeepSeek。它们要么有钱,要么有人,各有特色与优势。未来竞争焦点是追求更高「智能上限」和突破「多模态能力」,决战AGI。
清华唐杰团队揭示大模型记忆全景
清华唐杰教授团队等发布大模型记忆架构综述,提出三维记忆分类学,将前沿工作统一到理论框架,为LLM设计指明方向,分析了隐式、显式记忆架构,还探讨混合架构挑战与未来方向。
700多个「坏模型」喂出AI测谎仪?Anthropic审计神器让AI自曝黑料
Anthropic故意训练近700个「有问题」模型,训了LoRA适配器(IA)让模型自报家门。IA在AuditBench平均成功率59%,但也存在幻觉、成本高、训练分布无指南等局限。
让大模型异步地增强推理能力
在大模型推理时代,Test - Time Scaling成提升能力重要方向,但面临效率问题。ATTS提出异步框架,加入共形预测筛选候选路径,实验显示其加速显著,将测试时扩展推进到‘有原则加速’阶段。
大语言模型 + 编程智能体 = 安全噩梦
作者结合黑帽大会英伟达演讲,指出大语言模型和编程智能体扩大攻击面。如攻击者利用公共资源留恶意指令,实施水坑攻击。强大编程智能体虽普及,但易造成安全漏洞,虽有防御措施但效果有限。
像开发软件一样造世界,Agent2World来了,把世界模型做成可运行的符号环境
为让模型真正“能行动”,需可执行、可验证的符号世界模型,但现有自动生成路线有困局。研究团队提出 Agent2World,经实验验证有显著效果,能稳定产出高质量符号世界模型,开辟 AI 理解现实环境新可能。
还在为AI数据发愁?张文涛和鄂维南院士团队推出Data-centric AI系统
近年来大模型发展由科技公司主导,其数据资源不公开,学术界构建优化数据难。张文涛和鄂维南院士团队推出DataFlow系统,可实现数据治理,有算子和流水线,支持文本模态,多模态版待推出。