论文分享会」共找到 3403 篇相关文章

算法论文8

CMU&斯坦福提出Reasoning新范式!自己找“窍门”,教LLM抽象Reasoning

大型语言模型解决复杂推理问题时效率低,论文提出创新方法,让模型利用“推理抽象”,通过RLAD两玩家强化学习框架训练,在多基准测试提升性能,还分析了其作用、局限与未来方向。

深度学习自然语言处理
推荐文章7

为什么我用了那么多提示词模板甚至用了 AI 帮忙还是写不好提示词?

现在很多人觉得模型强大,提示词工程没必要,但复杂需求仍需它。作者以写雷军演讲提示词和YouTube字幕生成提示词为例,介绍迭代创作过程,指出写不好提示词根源是难评估差距和调整。

宝玉AI
推荐文章7

AI优质信息源整理:高质量网站、博主与Twitter资源推荐

文章整理了AI优质信息源,介绍Twitter在AI浪潮中的重要性及筛选优质信息流方法,还列举知乎、B站等平台,以及资讯平台、网站、播客、博客等资源,给出挑选标准和了解领域的技巧。

AI Reading Hub
新闻资讯7

劝人退学、庆幸没读博浪费5年,26岁DeepMind“传奇人物”:大厂内部分散,AI研究很低效

26岁的Neel Nanda是DeepMind“传奇人物”,他涉足机械可解释性研究四年成果丰硕。在与主持人对话中,他分享经验,认为大厂内部分散、AI研究低效,还谈及读博、AI安全研究、公司决策等看法。

AI前线
新闻资讯7

辍学潮来了?19、20 岁年轻人“逃离”教室去 AI 创业,20 多年创业大佬断言:他们的机比大厂大

云存储公司 Box 创始人 Aaron Levie 分享创业经验与 AI 见解。他指出 AI 让初创公司机大增,巨头优势不再,年轻创业者将成长为新大厂,还分析了云计算与 AI 转型差异等。

InfoQ
算法论文8

让大模型合成检查器:UIUC团队挖出Linux内核90余个长期潜伏漏洞

伊利诺伊大学香槟分校张令明老师团队的论文提出KNighter,它让大模型生成静态分析检查器,在Linux内核挖出92个长期潜伏漏洞,将LLM归纳能力沉淀为规则,带来可落地等好处。

机器之心
算法论文7

Thinking Machines再发文:模块化流形让训练更稳定

Mira Murati团队分享神经网络训练推理新研究,提出“模块化流形”让训练更稳定。将权重约束在Stiefel流形,设计Manifold Muon优化器,实验显示效果好,但计算开销和理论问题待解决,代码已开源。

AI工程化
产品应用8

Sora 2瑟瑟发抖!通义万相2.5放大招:一句话出1080P电影,音画精准同步

云栖大上通义万相2.5系列模型亮相,包含四大模型,视频生成模型实现音画同步突破,降低电影级视频创作门槛。它创作能力全方位升级,支持多种模态输入,采用原生多模态架构。

新智元
算法论文8

谷歌发布首个AI+教育RCT实验,传统教材要凉?

谷歌论文提出Learn Your Way AI增强型教科书系统,有两阶段AI生成框架,构建完整学习体验。经专家评审和RCT证明,使用该系统的学生学习效果和体验更好,还介绍了其可用场景。

CourseAI
算法论文8

刘鹏飞组提出Agent领域的少即是多:智能不在于数据堆砌,78个样本训练出超强Agent,128倍效率提升

刘鹏飞组论文《LIMI: Less is More for Agency》提出颠覆性观点,认为Agent智能培育关键在数据质而非量。LIMI用78个样本在AgencyBench得分超基线模型,实现128倍数据效率提升,为Agent开发提供新路径。

深度学习自然语言处理