「95后团队」共找到 5026 篇相关文章
全球首个龙虾模型 GLM-5-Turbo 发布:已经在用它帮我省几千块钱了
作者作为公众号编辑,排版耗时久费钱。他测试多款模型驱动龙虾排版均失败,换上智谱 GLM - 5 - Turbo 后成功,还能让其操作飞书润稿。该模型工具调用稳定,虽 API 涨价但性价比高,未来潜力大。
LeCun新公司10.3亿美元种子轮融资,三顾茅庐拉谢赛宁入伙
图灵奖得主LeCun主导的AMI获10.3亿美元种子轮融资,投前估值35亿美元。团队抛弃大模型路线,转向联合嵌入预测架构,为通用人工智能提供新解法,还将落地多领域,且承诺开源研究。
清华新框架让大模型学会「精读略读」!实现12倍端到端加速,基准评分翻倍
清华等团队提出全新框架RAM,受人类阅读认知启发,将“精读+略读”混合策略引入上下文压缩,突破现有方法效率瓶颈,在多任务上表现出色,实现12倍端到端加速,为长上下文LLM部署提供新范式。
视听分离SOTA提速6倍!清华发布首个6M高性能模型|ICLR'26
清华大学团队推出Dolphin模型,仅用6M参数,通过离散化视觉编码和热扩散注意力机制,实现单次推理精准分离语音,速度提升6倍以上,在多项基准测试中刷新纪录,为端侧设备部署开辟新路。
一个大脑搞定所有模态,百度ERNIE 5.0技术报告公布
模型发布近3个月后,百度ERNIE 5.0技术报告公布。其底座用超级稀疏架构,参数量万亿但推理激活参数不到3%,实现四种模态原生自回归统一,还在路由调度、训练范式等多方面有创新。
从显式CoT到隐式CoT:复旦让AI告别啰嗦,实现大模型高效沉默推理
复旦大学等机构团队论文提出SIM - CoT技术,解决隐式思维链推理准确率低、不稳定问题。该技术引入步骤级监督,提升性能、效率和可解释性,在多模型和任务测试中表现出色,让大模型高效沉默推理。
Chrome已死,AI浏览器当立!认知革命比技术成熟来得更快。
文章指出AI浏览器重新定义底层逻辑,从导航工具变为执行意图的引擎,有持续意图记忆等核心能力。即便成功率不高,用户也易完成认知转变,还总结了AI产品团队应知道的规律及失败类型。
Claude: 可视化
文章指出早期人与人靠体力拉开差距,工业革命后比拼脑力,AI 时代脑力被大模型拿走,人将比较心力。面对 AI 生成的海量文本,可视化或为解决脑力理解带宽瓶颈的解药,还给出了相关 Prompt。
攻克AI过度思考难题!美团新研究让通过“可验证”过程奖励激活LRM的高效推理
美团等机构研究团队针对LRM“过度思考”问题,提出可验证的过程奖励机制(VSRM)。它结合可验证奖励与步骤级奖励,为推理步骤分配奖励信号。实验显示其能降低输出长度并保持性能。
清华叉院教授手把手教你用强化学习训练智能体
在大模型智能体时代,智能体强化学习训练通用智能体很关键。ASearcher 是相关项目,AReaL 有交互次数和代码设计优势。本次吴翼教授将带团队成员,以多轮搜索智能体为例,教用最少代码实现训练。