「95后团队」共找到 5024 篇相关文章
PosterGen:告别学术海报制作烦恼,从PDF一键生成「演示级」可编辑PPTX学术海报
许多研究者制作学术海报耗时费力,现有自动化方法有缺陷。联合团队推出PosterGen,能将论文PDF转成可编辑PPTX海报。它有核心创新,遵循四大设计原则,工作流由四个智能体构成,实验证明其有效。
仅需152个样本,性能提升48%:Memory-R1如何重塑Agent记忆能力?
这篇文章解读论文Memory - R1,其由多所高校研究团队完成,旨在解决LLM在长对话和多轮任务中的‘记忆难题’。通过强化学习让LLM学会管理记忆,用152个问答对训练,大幅超越现有基线模型。
大模型解数学题是真懂还是 “死记硬背”?|首个反例驱动的数学推理基准揭穿 “刷题式假象”!
随着大语言模型在数学领域应用渐广,其是否真具备数学推理能力成焦点。清华等团队提出反例推理评测基准COUNTERMATH,测试20+主流模型,结果不佳,而小样本微调能显著提升模型能力。
马斯克的好兄弟,卡帕西又双叒出新指南!GPT-5 Pro是AI编程最后防线
在「代码后稀缺时代」,Karpathy分享AI辅助编程体会。他认为不同工具各有优劣,Cursor适合日常开发,Claude Code与Codex能完成大块功能但缺「品味」,GPT - 5 Pro是攻克顽固bug的最后防线。
氛围编程行不通!CTO们集体炮轰AI编程:不是失业,而是失控
CTO们认为氛围编程是灾难,如代码上线后出现系统崩溃、用户权限漏洞等问题。Augment Code的Chris Kelly演讲指出,AI写代码有局限,软件工程师要做决策,还给出写让AI接手代码的建议。
突发!字节开源 36B 模型Seed-OSS
字节跳动Seed团队开源Seed-OSS系列36B模型,用12T tokens训练,采用Apache-2.0许可证。该模型能灵活控制推理预算,有两个基座版本,Instruct版在多方面表现强劲,性能碾压OpenAI开源模型。
在OpenAI上班有多卷?离职员工爆料:7周打造Codex,每天熬到凌晨
OpenAI前员工Calvin French - Owen离职后在博客分享工作经历。他介绍了OpenAI内部沟通、晋升机制、战略调整等情况,还讲述Codex 7周开发发布过程,最后分享离职收获并建议创业者反思或加入顶级实验室。
性能提升 10 倍,零改造实现 DIFY 模式迁移至 Spring AI Alibaba 模式
文章深度讲解如何将 Dify 平台开发的应用导出为 Spring AI Alibaba 工程。先介绍两者特点,后通过示例展示转换过程,还阐述迁移收益,如扩展灵活、性能提升 10 倍,最后提及 Spring AI 后续计划。
Meta扩张继续!挖走OpenAI 2名多模态AI研发人员,收购语音初创公司PlayAI
据报道,Meta 首席执行官扎克伯格从 OpenAI 挖走 2 名多模态 AI 研发人员,还完成对语音初创公司 PlayAI 的收购。Meta 近期在 AI 人才争夺上攻势猛,想补足短板,其超级智能团队未来表现值得关注。
RL救不了泛化性!揭示LLM数学Reasoning的深层瓶颈
大型语言模型在数学竞赛级任务依赖机械化推理,现有评测集有缺陷。UC Berkeley团队提出OMEGA基准量化其数学泛化能力,实验揭示复杂度引发性能崩塌等问题,指出LLM创新组合难,给出改进方向。