00后团队」共找到 5016 篇相关文章

算法论文8

大模型解数学题是真懂还是 “死记硬背”?|首个反例驱动的数学推理基准揭穿 “刷题式假象”!

随着大语言模型在数学领域应用渐广,其是否真具备数学推理能力成焦点。清华等团队提出反例推理评测基准COUNTERMATH,测试20+主流模型,结果不佳,而小样本微调能显著提升模型能力。

深度学习自然语言处理
推荐文章7

马斯克的好兄弟,卡帕西又双叒出新指南!GPT-5 Pro是AI编程最防线

在「代码稀缺时代」,Karpathy分享AI辅助编程体会。他认为不同工具各有优劣,Cursor适合日常开发,Claude Code与Codex能完成大块功能但缺「品味」,GPT - 5 Pro是攻克顽固bug的最防线。

新智元
推荐文章7

氛围编程行不通!CTO们集体炮轰AI编程:不是失业,而是失控

CTO们认为氛围编程是灾难,如代码上线出现系统崩溃、用户权限漏洞等问题。Augment Code的Chris Kelly演讲指出,AI写代码有局限,软件工程师要做决策,还给出写让AI接手代码的建议。

InfoQ
开源动态8

突发!字节开源 36B 模型Seed-OSS

字节跳动Seed团队开源Seed-OSS系列36B模型,用12T tokens训练,采用Apache-2.0许可证。该模型能灵活控制推理预算,有两个基座版本,Instruct版在多方面表现强劲,性能碾压OpenAI开源模型。

AGI Hunt
新闻资讯8

在OpenAI上班有多卷?离职员工爆料:7周打造Codex,每天熬到凌晨

OpenAI前员工Calvin French - Owen离职在博客分享工作经历。他介绍了OpenAI内部沟通、晋升机制、战略调整等情况,还讲述Codex 7周开发发布过程,最分享离职收获并建议创业者反思或加入顶级实验室。

机器之心
开源动态7

性能提升 10 倍,零改造实现 DIFY 模式迁移至 Spring AI Alibaba 模式

文章深度讲解如何将 Dify 平台开发的应用导出为 Spring AI Alibaba 工程。先介绍两者特点,通过示例展示转换过程,还阐述迁移收益,如扩展灵活、性能提升 10 倍,最提及 Spring AI 续计划。

阿里云开发者
新闻资讯7

Meta扩张继续!挖走OpenAI 2名多模态AI研发人员,收购语音初创公司PlayAI

据报道,Meta 首席执行官扎克伯格从 OpenAI 挖走 2 名多模态 AI 研发人员,还完成对语音初创公司 PlayAI 的收购。Meta 近期在 AI 人才争夺上攻势猛,想补足短板,其超级智能团队未来表现值得关注。

机器之心
算法论文8

RL救不了泛化性!揭示LLM数学Reasoning的深层瓶颈

大型语言模型在数学竞赛级任务依赖机械化推理,现有评测集有缺陷。UC Berkeley团队提出OMEGA基准量化其数学泛化能力,实验揭示复杂度引发性能崩塌等问题,指出LLM创新组合难,给出改进方向。

深度学习自然语言处理
产品应用8

Agent 成大厂新“战场”?从同程旅行 DeepTrip 看垂类 Agent 的设计与落地实践

文章聚焦同程旅行推出的垂类旅行 Agent DeepTrip,介绍其设计与落地实践。它能降低旅行决策成本,构建旅行服务生态。团队基于多方面考量选 Agent 架构,还从多维度介绍实现方法及未来规划。

InfoQ
算法论文8

ICML 2025 | 千倍长度泛化!蚂蚁新注意力机制GCA实现16M长上下文精准理解

在大语言模型发展中,长文本建模挑战大。蚂蚁研究团队提出注意力机制GCA,可端到端学习检索相关片段,实现超长序列处理与泛化,其Triton kernel实现已开源,论文被ICML 2025接收。

机器之心