多学科优化」共找到 5025 篇相关文章

算法论文8

谷歌Transformer过时了?清华姚班校友等三连击,爆改注意力!

谷歌提出新架构,参数减少40%,训练速度较RNN提升5 - 8倍,某些任务性能超Transformer 7.2%。新架构引入注意力偏向策略,用「保留」取代「遗忘」,还提出Moneta、Yaad、Memora三个新模型,在任务上表现卓越。

新智元
产品应用7

The Batch: 964 | Claude 亮相另一款 Opus

Anthropic发布Claude Opus 5,这是款视觉 - 语言模型,运行成本低,任务表现优于Claude Fable 5。它在项测试中领先,解决了Fable 5的一些问题,但也有易产生幻觉等不足。

DeeplearningAI
开源动态7

爆改!8.1 万 Star LobeHub ,终于让我彻底解放啦!!!!!

LobeHub是开源的Agent工作与生活空间,GitHub约8.1万Star。它将Agent作为工作基本单位,解决了Agent管理难题,有创建、协作、调度等功能,还介绍了工作流和自托管方法。

小华同学ai
算法论文8

上海AI Lab新研究:SFT能泛化,只要满足这三个条件

上海人工智能实验室等团队研究指出,“SFT泛化能力差”定论有局限。SFT泛化能力受优化过程、数据质量与结构、模型基础能力共同制约,研究还揭示其训练中的现象及副作用。

量子位
产品应用7

Clawdbot火了,Anthropic急了,Claude Code连夜更新了Agent任务系统。

Claude Code更新Tasks系统,将原TODO系统升级,任务可借助文件系统持久化,实现进度同步。Task变为依赖图,有阻塞关系,还能让个Agent分工协作,任务状态存本地文件,方便查看。

探索AGI
算法论文8

“交互式Scaling”:增加Agent与环境交互的深度和频率来提升性能

在AI发展中,商业研究Agent是“黑箱”,开源研究Agent性能有差距。MiroMind团队推出MiroThinker v1.0,提出“交互扩展”提升性能,在基准测试表现出色,也指出了当前版本的局限。

深度学习自然语言处理
产品应用8

AI Code赛道跑出一匹黑马:字节Doubao-Seed-Code

字节发布面向Agentic Coding任务优化的编程模型Doubao - Seed - Code。它在代码能力、生态兼容性、价格上优势明显,在实际案例中表现出色,其训练体系独特,为开发者提供高性价比选择。

PaperAgent
新闻资讯8

硅谷热议:最快语音转文字模型

AI语音独角兽ElevenLabs发布Scribe v2 Realtime实时语音转文本模型,实现150毫秒超低延迟、93.5%高准确率,覆盖90种语言,打破速度与精度不可兼得困境,此前该领域痛点

量子位
推荐文章8

YC 编写的 《Vibe Coding 指南》

本文是 YC 编写的《Vibe Coding 指南》,采访位创始人总结出 AI 协作编程指南,涵盖规划流程、版本控制、测试框架等方面,还提及 AI 在编码外的应用及持续改进方法。

宝玉AI
推荐文章8

大型语言模型正在掏空和填满你的钱包

人工智能改变赚钱和花钱方式,生成式AI每年或为全球经济增2.6 - 4.4万亿美元。文章介绍LLM在领域应用,如客服降成本、内容创作提效率等,企业应积极拥抱技术革命。

AIGC开放社区