「评估驱动开发」共找到 2707 篇相关文章
突发!Cognition宣布收购Windsurf:看上的还是AI人才
Cognition宣布收购Windsurf,旨在构建软件工程未来。此次是全面整合,获其核心产品、IP、强劲业务、庞大用户基础及顶尖人才。Cognition还提供员工保障方案,战略协同有望变革软件开发模式。
MemOS:一种用于 AI 应用的记忆操作系统
大型语言模型缺乏记忆管理系统,限制其发展。MemTensor与高校联合开源MemOS,它将记忆视为可管理资源,有三层架构,系统化三种记忆类型。评估显示其在推理、检索、加速等方面表现优异。
奥特曼抢走小扎印钞机!Meta「占领」OpenAI,20%都是前同事
新智元报道,OpenAI高管中大量前Meta员工任职,约占20%。公司战略现Meta影子,考虑广告业务,引发员工担忧。此外,OpenAI在Sora成功后着手开发音乐AI,欲进军音乐领域。
谷歌实验室推出了 Opal,一个用于创建 AI 迷你应用程序的可视化平台
谷歌实验室推出实验性无代码工具 Opal,可让用户通过自然语言和可视化编辑器创建 AI 小应用。它支持两种交互模式,开发完成后能分享链接。开发者关注其与微软产品竞争前景。
写代码从来不是瓶颈
Pedro Tavares认为软件开发瓶颈并非写代码,而是代码审查、知识传递等“人类开销”。LLM让写代码变容易,但理解、测试代码成本更高,未解决根本问题,团队理解代码成本才是瓶颈。
DeepSeek被曝自研AI推理芯片
据路透社报道,DeepSeek 正开发自研 AI 推理芯片,欲降低对英伟达和国产芯片依赖。此为重大战略转变,影响英伟达股价。虽有降本等好处,但面临技术、制造、生态等挑战。
一句话造世界!开发者用10天婚假爆肝,让AI小镇真正「活」了过来
2023年斯坦福「AI小镇」火了,但后续类似项目世界多人工搭建、固定。独立开发者用10天婚假开发WorldX,输入一句话5分钟就能生成完整AI世界,还解决了让AI看懂自己生成图等难题。
对话 MoonBit 张宏波:为 AI 重构编程语言
文章围绕 MoonBit 语言开发者张宏波展开,探讨为 AI 重构编程语言。指出当前 AI Coding 基于旧有语言有局限,MoonBit 有原生 AI 支持,还介绍其开发历程、特性及 Pilot 工具创新,强调未来商业化愿景。
会解题不等于懂人心,腾讯混元提出Sentient Agent,提高高阶社交认知能力
过去评判LLM像考核‘做题家’,但会解题不等于懂人心。腾讯团队提出SAGE框架,用会闹情绪的agent评委评估模型高阶社交认知能力。实验显示不同模型表现差异大,未来需懂人心的AI。
鹅厂员工怎么看Agent自动持续进化?
落地一个Agent容易,但让其自动持续优化很难。文章分享了9位鹅厂同事对“Agent如何自动持续进化”的看法,如建立评估体系、记录真实任务反馈、结合强化学习等。