演化规律」共找到 145 篇相关文章

新闻资讯8

程序员都在给AI当“监工”!7万多条编程消息揭开当前编程现状

圣母大学和范德堡大学研究团队剖析超7万条编程指令,揭示开发者与AI编程助手协作现状。开发者多当“监工”,工作从敲代码转向指导AI、诊断错误等,还总结出人机协同的诸多规律

AIGC开放社区
推荐文章8

Agent/Skills/Teams 架构演进过程及技术选型之道

文章结合作者实践与多篇论文,梳理Agent架构从单点提示词调用到Agent Teams的演进逻辑,分析Single Agent、Multi - Agent、Agent Skills、Agent Teams的优劣,给出架构选型建议,强调架构应与问题复杂度匹配。

阿里云开发者
算法论文7

OpenAI谈:大模型为什么会有幻觉?如何避免?

OpenAI论文探讨大模型幻觉问题,指出评测缺陷,像多数AI模型评测非对即错,模型为得分会瞎猜。还从预训练和后训练阶段剖析根源,提议改造评测,引入置信度阈值和错误惩罚机制。

探索AGI
算法论文8

大模型到底是怎么「思考」的?第一篇系统性综述SAE的文章来了

在大语言模型时代,人们需要“能解释”的LLM。SAE技术崛起,作者团队发布首篇SAE综述,梳理其技术、演化和挑战。介绍了SAE概念、优势,涵盖其技术框架、可解释性分析等多方面内容。

机器之心
算法论文8

Meta联合Google新作:语言模型到底“记”了多少东西?

Meta和Google合作的论文探讨现代语言模型对训练数据的“记忆”情况。研究发明新方法精确测量“记忆”量,发现模型记忆有上限且与参数线性相关,还揭示学习转折、隐私规律等重要结论。

深度学习自然语言处理
产品应用8

Google | 发布革命性编码智能体:AlphaEvolve,突破数学极限!

DeepMind 发布由 LLMs 驱动的进化编码智能体 AlphaEvolve,能演化代码库用于算法发现和优化。它结合 LLM 创造力与自动化评估,减少幻觉,在谷歌计算生态、数学算法等多领域有巨大应用潜力。

AINLPer
新闻资讯8

刚刚,DeepMind通用科学智能体AlphaEvolve突破数学极限,陶哲轩合作参与

DeepMind发布革命性进化编码智能体AlphaEvolve,由LLMs驱动,可演化代码库、发现和优化算法。它结合LLM创造力与自动化评估,减少幻觉,在多领域应用前景大,还与陶哲轩合作探索数学应用。

机器之心
推荐文章8

AI科研全周期拆解:从选题到宣发,哪里能放手,哪里得盯着

Awesome AI Auto-Research Team 综述梳理 AI 科研全周期能力与局限,按四阶段八环节拆解,介绍五种方法范式,指出各阶段应用情况、瓶颈及规律,强调人本治理的 AI 辅助科研才是可信路径。

AIGC开放社区
开源动态7

3.5k星星!用AI推演、预测未来,这个开源多体智能引擎做到了。

文章介绍开源多体智能引擎MiroFish,它是基于多智能体技术的AI预测引擎。用户提供种子文件、下达指令,它能构建数字沙盘,让AI智能体互动演化,可用于企业公关等场景,还给出推演流程。

开源AI项目落地
算法论文8

上海人工智能实验室让AI像科学家一样在探索中发明工具

上海人工智能实验室等团队提出推理时工具演化(TTE)框架,推动AI在科学领域从被动选工具到主动发明工具。它解决传统工具库问题,提升多学科推理准确率,赋予AI跨学科迁移能力。

AIGC开放社区