计算机智能体」共找到 5526 篇相关文章

新闻资讯8

Claude 4 核心成员访谈:提升 Agent 独立工作力,强化模型长程任务力是关键

Anthropic 两位研究员在采访中表示 2025 年强化学习在大语言模型训练奏效,如 Opus 4 处理长周期任务。还探讨模型发展方向,如用户与多模型交互、模型可解释性等,认为未来会有白领 AI 员工。

Founder Park
推荐文章7

分享一个我用了2年的深度研究Prompt,半小时帮你搞懂任何陌生领域。

作者分享用了2年的深度研究Prompt,即横纵分析法。该方法结合社会科学和语言学经典视角与商业分析思路,有Prompt和Skill版本且已开源。虽有局限,但半小时帮人建立认知框架,助其快速入门陌生领域。

数字生命卡兹克
产品应用8

手机跑推理模型:Liquid AI发布仅需900MB内存的LFM2.5-1.2B-Thinking

Liquid AI发布LFM2.5 - 1.2B - Thinking推理模型,仅需900MB内存就在手机运行。它专为简洁推理训练,性提升明显,多数性基准超Qwen3 - 1.7B,在多平台表现佳,还支持主流推理框架。

AI工程化
开源动态8

开源框架让代码AI偷师GitHub!bug修复率飙升至69.8%,性创纪录

MemGovern团队联合多高校团队提出MemGovern框架,将杂乱GitHub数据转化为AI可用的结构化记忆。它构建筛选净化流水线,采用先搜后看模式,实验显示显著提升代码智体的bug修复率,还具跨领域推广价值。

量子位
算法论文8

Agent可以自己进化了?!

论文《Automated Design of Agentic Systems》提出让Agent扮演设计师,“元代理”自动生成新代理设计方案。用编程语言作设计空间,实现“设计自由”。实战中,AI设计的Agent全领域超越人类,还具备知识迁移力,未来或有自主进化的AI生态。

深度学习自然语言处理
产品应用8

TRAE Work 上线 Design 模式:产品经理还需要 Figma 吗?

TRAE Work 上线 Design 模式,可将一句话描述变成可编辑设计稿,还将设计稿转代码,在同一平台完成从需求到代码的链路。作者测试后发现其效率大幅提升,并分析了该模式与其他工具的区别及 AI 设计趋势。

特工宇宙
新闻资讯8

扒光谷歌Gemini 2.5:一份官方“翻车报告”,揭露AI Agent的8个秘密。

谷歌DeepMind发布Gemini 2.5技术报告,以玩《宝可梦 红/蓝》为例,展示构建有效智体的案例。该系统架构由多部分组成,但运行状况百出,如上下文过长变差、产生幻觉等,也有亮点,还提炼避坑方法。

探索AGI
产品应用8

实测 Seed 2.1:豆包基模超进化,国产模型力跨过质变点

作者在做面向 Agent 项目时,因 Claude Code 内存开销大,需更轻方案。火山引擎 Force 大会发布 Seed - 2.1,作者实测其在办公、编程、图像理解等方面表现出色,认为它跨越质变点,将赋国内 AI 生态圈。

特工宇宙
产品应用7

最强协作模型?MiniMax M2.7 实测:AI开始更会合作了 | Claude Teams

MiniMax M2.7模型发布,强调模型自我进化、Agent Harness和Agent Teams。它构建复杂Agent Harness,完成高难度生产力任务。其力达国际一线水平,在多测试中成绩优异。还介绍了Harness、Agent Teams等概念及应用场景。

AI进修生
产品应用8

录屏扒代码、截图改网页!Kimi K2.5把「视觉x代码」玩明白了

Moonshot AI推出最强Agentic模型Kimi K2.5,发布后热度起飞。它实现多功一体化整合,具备设计审美,支持可视化编辑,推出编程工具Kimi Code。在多项测试中表现优异,还在办公领域发挥作用,其智体集群提升了效率。

量子位