成本性能」共找到 6932 篇相关文章

产品应用8

WorkSwarm:引领办公智体新范式,让AI从一个助手,进化为一支与你并肩作战的团队

办公智热门赛道,openJiuwen推出WorkSwarm蜂群办公智体,将多智体协作引入个人办公场景。它有单Agent和集群两种模式,自主组队、共享果等,还支持多平台,openJiuwen社区也在招募开发者。

InfoQ
产品应用7

Claude Code 推出 Monitor 功,帮你随时盯梢

Claude Code 在 v2.1.98 版本推出 Monitor 功,可让 Agent 后台挂监控脚本,解决轮询痛点。它覆盖日志监控等多场景,与 /loop、/schedule 功有别,使用有注意事项,反映 Anthropic 让其工程系统的方向。

AGI Hunt
算法论文8

大模型解数学题是真懂还是 “死记硬背”?|首个反例驱动的数学推理基准揭穿 “刷题式假象”!

随着大语言模型在数学领域应用渐广,其是否真具备数学推理焦点。清华等团队提出反例推理评测基准COUNTERMATH,测试20+主流模型,结果不佳,而小样本微调显著提升模型力。

深度学习自然语言处理
产品应用8

美团悄悄上线的AI浏览器Tabbit,我觉得它更适合普通人。

美团光年之外团队发布AI浏览器Tabbit,作者认为它比Comet的Agent力更强,产品完整细节好还免费。与类OpenClaw产品是互补关系,处理场景式任务,还有很多实用功,值得一试。

数字生命卡兹克
新闻资讯7

CSDN 创始人蒋涛:“码盲”消失,新程序员崛起

CSDN 创始人蒋涛在大会演讲指出,从传统互联网到 AI 是底层变迁,要翻越美国‘三座大山’实现从 Global AI 到 Local AI。他预言‘码盲’将消失,新程序员崛起,AI 还重写硬件,中国机遇大。

AI科技大本营
算法论文8

Seedream 4.0大战Nano Banana、GPT-4o?EdiVal-Agent 终结图像编辑评测

在AIGC下一阶段,图像编辑检验多模态模型关键场景。研究者提出EdiVal - Agent评估框架,自动化生指令并多维度评估编辑结果,其评估与人类判断一致性高,还对比了13个模型的多轮编辑表现。

机器之心
开源动态8

突然,被GLM-4.7的Coding交付力惊到了

国内大模型圈因智谱启动A股上市而兴奋时,GLM系列再展“卷王”姿态,本月开源旗舰GLM - 4.7。它从代码大模型变为任务交付引擎,实测在多场景表现出色,理解复杂意图、交付高质量代码。

PaperAgent
8

AI引发K型分化:Gemini 3 加剧技术劳动力分化,判断力为王,基础岗位将被AI完全替代,程序员也不例外

2025年11月Google发布Gemini 3,依托多模态MoE架构和“Deep Think”模式,在软件工程等领域实现推理力质的飞跃。它使前端开发工作重心转移,重构软件工程工作流,赋白领但带来隐患,还冲击劳动力市场,提升软件掌握门槛。

AI Reading Hub
算法论文8

ICML 2026|告别「单线程」思维,智体进化出了原生的并行推理大脑

北京通用人工智研究院语言交互实验室提出原生并行推理器NPR,它有「自蒸馏 + 并行强化学习」三阶段训练范式,配套并行推理引擎,让并行推理模型原生认知力,还介绍了其具体实现、实验结论等。

机器之心
算法论文8

Snapchat提出Canvas-to-Image:一张画布集 ID、姿态与布局

Canvas-to-Image 是面向组合式图像创作的全新框架,将不同控制信息整合在同一画布,简化图像生控制流程。它解决了传统生流程中控制方式分散的问题,在推理阶段组合多种控制信号,实验效果良好。

机器之心