同质化评估」共找到 1447 篇相关文章

开源动态8

文档秒变演讲视频还带配音!开源Agent商业报告/学术论文接近人类水平

澳大利亚和英国多所高校团队提出多模态智能体PresentAgent,能将文档转为配有语音讲解和同步幻灯片的视频演示。其模块生成框架有可控性和领域适应性,评估显示它在各指标上接近人类水平。

量子位
产品应用8

推出4个月就狂赚3亿?!百万用户应用CTO弃Copilot转Claude Code:200美元拯救我的137个应用

Anthropic 公司推出的 AI 编码助手 Claude Code 推出 4 个月吸引 11.5 万开发者,单周处理 1.95 亿行代码,年收入预估达 1.3 亿美元。开发者认为它优势明显,Soham 级别的生产力,还分享使用技巧。

AI前线
新闻资讯8

学习教父重出江湖, 生成式AI的时代要结束了?

新智元报道,强学习之父Richard Sutton称GenAI时代正结束。他加入ExperienceFlow.AI,要让AI靠「经验」觉醒。该公司定位打造「经验驱动的去中心超级智能」,认为AI下一阶段应从世界中学习。

新智元
开源动态8

具身智能迎来ImageNet时刻:RoboChallenge开放首个大规模真机基准测试集

近日,RoboChallenge推出全球首个大规模、多任务真机基准测试。它构建开放、公正、可复现的‘真实考场’,为视觉 - 语言 - 动作模型提供评估标准,推动具身智能发展,还提供远程测试服务等。

机器之心
推荐文章7

三个方法让Cursor构建网站更加精美:Browser MCP 克隆 + 提示技巧 + 组件修改!(Bolt、Lovable)

文章介绍用Browser MCP克隆网站结构、结构Prompt模板及UI组件修改三种方法,让Cursor构建网站更精美,还分享Lovable设计技巧、让AI网站变好看的方法及早期公司获客策略。

AI进修生
新闻资讯7

Anthropic 兄妹 Dario Amodei 和 Daniela Amodei 最新对话:Claude 为什么一直限速?

在 5 月 6 日 Anthropic 开发者大会上,兄妹 Dario Amodei 和 Daniela Amodei 对话,谈到 Claude 限速因 2026 年 Q1 增速年 80 倍远超规划,还涉及开发者生态、模型训练、能力释放等话题,强调平衡发展与安全。

宝玉AI
算法论文7

谷歌研究院探索多智能体协调的扩展原则

谷歌研究院对180种智能体配置对照评估,得出‘AI智能体系统首批定量扩展原则’。发现多智能体协同效果因任务而异,还指出工具使用瓶颈等问题,且开发预测模型辅助架构选择。

InfoQ
推荐文章8

吴恩达来信:智能体并行运行以提升效率

吴恩达称并行智能体成扩展AI规模新方向。AI性能会随数据量、训练及推理计算量提升,但耗时久。随着LLM每个token价格下降,更多智能体工作流被并行,且相关研究增多。

DeeplearningAI
产品应用7

狂肝一周,测评十余款 PPT AI 生成产品的真实反馈

评估 Agent 产品能力复杂,以 PPT 生成为例,有 Agent 和模板两种流派。作者选前者投票测评、后者全方位测试。给出方案,还推荐不同需求适用产品,附总榜单和细致体验描述。

特工宇宙
推荐文章8

当 Kanban 不再管理人:Routa Kanban 如何管理 Agent Team

本文探讨了 Routa Kanban 如何管理 Agent Team,指出在 AI4SE 时代,多 Agent 协作进入日常软件交付需建设管理界面与工程护栏。Routa Kanban 把多 Agent 协作推进到‘管理驱动’,其价值在于将隐性约束显性

phodal