「模型支持」共找到 8499 篇相关文章
一句话生图要过时了?开源图像生成Agent进化出「工具编排」
来自多机构的研究团队提出GenEvolve,将开放图像生成建模为「工具编排轨迹」。它配置三类工具,经多轮决策完成生成。通过构建数据集训练,实验显示在多基准上表现出色,已开源模型、代码等。
Anthropic深夜连放两弹:Sonnet 5、全新AI科研App重磅上线
Anthropic 深夜发布两个重磅更新:Claude Sonnet 5和面向科研人员的AI工作台Claude Science。Sonnet 5性能接近Opus 4.8,提升Agent能力且价格低;Claude Science整合科研工具,支持复现产出、自动管理算力、多学科查询。
为什么你的 AI Coding 账单越涨越快?十个节约 Token 的工程办法。
文章指出今年大模型Token账单涨得快,尤其AI编程重度用户。从工程角度总结降低Token消耗的方法,如上下文清场、代码导航等,还分析AI Coding的Token变贵原因及各方法适用边界。
Netflix 如何实时绘制数千个微服务的拓扑图
Netflix分享Service Topology系统细节,它为数千微服务创建实时依赖关系图,合并三类数据源,近实时更新。开发动机源于工程支持请求常见问题,现有工具无统一视图。未来将加入部署和配置变更事件。
感知、控制与数据:ICRA 2026 中国企业报告的三个交汇点
ICRA 2026期间,速腾聚创等六家中国企业分享机器人领域进展。他们关注感知底层基础、接触‘最后一毫米’问题、数据与模型关系,且技术路径和产品侧重有差异,具身智能注重工程落地和系统能力建设。
蚂蚁EGSS算法破解Test Time Scaling困局 | ACL 2026
蚂蚁集团CodeFuse团队在ACL 2026主会论文中提出EGSS算法,破解Test Time Scaling困局。该算法精准识别高不确定性决策点,解决计算冗余与选择脆弱问题,在SWE - Bench - Verified上全模型提升5 - 10%。
见微知著:LLM 奖励建模的「Analytic Rubric」范式全面综述
该文是对LLM奖励建模的「Analytic Rubric」范式的全面综述。介绍了Rubric概念来源,指出传统奖励模型存在对齐风险,而Rubric RM在多方面取得平衡,还阐述其工作流、各维度研究情况及面临的挑战。
Claude不到4%,全军覆没!一场大考撕碎Agent「全自动办公」幻想
新智元报道,UniPat AI的SaaS - Bench实战考卷,用23个真系统、106个任务测试Agent。结果显示,Claude Opus 4.7完全通过分数仅3.8%,多数模型全军覆没,暴露了Agent在真实环境中的四种致命缺陷。
GitHub 推出 MCP 服务器集成,全面扩展机密扫描功能
GitHub宣布MCP Server全面支持机密扫描功能,将其扩展至AI辅助和代理驱动的开发工作流,可让外部工具和AI工作流访问安全洞察、自动化修复。这反映安全工具正从被动检测转向自动化治理。
当 Agent 开始接管工作流,企业最在意的三件事:安全运行、稳定交付、持续进化
Agentic AI 开发落地使基础设施问题凸显。AI 产业转向重视模型部署等,CPU 受关注,云计算角色转变,容器重要性凸显。Agent 应用规模化落地,AI 负载变化,Agent Infra 要解决四个问题,云和 CPU 任务也在改变。