混杂变量重构」共找到 1046 篇相关文章

产品应用8

Claude Opus 4.1 上线,SWE-bench 验证率 74.5%,构可靠性与安全性全面升级

Anthropic推出Claude Opus 4.1,是Opus 4要升级版。SWE - bench验证率从72.5%提至74.5%,多文件代码构可靠性及长链交互推理能力增强,无害响应率提升,合作率下降,定价不变。

InfoQ
新闻资讯8

从美国能源部“创世纪计划”看 AI for Science:走向更完整的科学闭环与科研组织方式

近日,美国能源部公布“创世纪计划”首批入选资助谈判项目名单,反映AI for Science深刻演变,从理论探索走向实际应用,科研组织方式也在构。本文从多维度拆解名单背后的战略布局与演进趋势。

力学与人工智能
产品应用8

扔掉人工公式:快手EMER框架,用“会比较、自进化”的模型构短视频推荐排序

过去十年,推荐排序多依赖人工设计公式,但此模式遇瓶颈。快手策略算法团队提出 EMER 框架,用“会比较、能进化的 AI 模型”构短视频推荐排序,在快手主 App 和极速版效果显著,还为行业提供解决方案。

机器之心
产品应用7

Seedance 2.5 专业创作实测:3D导演台、局部改、角色库如何释放模型能力

Seedance 2.5升级,3D导演台自带图片生成白模功能、打通3D工作流;有片段拍实用功能;小云雀升级角色资产能力。除素材增加,其更理解原视频创意逻辑,还有多模态参考等功能,降低创作门槛。

AI进修生
新闻资讯7

Agent 构互联网,谁将受益于线上内容的“帕累托效应”?|AGIX PM Notes

文章围绕AI时代展开。在搜索领域,谷歌垄断案法庭主张其向竞争者开放搜索索引数据,这能助对手构建强大索引、补短板。商品服务层面也有80 - 20构。还提及本周市场动态、AI企业相关消息,如谷歌案裁决、OpenAI成本预期等。

海外独角兽
产品应用7

1周半写64个PR、完成30%项目构:一家成熟SaaS公司把Agent塞进研发全流程后

Calendly作为成熟SaaS公司,分享Agentic Engineering实践,让Agent嵌入研发全流程。如一周半生成64个PR,完成30%项目构。还探讨了瓶颈转移、对工程师的影响等,强调判断力和规则的要性。

AI前线
开源动态8

LangChain 彻底写:从开源副业到独角兽,一次“核心迁移”干到 12.5 亿估值

本周,LangChain 宣布完成 1.25 亿美元融资,投后估值 12.5 亿美元,还发布里程碑式更新,LangChain 1.0 正式登场,这是一次从零开始的写。它最初是副业,后成热门开源项目,此次写解决了过往问题。

InfoQ
开源动态8

LangChain 彻底写:从开源副业到独角兽,一次“核心迁移”干到 12.5 亿估值

本周,LangChain 宣布完成 1.25 亿美元融资,投后估值 12.5 亿美元,还发布了里程碑式更新 LangChain 1.0,这是一次从零开始的写。LangChain 最初是副业,发展成热门开源项目,此次写解决了此前问题,有诸多升级。

AI前线
算法论文8

Nature丨告别「炼丹」!AI+机器人闭环搞光伏:效率27.18%,可复性直接拉高5倍

香港城市大学朱宗龙、曾晓成团队首创AI驱动的自动化闭环研发平台,从分子筛选到制备、反馈调整全程自动化。刷出27.18%稳态认证效率,可复性提升5倍,是AI for Science +机器人制造在光伏领域的大突破。

量子位
产品应用7

高考数学全卷赛!一道题难倒所有大模型,新选手Gemini夺冠,豆包DeepSeek并列第二

因网友质疑上次测评不严谨,此次用六款大模型挑战含解答题的全套高考数学题。结果Gemini 2.5 Pro夺冠,Doubao和DeepSeek R1并列第二。解答题是失分灾区,图像题难倒多模态大模型。

机器之心