可扩展监督」共找到 4363 篇相关文章

8

估值200亿美元!灵AI被曝剥离快手单独融资

The Information爆料,快手计划分拆旗下视频生成模型灵AI,目标估值200亿美元并计划明年IPO。灵已开始盈利,在海外表现出色。快手拆分是因估值重构、资源压力和人才等三层压力。

量子位
开源动态8

微软开源Skill训练框架,让Agent白天干活,晚上自动复盘,Skill的自进化终于监控了

微软开源SkillOpt v0.2.0,加入SkillOpt - Sleep让Agent自我复盘。该文本空间优化框架能自动训练和优化skill,有透明化、质量控制等特点,适合重复、评估任务场景。

开源AI项目落地
算法论文8

条条电路通罗马:大模型解释性的「唯一机制」能从一开始就不存在

长期以来,机制解释性领域默认模型对同一任务的能力对应唯一内部「电路」。但被ICML 2026接收的新论文指出,「唯一电路」能不存在,同一任务由多个结构不同但能力相当的电路完成。

机器之心
新闻资讯8

三大头部互联网企业交锋,AI时代观测边界出现了吗?

InfoQ《极客有约》X AICon 直播栏目邀阿里云张城等探讨AI时代观测新边界。嘉宾们认为AI与观测技术双向赋能,传统算法与大模型互补,未来有望实现半自治运维,还分享了数据治理等经验。

InfoQ
推荐文章7

MCP for 观测2.0,6个让MCP开发更高效的小妙招

文章介绍MCP这一开放协议,它能标准化AI模型与不同数据源和工具连接。分享配置MCP开发所需客户端、API等步骤,阐述阿里云观测2.0融合MCP的实践及效果,还给出设计MCP Server的6个经验,最后展望了MCP应用场景和观测2.0+AI未来。

阿里云开发者
产品应用8

从「对口型」到「会表演」,刚进化的灵AI数字人,技术公开了

快手灵团队让数字人从「对口型」进化到「会表演」,全新数字人功能在灵平台公测。技术报告Kling - Avatar解析背后技术路径,设计多模态两阶段生成框架,实验显示其在多方面领先竞品。

机器之心
算法论文8

扩展外部测试时Scaling Law,中关村学院新发现:轻量级验证器解锁LLM推理最优选择

文章聚焦大语言模型‘测试时扩展’,指出内部方法接近瓶颈,外部方法的传统实现有缺陷。提出 TrajSelector 策略,用轻量级打分模型复用隐状态打分,训练无需手动标注,实验显示性能增长稳定。

机器之心
开源动态7

谷歌开源的 Gemini CLI 扩展助力开发者构建定制化人工智能工作流

谷歌发布开源的 Gemini CLI 扩展框架,引入‘剧本’概念,让 AI 与外部工具交互。框架增强了 Gemini CLI 功能,支持多组件。谷歌构建开放生态,还为开发者提供模板和指南,其在 AI 驱动 CLI 领域有独特优势。

InfoQ
新闻资讯7

AI 时代的新观测性:不只看系统崩没崩,还要看模型有没有胡说

New Relic首席技术战略官Nic Benders与主持人探讨观测性从传统到AI驱动的演进,提及LLM与统计方法协同处理海量数据,还讨论了监控AI系统的难题及观测性核心是理解业务目标。

InfoQ
算法论文8

监督学习也能从错误中学习反思?!清华英伟达联合提出隐式负向策略爆炸提升数学能力

清华大学与英伟达、斯坦福联合提出监督学习方案NFT,在RFT算法基础上构造“隐式负向模型”利用负向数据训练。该策略弥合监督与强化学习差距,其损失函数梯度和GRPO在On - Policy条件下等价。

量子位