可验证性」共找到 4867 篇相关文章

8

估值200亿美元!灵AI被曝剥离快手单独融资

The Information爆料,快手计划分拆旗下视频生成模型灵AI,目标估值200亿美元并计划明年IPO。灵已开始盈利,在海外表现出色。快手拆分是因估值重构、资源压力和人才等三层压力。

量子位
开源动态8

微软开源Skill训练框架,让Agent白天干活,晚上自动复盘,Skill的自进化终于监控了

微软开源SkillOpt v0.2.0,加入SkillOpt - Sleep让Agent自我复盘。该文本空间优化框架能自动训练和优化skill,有透明化、质量控制等特点,适合重复、评估任务场景。

开源AI项目落地
新闻资讯8

三大头部互联网企业交锋,AI时代观测边界出现了吗?

InfoQ《极客有约》X AICon 直播栏目邀阿里云张城等探讨AI时代观测新边界。嘉宾们认为AI与观测技术双向赋能,传统算法与大模型互补,未来有望实现半自治运维,还分享了数据治理等经验。

InfoQ
算法论文8

拒绝「降智、减配、乱收费」:面向LLM API的验证框架

大语言模型成AI应用基础设施,黑盒服务模式引发信任危机。研究者提出IMMACULATE审计框架,能在不暴露模型信息、仅1%额外开销下,验证黑盒LLM API执行完整,检测违规行为,相关论文与代码已公开。

机器之心
推荐文章7

MCP for 观测2.0,6个让MCP开发更高效的小妙招

文章介绍MCP这一开放协议,它能标准化AI模型与不同数据源和工具连接。分享配置MCP开发所需客户端、API等步骤,阐述阿里云观测2.0融合MCP的实践及效果,还给出设计MCP Server的6个经验,最后展望了MCP应用场景和观测2.0+AI未来。

阿里云开发者
产品应用8

从「对口型」到「会表演」,刚进化的灵AI数字人,技术公开了

快手灵团队让数字人从「对口型」进化到「会表演」,全新数字人功能在灵平台公测。技术报告Kling - Avatar解析背后技术路径,设计多模态两阶段生成框架,实验显示其在多方面领先竞品。

机器之心
算法论文8

上海AI Lab、浙大EagleLab等提出RRVF:利用「验证非对称」,只输入图片学习视觉推理

上海AI Lab、浙大EagleLab等联合完成研究,提出RRVF框架,利用「验证非对称」,仅输入图片学习视觉推理。它构建闭环系统,通过迭代推理、视觉反馈等步骤训练模型,实验显示效果佳,证明验证法则力量。

机器之心
算法论文8

扩展外部测试时Scaling Law,中关村学院新发现:轻量级验证解锁LLM推理最优选择

文章聚焦大语言模型‘测试时扩展’,指出内部方法接近瓶颈,外部方法的传统实现有缺陷。提出 TrajSelector 策略,用轻量级打分模型复用隐状态打分,训练无需手动标注,实验显示能增长稳定。

机器之心
新闻资讯7

今起Codex每天重置一次!Tibo义父:首次3小时后发放,重置时间自选

今起付费却无法用GPT - 6 Astra的用户,每天能重置额度一次,首个额度不到3小时发放,自选重置时间。还提到GPT - 6做长程任务超272K tokens部分不增额度消耗倍率,开放时间待定。此外介绍在其开放前做的3件事。

量子位
新闻资讯7

宇树机器人被曝漏洞,机器人之间相互感染,官方火速回应

宇树旗下多款机器人被曝存在严重无线安全漏洞,攻击者借此实现最高权限控制,被攻陷的机器人还会自动扩散感染。发现者此前与宇树多次沟通无果后公开漏洞利用工具链,宇树回应已着手修复。

量子位