可观测2.0」共找到 5953 篇相关文章

开源动态8

3A大作!阿里ROLL团队从基建->算法->机理,推动RL4LLM全栈协同优化

阿里巴巴ROLL团队联合高校推出「3A」协同优化框架,推动「强化学习用于大语言模型(RL4LLM)」迈向新范式。Async架构提升GPU利用率,AsyPPO降低计算资源消耗,Attention机制提升训练效率与解释性。

机器之心
算法论文8

当 AI 下场炒 A 股,「推理」成了新的直觉

海外“AI Trading Battle”实验中,不同大模型交易表现差异大。港科大等团队提出RETuning方法,基于A股数据集验证,显著提升大模型金融预测准确率、推理解释性,是综合改进方案,但有算力等局限。

AI科技评论
推荐文章8

AIGC全生命周期业务风控白皮书,从备案到运营的合规与安全实践

2025年9月15日《人工智能安全治理框架》2.0版发布,为AI风险防控指明方向。数美科技发布《AIGC全生命周期业务风控白皮书》,构建全生命周期业务风控体系,涵盖合规备案、安全评测、账号与内容风控等多方面。

AI前线
产品应用7

藏师傅教你用 Nano Banana 编辑图片做手办

前几天发 Nano Banana 测评后,很多人不知怎么用。刚好做手办图玩法火了,作者教大家在 LM Arena 用 Nano Banana 编辑图片、做手办图,还介绍把图片变视频及剪辑的方法。

歸藏的AI工具箱
新闻资讯7

闹玩呢!首届大模型对抗赛,DeepSeek、Kimi第一轮被淘汰了

谷歌发起首届大模型国际象棋对抗赛,为期三天。参赛模型众多,首轮中 Gemini 2.5 Pro、o4 - mini、Grok 4 和 o3 以 4 - 0 战绩晋级半决赛,DeepSeek、Kimi 首轮被淘汰,目前 Grok 4 是夺冠热门。

机器之心
开源动态8

拆箱开源版Coze:Agent核心三件套大公开,48小时揽下9K Star

扣子两款子产品扣子开发平台和扣子罗盘近期开源,加上此前开源的开发框架Eino,覆盖了Agent开发全链路。其采用宽松的Apache 2.0开源协议,降低开发门槛,有望带动Agent在更多场景落地。

量子位
算法论文8

因果发现大模型迎来「理论破局」: DAG-FM 破解异质机制下的因果图识别与涌现难题 | GAIR Paper 116

浙大、清华与稳准智能联合发布因果发现大模型DAG - FM,解决了现有模型缺乏理论基础、易产生非法环路和显存爆炸问题。它在理论上证明因果图识别,架构上避免环路,处理数据能力强,还将推进特定领域预训练。

AI科技评论
开源动态8

单Agent时代正式结束:一个干不过,就上300个

月之暗面发布并开源 Kimi K2.6 模型,热度高。它强化 Agent 团队协作能力,核心能力进步,领先对手。在编程领域发力,长程编码能力突破,集群协同输出强,还适配框架,实测效果出色,Claw 群组开启内测。

机器之心
新闻资讯7

CES 2026现场观察:AI正在“消失”|甲子光年

本文为CES 2026现场观察,指出AI正从工具变为前提条件,“默认式AI”到来。还介绍多款新奇产品,如Glyde理发器、MOVA飞行扫地机器人等,也提及AI硬件变萌、穿戴设备爆发及中国机器人受关注等趋势。

甲子光年
算法论文8

Meta「透视」AI思维链:CRV推理诊断,准确率达 92%!

Meta FAIR团队在论文中提出CRV方法,实时观察AI思维过程。它通过改造模型大脑结构,让推理见。在算术推理实验中,检测精度提升到92.47%,还能让模型修正错误。不过该技术落地尚面临诸多挑战。

新智元