可验证性」共找到 4878 篇相关文章

开源动态8

CVPR 2026 | 1B模型也能当多镜头导演?大连理工&快手灵开源力作MultiShotMaster

大连理工与快手灵团队推出MultiShotMaster框架,能在1B左右小参数量级模型实现导演级镜头调度和连贯叙事,支持多图参考、主体运动控制。论文录用至CVPR 2026,代码已开源,还获AAAI CVM Workshop竞赛冠军。

机器之心
开源动态8

百川开源医疗增强大模型 Baichuan-M2:更符合中国临床诊疗场景, 4090 单卡部署

百川智能发布并开源医疗增强大模型 Baichuan-M2,以更小尺寸反超 OpenAI 新模型。它 4090 单卡部署,成本低,在 HealthBench 评测表现佳,免费开源,更适配中国临床诊疗场景。

InfoQ
推荐文章7

数据分析师如何快速建立在 AI 时代最值钱的能力:一份落地的行动路线图

文章借Snowflake分享,探讨数据从业者在AI时代的核心能力。介绍AI从工具到执行者的进化,指出数据叙事成稀缺技能,还给出普通职场人90天AI逆袭路线图,强调人类在决策判断上的不替代

InfoQ
推荐文章7

AI Coding 的下一步不是写得更快,而是验收:蚂蚁数科 Harness 工程实践

蚂蚁数字科技资深技术专家魏长征在AICon大会分享AI Coding实践。指出当前产能提升快,但验证能力能跟不上,容易引发质量风险。介绍了Harness工程思路及在新项目和存量项目中的应用,还提及AI协作的未来挑战。

InfoQ
新闻资讯7

CVPR 2026新规:强制披露算力成本,高效率、高透明度论文获三项认

CVPR2026出台‘计算资源报告表(CRF)’试点计划,要求论文作者报告研究中使用的计算资源,提交报告不影响论文接收决策,展示出色计算效率和透明度的论文获认奖项。

机器之心
算法论文8

GRPO训练不再「自嗨」!快手灵 x 中山大学推出「GRPO卫兵」,显著缓解视觉生成过优化

GRPO在视觉生成流模型后训练阶段有显著提升,但clip机制存在系统偏差,易使模型陷入过度优化。中山大学、快手灵等团队提出GRPO - Guard,能降低过度优化风险,在多种任务中表现良好。

机器之心
产品应用7

Qwen深度研究一夜升级!生成网页和音频播客,新模型能认医生手写体

Qwen版深度研究加速进化,增加听觉和视觉输出,生成网页和音频。改进功能同时更新模型,Qwen3 VL能识别医生手写体。实测新功能表现出色,Qwen3-VL系列更新后能优异。

量子位
开源动态8

清华开源了一个真的会和你互动的AI课堂,同学老师都是AI,500学生已经验证....

清华大学开源OpenMAIC,这是多智能体驱动的交互式AI课堂。它模拟真实课堂,有多种场景,内置自适应引擎。经500学生验证,数据佳。支持多模型,部署方式多,还集成OpenClaw。

AI寒武纪
开源动态7

从表复杂文档中提取结构化数据的Python库agentic-doc,支持100+页PDF长文档

LandingAI的Agentic文档提取API从复杂文档提取结构化数据,Python库agentic-doc封装该API,支持100+页PDF长文档,有自动重试、并行处理等功能,还能视化调试。

GitHubStore
开源动态8

基础模型又一关键拼图,腾讯混元发布训练新范式「无相」:引入功能记忆,打破静态权重枷锁

腾讯混元团队发布HY - WU范式,打破静态权重束缚,引入功能记忆,实时生成个化参数。应用于图形编辑基模效果好,在图像编辑任务表现优秀,还对未来AI架构提出多方面展望。

量子位