「大模型自信问题」共找到 9547 篇相关文章
SMO | 西工大宁晨伽、张伟伟等:基于共享并行神经网络架构的多精度气动融合方法
高可靠性气动数据降本增效是关键命题。本研究总结主流多精度建模方法,提出基于共享并行架构的融合策略,区分公共与私有特征,提升融合框架表征能力,还通过算例验证方法有效性。
字节跳动2步突破,复杂文档布局解析,为啥如此惊艳?
文章指出现有文档图像解析方案有局限,介绍字节跳动的Dolphin解决方案。它采用分析 - 解析范式分两阶段解析文档,避免传统方法弊端,运行效率高,还给出训练方案、实战代码和试用链接。
李静海院士团队:未来数据系统的逻辑与架构 | Engineering
本文展望数据科学未来,强调其对AI重要性。探讨科学数据系统挑战,提出收集处理原则,指出要重视数据系统逻辑与架构研究,建立标准协议框架,促进AI健康发展。
Redis之父宣布“Redis再次开源”!网友:骗我一次,算你狠;骗我两次,是我蠢
Redis公司将Redis重新拉回开源阵营,自Redis 8开始增加AGPLv3许可选项。此举源于之前许可引发社区不满,此次重新开源虽受关注,但部分开发者仍存疑虑,同时还介绍了相关许可证区别及社区对此事的讨论。
轮到谷歌踩油门了!Gemini 4泄漏、TPU上天、工程师因「太快」辞职
本文报道谷歌近期AI业务最新动态,涵盖Gemini 4大模型研发进展、TPU上太空测试计划,以及工程师因AI发展太快辞职事件,展现谷歌AI全面加速的现状。
Redis之父质疑Jev狂热!绝大多数开发者其实不需要它
本文报道Redis之父Salvatore Sanfilippo公开质疑AI新模型Jev的过度炒作,梳理了Jev的产品定位与能力边界,整理社区多方观点,探讨开发者是否真的需要Jev。
EMNLP 2026 | 通过分解生成与动态自反馈,构建工具调用合成数据
本文是被EMNLP 2026主会录用的算法论文,针对现有工具调用合成数据「先生成再筛选」的缺陷,提出分阶段分解加动态自反馈的ToolLoop方法,有效提升合成数据质量,实验效果优于现有方案。
NVIDIA 李柏依:机器人只会「看」还不够,它还得学会「听」| ECCV 2026
本文整理了NVIDIA Research科学家李柏依在ECCV 2026 Workshop的分享,针对机器人训练数据采集壁垒高的问题,介绍了两项解决多模态感知与灵巧操作数据难题的前沿研究。
MCP 已死?不,它正在进化:三个关键变化
本文针对网传“MCP已死”的说法,解读最新版MCP模型上下文协议的三大核心变化,对比MCP Tasks与A2A的区别,给出选型建议,帮助开发者适配企业级Agent场景需求。
光模块还能打吗?
本文围绕英伟达首款CPO交换机量产引发A股光模块板块震荡展开,分析CPO对光模块行业的短期影响与长期格局变化,梳理国内产业链的优劣势,给出清晰的产业趋势判断。