中科大」共找到 6825 篇相关文章

新闻资讯7

从Claude隐形水印回望GenAI时代信息隐藏:嵌入水印如何保证无损?

2026年Anthropic新版Claude模型嵌入隐形水印,引发对水印是否伤模型的质疑。可证安全隐写理论为解决此问题提供支撑,中科大等团队取得诸多成果,将“可证无损”从内容延伸到模型,还探讨了水印攻防。

新智元
新闻资讯8

马斯克抢先谷歌一步放招,Grok 4.1登顶LMArena,创意写作直逼GPT-5.1

当谷歌Gemini 3将上线消息传得沸沸扬扬时,马斯克xAI更快一步上线最新模型Grok 4.1,响应速率提升、幻觉率下降。它有两个“形态”,免费开放且有APP版。在LMArena测试成绩亮眼,多方面能力提升。

AI前线
新闻资讯7

老外傻眼!明用英文提问,DeepSeek依然坚持文思考

DeepSeek-V3.2和DeepSeek-V3.2-Speciale推理能力显著提升,海外研究者用英文提问,它却用文思考。评论有两种观点,相关论文显示文省token但非最有效,模型选思考语言并非只看效率。

机器之心
新闻资讯8

国产AI高考708分,这款模型靠什么成为「屏蔽生」?

高考放榜,媒体对国内外模型进行测试。综合成绩上,讯飞星火X2物理、历史类表现优异;单专项,它在数学、作文等测试也领先。其优势源于数据积累、理解评判标准,还采取软硬件一体化落地路径。

机器之心
算法论文8

Qwen团队发布长上下文Reasoning模型QwenLong-L1,超越o3-mini

Qwen团队发布长上下文Reasoning模型QwenLong - L1。当前模型处理长文本有训练效率低、过程不稳定难题。QwenLong - L1用分阶段强化学习等方法,实验超越o3 - mini、比肩Claude,还在案例表现出色。

深度学习自然语言处理
算法论文7

英伟达新研究:小模型才是智能体的未来

英伟达最新论文指出,模型在Agent任务消耗量计算资源,成本高、效率低、灵活性差,而小模型能在性能够用前提下让任务执行更经济灵活。小模型通过优化硬件资源和任务设计高效执行任务,但落地面临挑战。

量子位
算法论文8

Dense、MoE之外第三条Scaling路径:交提出JTok模块,省1/3算力

上海交通学与小红书Hi Lab联合团队提出JTok/JTok - M模块,作为插件挂载在Transformer层,几乎不增算力和显存开销却显著提升性能。该模块构建新scaling路径,在多任务测试全面提分,为模型发展提供新方向。

机器之心
推荐文章8

Efficiency Law, 物理精确世界模型,及世界模型引擎驱动的具身智能学习新范式

2025年秋具身智能赛道火热,特斯拉、英伟达动作不断,数据问题成落地症结。跨维智能贾奎、港(深圳)刘桂良探讨突破具身智能学习枷锁的方法,提出Efficiency Law和GS - World世界模型引擎及新学习范式。

机器之心
产品应用7

AI 应用开发的破局之路:字节跳动 Eino 框架实践

在 InfoQ 举办的 QCon 全球软件开发会上,字节跳动沈桐介绍 Eino 框架在组件抽象和业务编排的创新实践。该框架以模型为基础,解决应用开发节点、信息流转和沉淀框架的问题,还给出开发实例,展望了未来重点方向。

InfoQ
算法论文8

Claude团队用Qwen测试全新训练方法

Anthropic最新研究提出训练(MSM),在预训练后、后训练前给AI立规矩。实验显示,新增MSM能让通义千问两款32B模型失准率幅下降,还能精简微调数据。MSM与对齐微调结合,可提升模型泛化能力。

量子位