中科大」共找到 6802 篇相关文章

开源动态8

开源医疗模型SOTA:蚂蚁健康发布百亿参数医疗模型

由浙江省卫生健康信息心、蚂蚁健康等联合开发的AntAngelMed医疗模型正式开源。它凭借独创训练与架构,在权威评测表现优异,降低算力门槛,将专业知识、诊疗能力与计算架构融合,为医疗AI落地奠基。

AIGC开放社区
开源动态8

腾讯开源WMT2025冠军模型:拿下30个第一,同类最佳

昨晚腾讯开源WMT2025冠军翻译模型Hunyuan - MT - 7B,它在31种语言测试获30个第一,成同类最佳。文介绍其架构、训练过程,还通过多场景翻译案例展现优势,有望推动高质量翻译普及。

AIGC开放社区
算法论文8

推理路径的动态调控:让模型学会“恰到好处”的思考

当前模型推理路径存在冗余问题,本文提出测试时提示干预框架PI(π),通过《When/How/Which》三模块协同,将人类专家经验融入推理过程,在多个STEM基准测试缩减推理步骤、提升准确率。

深度学习自然语言处理
新闻资讯8

文信息学会模型与生成专委会2025模型战略研讨会成功举办

2025年6月27日,文信息学会模型与生成专委会2025模型战略研讨会在哈尔滨举办。会议探讨技术革命、交流成果、发布基金,多位专家作报告、参与思辨讨论,聚焦模型多方面话题。

深度学习自然语言处理
算法论文8

模型装上「思维分段引擎」:浙InftyThink解锁无限深度推理

如今模型长上下文推理面临计算成本高、推理易断问题。浙联合北团队提出InftyThink新范式,将传统推理拆成短片段并总结,突破推理长度限制,在多基座模型实验表现优异。

量子位
新闻资讯7

模型玩不好数独?!Transformer作者初创公司公布排行榜:o3 Mini High“变异数独”正确率仅2.9%

Transformer作者初创公司Sakana AI公布AI解决数独能力排行榜,用全新基准Sudoku - Bench考验模型创造性推理能力。结果显示模型总体正确率仅15%,9×9数独高性能模型o3 Mini High正确率2.9%。

量子位
新闻资讯8

对话智源王仲远:机器人的小脑可能会“合体”,但不是今天

今年智源会上,智源研究院推出“悟界”系列模型,如Emu3、Brainμ、RoboOS2.0、RoboBrain2.0和OpenComplex2。智源研究院长王仲远称模型技术未到尽头,介绍了模型特点及发展趋势,如机器人小脑融合需时间。

AI前线
开源动态8

小红书开源模型dots.llm1,初次出手,小有惊艳!国外网友们又炸了……

小红书hi lab团队公布首个开源模型dots.llm1,这是142B参数的MoE模型,仅14B激活参数就能与Qwen2.5 - 72B打平。它开源力度,训练效率高,数据处理精细,训练稳定,获国外网友高度关注。

AGI Hunt
算法论文8

Stanford、Meta和Google等发现LLM存在五天花板,再扩算力已无用

论文《On the Fundamental Limits of LLMs at Scale》指出,LLM性能提升有理论天花板,扩展会遇幻觉、上下文压缩等五根本限制,源于计算、信息与学习理论,未来应转向‘有限优化’。

深度学习自然语言处理
新闻资讯8

模型竞赛转向:决胜关键为何是“后训练”?|甲子光年

模型价值主战场向后训练转移,Grok 4凭后训练成“宇宙最强”。产业应用通用模型适配难,后训练方法也在进化,如采用SFT+RL等,还介绍了夸克和阿里云的后训练实践。

甲子光年