科学智能2.0」共找到 5591 篇相关文章

算法论文8

Meta超级智能实验室又发论文,模型混一混,性能直接SOTA

大语言模型训练依赖算力和时间,传统模型 Souping 多采用均匀平均。Meta 等研究者提出类专家 Soup(SoCE),利用基准测试类别构成选最优模型,非均匀加权平均,实验显示其提升了模型效果与稳健性,在排行榜获 SOTA 成绩。

机器之心
新闻资讯7

被H-1B签证折磨10年,前微软科学家用AI「掀桌」

美国签证体系成本高、周期长、透明度低,前微软科学家Priyanka Kulkarni创办Casium,用AI改造签证服务,把材料准备时间大幅缩短,近期获500万美元种子轮融资。新规下,其服务更显重要。

新智元
新闻资讯7

DeepSeek V3.1更新「最终版」!下一次是V4/R2了???

DeepSeek-V3.1更新至DeepSeek-V3.1-Terminus版本,修复了“极你太美”等bug,缓解中英文混杂等情况,优化了Code Agent与Search Agent表现。评测显示输出更稳定,但编程竞赛分数下降引质疑,版本名引发对后续版本猜测。

量子位
算法论文7

英伟达说,小语言模型(SLM)是智能体的未来

英伟达论文指出小语言模型(SLM)是代理人工智能未来。SLM参数小于100亿,可装在消费电子设备。英伟达认为其强大、适合代理系统且经济。微软、英伟达等多家厂商的小模型表现出色,文中还分析了SLM优势及代理架构。

AI与安全
新闻资讯8

OpenAI高管自爆:Scaling不死,GPT-5「双轴训练」撕开智能天花板

OpenAI首席运营官Brad Lightcap在对话中揭秘GPT-5,其能自主判断是否深度推理再作答,体验全面升级。训练方式有后训练,Scaling Law仍成立,未来从两轴改进。还探讨了AGI、应用场景等。

新智元
算法论文8

首次综述「边-云协同计算」,分布式智能与模型优化的最新进展

边缘 - 云协同计算整合边缘节点和云端资源,解决传统云计算问题。最新综述论文系统梳理其架构设计、模型优化等方面,提出统一框架,还指明未来研究方向,如大语言模型部署、6G整合等。

新智元
算法论文8

VLA统一架构新突破:自回归世界模型引领具身智能

北京智源研究院联合中科院自动化所提出 UniVLA 全新 VLA 模型架构,基于全离散、自回归机制建模多模态信号,后训练引入世界模型。它刷新多项基准纪录,在真机操控和自动驾驶有潜力,为多模态感知决策融合带来新思路。

机器之心
新闻资讯7

从辅助工具到智能决策,大模型如何改变人才选拔方式?

随着大模型应用拓展,企业人力资源管理成落地热点。阿里巴巴技术专家程鹏认为,大模型在人才选拔与培养中有效率、个性化、客观决策等颠覆性价值,也面临落地挑战,还分享应对策略等内容。

InfoQ
算法论文7

SRO架构赋予Qwen-2.5-VL推理能力,性能飙升16.8%

文本领域推理模型成就大,但扩展到多模态大语言模型遇阻力,如冷启动初始化不足等。为此提出 SRO 三阶段训练框架,经测试,ReVisual - R1 平均性能提升 16.8 个百分点。

CourseAI
开源动态8

微软开源浏览器Agent,可实时跟踪、控制智能体,超4000颗星

微软在官网开源用于浏览器网络任务的Agent——Magentic - UI,基于Magentic - One开发,支持人机协同。GAIA测试显示其能提升任务完成率和准确率。它以人为本,有独特机制,框架含多阶段,在Github超4000颗星,支持MIT许可证商用。

AIGC开放社区