网络信息获取」共找到 1038 篇相关文章

新闻资讯7

4000亿国产算力航母:芯片巨头合并超算巨头

上交所披露海光信息拟换股吸收合并中科曙光并募资,两家公司A股自5月26日开市起停牌,预计不超10个交易日。海光聚焦芯片研发,中科曙光深耕服务器领域,重组方案待明确,实施有不确定性。

量子位
算法论文8

EMNLP2025 | 解耦视觉与推理,港大探索视觉语言模型"眼智分离"新范式

当前大视觉语言模型处理复杂推理任务时,常过分依赖语言知识,忽视图像关键信息。港大等团队提出ProReason框架,其蒸馏的ProReason - VL和ProReason - Q3模型性能提升显著,为LVLMs发展提供方向。

深度学习自然语言处理
开源动态8

告别Transformer!北大、北邮、华为开源纯卷积DiC:3x3卷积实现SOTA性能,比DiT快5倍!

北大、北邮和华为研究提出纯卷积扩散模型 DiC,抛弃自注意力机制回归 3x3 卷积。它性能超 DiT,推理速度快 5 倍,证明精心设计的卷积网络在生成任务中也能表现卓越。

机器之心
新闻资讯7

一次代码提交=250万美元!xAI被开除工程师大爆料,揭秘马斯克“人类模拟器”秘密项目

xAI技术成员Sulaiman Ghori在播客披露公司内幕被开除。他透露了“人类模拟器”项目、算力工厂建造细节、内部工作文化等敏感信息,还描绘了充满马斯克风格的xAI工作画像。

AI寒武纪
开源动态8

宇树科技开源UnifoLM-WMA-0机器人模型,离通用机器人又进一步

宇树科技开源UnifoLM-WMA-0模型,用神经物理网络让机器人理解力学规律。它支持两种模式,融合多模态信息,架构精妙。经测试性能强,已真机部署。开源降低门槛,有望推动行业发展。

AIGC开放社区
推荐文章7

OCR-Reasoning:揭秘多模态大模型在复杂图文推理中的真实能力

主流OCR评测基准聚焦信息抽取,复杂图文推理任务中多模态大模型深度推理能力缺乏评估标准。OCR - Reasoning可系统性评估,还列举多种推理示例,并测评了Qwen2.5 - VL - 7B模型。

CourseAI
推荐文章7

Anthropic实践发现:Multi-Agent系统的核心仍然是Prompt设计!

近期Anthropic分享构建多智能体研究系统最佳实践,提出8条研究智能体的提示工程与评估原则。其架构采用协调者 - 工作者模式,与传统RAG方法不同,使用多步骤搜索动态查找信息

PaperAgent
算法论文8

ACL 2025|为什么你设计的 Prompt 会成功?新理论揭示大模型 Prompt 设计的奥秘与效能

英属哥伦比亚大学等团队剖析Prompt在LLM的CoT推理中调控模型内部信息流,构建量化Prompt搜索空间复杂度理论框架。研究解释提示有效的原因,提供设计高效提示词思路,实验验证理论框架。

机器之心
算法论文7

人多不管用!智能体团队别盲目扩张,最新综述给出三大维度

随着大语言模型驱动的多智能体系统快速发展,核心问题是有些系统规模扩大后会失稳、低效。美国、英国和澳大利亚研究人员提出三维分类框架描述大规模智能体网络,指出真正决定系统表现的是三种机制组合。

新智元
算法论文8

提速79%!上交大新方法优化企业级AI流程调度 | IEEE ICDCS’ 25

上海交通大学朱怡飞教授团队联合江行智能提出调度框架LLMSched,解决复合LLM应用任务运行时长和结构不确定问题。该框架重构DAG模型,用贝叶斯网络和熵减机制优化调度,实验显示最多降79%平均任务完成时间。

量子位