多Agent并行推理」共找到 4687 篇相关文章

开源动态8

社区供稿丨Jina-VLM:可在笔记本上跑的多语言视觉小模型

Jina AI发布2.4B参数量的视觉语言模型Jina - VLM,在多语言视觉问答任务达SOTA。它引入注意力池化,连接视觉与语言基座,处理问答等任务,对硬件要求低,多项测试表现优,还介绍架构、训练策略和上手方式。

Hugging Face
开源动态8

第二代InfLLM开源,同尺寸快三倍!零参数,可训练稀疏注意力

新智元报道,清华、OpenBMB和哈工大提出零额外参数、训练高效的原生稀疏注意力框架InfLLM-V2,仅用5B长文本词元就能完成训练,相比稠密注意力机制有显著加速,性能接近传统稠密模型。

新智元
新闻资讯7

DeepSeek V3.1更新「最终版」!下一次是V4/R2了???

DeepSeek-V3.1更新至DeepSeek-V3.1-Terminus版本,修复了“极你太美”等bug,缓解中英文混杂等情况,优化了Code Agent与Search Agent表现。评测显示输出更稳定,但编程竞赛分数下降引质疑,版本名引发对后续版本猜测。

量子位
新闻资讯7

究竟会花落谁家?DeepSeek最新大模型瞄准了下一代国产AI芯片

近期,DeepSeek发布V3.1新模型,采用全新混合推理架构,在多任务表现上有提升。它采用UE8M0 FP8,或为国产推理芯片优化机制。国内多家厂商新一代AI芯片支持FP8,未来国产大模型或针对其专门优化。

机器之心
新闻资讯8

黄仁勋迟到了15分钟,然后甩出一个数字:1万亿美元。

GTC 2026上,黄仁勋获“Token之王”称号。他预计英伟达到2027年营收至少1万亿美元,还展示商业定价模型,推出Vera Rubin系统,整合Groq芯片,开源OpenClaw,预告Feynman架构,开发太空数据中心。

探索AGI
新闻资讯7

阿里AI重组:集团CEO吴泳铭亲征!「Token为王」全面决战ASI

阿里宣布成立全新的Alibaba Token Hub(ATH)事业群,由CEO吴泳铭挂帅,收拢通义千问等团队。这标志阿里AI战略转向,告别技术至上,聚焦B端商业变现与算力应用,围绕Token构建工业化流水线。

新智元
开源动态7

PaperDebugger:开源的学术版Cursor

PaperDebugger是AI驱动的学术写作助手,能调试和改进论文,提供智能建议。它用基于MCP的编排引擎,模拟学术流程,有聊天、插入、评论等功能,只读取项目,保障隐私。

PaperAgent
新闻资讯7

金山、Zilliz、腾讯、灵犀量子专家齐聚,揭秘 AI 记忆、RAG 演进与自我进化的工程实践 | AICon

2025 年构建复杂 AI 系统面临记忆缺失、检索瓶颈、认知固化等系统工程挑战,Context Engineering 是关键。AICon 北京站邀金山、Zilliz、腾讯、灵犀量子专家,分享上下文工程技术实践。

InfoQ
新闻资讯7

Claude 4如何思考?资深研究员回应:RLHF范式已过,RLVR已在编程/数学得到验证

Anthropic两位研究员在博客采访中透露Claude 4思考细节。提到可验证奖励强化学习RLVR在编程和数学领域获证明,探讨了RL扩展、模型自我意识等,还为大学生给出AI领域建议。

量子位
新闻资讯9

Claude Mods开始上线,社区用插件「魔改」Claude Code

本文报道Anthropic推出Claude Mods,开放Claude Code可编程扩展接口,支持开发者通过插件修改其行为与界面,甚至可让Claude自动生成Mod,引发社区测试与行业关注。

机器之心