「多语言大模型」共找到 9869 篇相关文章
MIT这篇RLM论文,给出了Scaling的另一种可能~
当大家普遍认为解决长上下文问题要靠扩大模型上下文窗口时,MIT 最新的 RLM 论文提出新路径。其 code 已开源,能实现无界上下文处理,可让任意大语言模型处理 10 万 +token。
追剧不断网,可能背后有个AI在加班,故障诊断准度破91.79%
中兴通讯和中国移动团队针对电信网络故障诊断难题,提出 TN - RCA530 基准和 Auto - RCA 框架。测试多个大模型,初始准确率低,经框架优化后,Gemini - 2.5 - Pro 准确率从 58.99% 升至 91.79%,超人工水平。
The Batch: 978 | DeepSeek-V4-Pro 更新了
DeepSeek发布旗舰模型DeepSeek-V4-Pro-0813正式版,性能提升,还发布开源agent harness开发者预览版并提价。模型在多指标表现佳,编码能力改进明显,公司公开基准测试框架意义大。
完全免费!Claude Science开源平替,DeepSeek/GLM想用哪个用哪个
Anthropic发布面向科学家的AI工作平台Claude Science,能集成科研工具、多智能体协作等,但有系统、付费和模型使用限制。YC孵化团队推出开源平替OpenScience,不绑定模型厂商,功能更丰富且安装简单。
Nano Banana 拉爆谷歌营收创纪录,劈柴哥开心坏了!幕后团队曝内部“绝对优先事项清单”
谷歌凭借Nano Banana功能让Gemini应用月活达6.5亿,单季营收破千亿。Nano Banana由多团队融合能力打造,引发全球热潮,吸引年轻和国际用户。文中还探讨其诞生、传播原因及图像编辑未来,提及谷歌发展规划。
做过十遍还要从头摸索?Agent 的记忆终于开始长成技能
MemTensor 等机构提出无需训练基础模型的 MSCE 框架,为 Agent 外部经验建‘晋升制度’,让经验成技能。该论文在 EvoAgentBench 与 LoCoMo 测试中结果更好,但在因果证明、模型依赖等方面有不足。
DeepSeek-OCR是「长文本理解」未来方向吗?中科院新基准给出答案
DeepSeek-OCR的视觉文本压缩技术降低长文本处理成本,中科院自动化所等团队推出VTCBench基准测试评估模型视觉认知,含三大任务及衍生版本,测试结果有‘U型曲线’,还评测多种尖端模型。
紫东太初推出GMC核心集剪枝方法,少80%Token仍满血保真多模态能力
视觉Token冗余是多模态模型高效推理与落地的瓶颈,传统筛选方法有缺陷。紫东太初团队提出GMC核心集剪枝方法,具双阶段架构,优势多,实验显示其能在减少Token同时保持性能。
AgentScope x RocketMQ:打造企业级高可靠 A2A 智能体通信基座
文章介绍 Apache RocketMQ 新推的 LiteTopic 通信模型,能简化 AI 系统架构、提升稳定性。结合 A2A 协议与 AgentScope 框架案例,剖析智能体通信实践与技术实现,还给出构建多智能体应用的实战方案。
几分钟扫完细菌全基因组,MIT团队用AI找出大量未知的抗病毒防御系统
MIT科学家开发AI模型DefensePredictor,能从细菌基因组快速找防御系统。用约1.7万个细菌基因组训练,借助ESM2蛋白语言模型,几分钟扫描完一个细菌全基因组,还开源供科学界使用,潜力巨大。