「开发团队模型」共找到 9953 篇相关文章
架构解耦是统一多模态模型所必须的吗?全新AIA损失:No
香港中文大学 MMLab 和美团研究者思考架构解耦是否为统一多模态模型必须,推出 AIA 损失。研究发现架构解耦未解决任务冲突,AIA 能提升模型性能,减少数据配比问题。
OpenRouter模型7月排名:谷歌遥遥领先,DeepSeek 令牌份额占比超越Anthtropic
OpenRouter公布7月模型排名,按模型令牌份额占比,谷歌以43.2%遥遥领先,DeepSeek 19.4%超Anthropic,OpenAI仅5.9%。编程领域Claude sonnet 4占比第一,谷歌Gemini 2.5pro进步大。
250份文档就能给大模型植入后门:不分参数规模
Claude母公司Anthropic联合英国AISI和图灵研究所研究发现,仅250份恶意文档就能给不同规模大模型植入“后门”漏洞,打破了以往对大模型数据中毒的认知,给厂商提了个醒。
【手把手教程】不写一行代码,开发鸿蒙应用,赚华为1万!
作者实测不写代码开发鸿蒙应用流程,介绍华为鸿蒙激励政策,含三档奖励最高1万。还讲搭建DevEco Studio与AI编程环境,用Claude Code开发,以及构建、打包、上架应用步骤和实用技巧。
大小模型协同架构在金融智能投顾中的应用与挑战
本文整理自北银金科高级算法专家尹辰轩分享,介绍大小模型协同架构下的大模型投顾方案,能解决幻觉问题、优化回答深度。还提到 12 月 19 - 20 日 AICon 北京站聚焦多热门方向。
比Qwen3-Max更Max?夸克抢先用上最新闭源模型
10月23日夸克上线对话助手,采用比Qwen3 - Max更优的Qwen最新闭源模型,实现AI搜索与对话深度融合。经测试其搜索、理解、写作等能力出色,技术架构创新,是阿里‘模型即应用’战略体现。
一个模型千万个灵魂!Anthropic找到了防止AI陷入疯狂的防线
Anthropic和牛津大学研究发现,大模型的AI助理角色易在长对话中漂移崩塌,致其陷入幻觉。研究解析助理轴,揭示模型人格定位,还提出激活上限技术,能在保能力的同时降低有害回复率。
CVPR 25 |全面提升视觉感知鲁棒性,生成模型快速赋能三维检测
香港中文大学(深圳)等单位学者提出 DriveGEN 无训练自动驾驶图像可控生成方法,无需额外训练生成模型,通过两阶段策略扩展训练数据,提升三维检测模型鲁棒性,代码已开源。
Claude Opus 4.1模型发布,OpenAI继续被拉开差距
Anthropic发布Claude Opus 4.1模型,在各指标上超越Opus 4。Anthropic ARR达50亿美元,API收入首超OpenAI。新模型在多场景有进步,官网等渠道统一可用,还给出Claude Code使用建议。
五角大楼计划将绝密数据喂给AI,训练军事特供版模型
《麻省理工学院技术评论》称,五角大楼正讨论为生成式人工智能公司建安全环境,用机密数据训练军事特定版本模型。美国军方重构战略,推动先锋项目,还筹备用绝密数据训练模型,引发安全担忧。