「中国模型」共找到 8213 篇相关文章
一个模型千万个灵魂!Anthropic找到了防止AI陷入疯狂的防线
Anthropic和牛津大学研究发现,大模型的AI助理角色易在长对话中漂移崩塌,致其陷入幻觉。研究解析助理轴,揭示模型人格定位,还提出激活上限技术,能在保能力的同时降低有害回复率。
CVPR 25 |全面提升视觉感知鲁棒性,生成模型快速赋能三维检测
香港中文大学(深圳)等单位学者提出 DriveGEN 无训练自动驾驶图像可控生成方法,无需额外训练生成模型,通过两阶段策略扩展训练数据,提升三维检测模型鲁棒性,代码已开源。
突发!美国在AI芯片嵌入追踪器,以阻止运往中国
路透社消息,美国当局秘密在部分可能被非法转运至中国的先进AI芯片货运中装位置追踪装置,旨在检测运往受出口限制目的地的芯片,该措施仅针对特定货运,中国谴责美出口限制。
创建“中国的ASML”!中芯国际、北方华创等掌舵人联名建议
多位中国集成电路行业领军人物联合撰文,提出在‘十五五’期间通过整合机制,集中力量解决极紫外光刻等关键问题,建议创立‘中国的ASML’,还设定了未来五年产业发展的量化目标。
Claude Opus 4.1模型发布,OpenAI继续被拉开差距
Anthropic发布Claude Opus 4.1模型,在各指标上超越Opus 4。Anthropic ARR达50亿美元,API收入首超OpenAI。新模型在多场景有进步,官网等渠道统一可用,还给出Claude Code使用建议。
AMI Labs 冯雁:AI 迈向现实世界,世界模型不可或缺 | ICML 2026
2026年7月7日,AMI Labs冯雁在ICML 2026带来特邀演讲,系统回答三个核心命题。她认为AI迈向现实世界,世界模型不可或缺,JEPA世界模型比生成式更具结构性优势,团队也取得系列关键突破。
五角大楼计划将绝密数据喂给AI,训练军事特供版模型
《麻省理工学院技术评论》称,五角大楼正讨论为生成式人工智能公司建安全环境,用机密数据训练军事特定版本模型。美国军方重构战略,推动先锋项目,还筹备用绝密数据训练模型,引发安全担忧。
比肩Claude Opus:阶跃星辰最强模型Step 3.5 Flash发布
阶跃星辰发布最强模型 Step 3.5 Flash,参数强大,性能与前沿顶级大模型并驾齐驱。其架构平衡算力与智力,有独特注意力布局;基础设施保障训练稳定;强化学习激发智能体潜能;评测数据显示战斗力强,未来还将持续优化。
大模型平台AI21 Labs获3亿美元D轮融资
Business Insider消息,大模型平台AI21 Labs获3亿美元D轮融资,由谷歌、英伟达领投。该公司创立于2017年,2025年3月推出新AI平台Maestro,可提升主流模型指令遵循准确性。
幻觉的根源找到了:大模型说谎,是为了讨好你
清华大学OpenBMB团队研究发现,大模型胡说八道根源是想讨好用户。他们识别出负责产生幻觉的H - Neurons,占比不到0.1%,其本质是‘过度服从’,在预训练阶段形成,为构建可靠模型提供新视角。