模型自曝」共找到 8249 篇相关文章

新闻资讯7

多模态扩散模型开始爆发,这次是高速可控还能学习推理的LaViDa

近期基于扩散模型的视觉 - 语言模型 LaViDa 出现,它继承扩散语言模型优点。与回归模型不同,扩散模型能并行、处理双向上下文。LaViDa 在多任务测试有竞争力,推理蒸馏和文本填空表现好,还能权衡速度与质量。

机器之心
新闻资讯7

OpenAI 盲测新模型不如 Nano Banana Pro? Altman 要暂停 Sora,死磕 ChatGPT

近日,网友发现 Notion 或在测试 GPT - 5.2。OpenAI 盲测新图像模型‘Chestnut’和‘Hazelnut’,结果接近 Nano Banana Pro,但生成图未获好评。Altman 调整战略,暂停 Sora 死磕 ChatGPT,本周将推 GPT - 5.2。

InfoQ
新闻资讯7

英伟达推理服务器被高危漏洞,云端AI模型被攻击直接裸奔

安全研究机构Wiz Research光英伟达Triton推理服务器一组高危漏洞链,可组合利用实现远程代码执行,造成模型被盗、数据泄露等后果。英伟达已发布补丁,25.07版本前系统有风险。

量子位
产品应用8

刚刚,Cursor 2.0携模型Composer强势登场,不再只做「壳」

Cursor 2.0发布重大更新,带来研编码模型Composer和新协作界面。Composer速度领先,针对软件工程优化;新界面以智能体为中心,可并行运行多智能体,还解决了代码评审和测试瓶颈。

机器之心
算法论文8

除了prompting外,不动参数,如何改变模型行为?

文章指出传统提示工程控制大模型生成行为有缺陷,提出Steering Target Atoms (STA)方法。它用稀疏编码器分解LLM高维表示,定位“原子知识组件”精准控行为,实验效果超现有技术,还能控制推理长度。

深度学习自然语言处理
新闻资讯8

DeepSeek-R1登顶Nature,8位专家严审通过, 大模型「交卷时刻」来了

近日,DeepSeek - R1登上Nature封面,打破主流大模型未经过独立同行评审惯例。同行评审可理清模型机制,提升透明度与可信度,还能避免‘刷榜’‘评’,虽有公司担心泄密,但它是验证成果的必要程序。

新智元
推荐文章7

万字长文!大模型LLM推理优化技术总结

文章围绕大模型LLM推理优化技术展开,先介绍LLM推理各阶段、批处理、KV缓存等概念及内存需求,再阐述模型并行、注意力机制优化、模型优化和模型服务等技术,如Pipeline并行、MQA、量化、动态批处理等。

OpenMMLab
新闻资讯7

OpenAI重组GPT-5「灵魂」团队!亚裔女负责人遭调离,罕见AI幻觉祸首

OpenAI进行重磅结构调整,ChatGPT「模型行为」团队并入Post - Training,前负责人Joanne Jang负责新OAI Labs。同时,OpenAI揭秘AI产生「幻觉」的罪魁祸首是「应试」评估体系。

新智元
新闻资讯7

OpenAI「GPT门」事件引爆!Plus、Pro账户统统降配,偷换模型全网实锤

OpenAI被在用户不知情下,将GPT-4、GPT-5等模型路由至低算力敏感模型,引发用户对选择权和付费权益质疑。该现象已在社交媒体广泛验证,OpenAI回应称是在测试新安全路由系统。

新智元
算法论文8

适应Agent基础模型:从“会推理/会用工具”到“懂得取舍的执行者”

当前大型语言模型在智能体/工具调用场景有推理型和工具型两类,存在效率与功能、深度的矛盾。A²FM框架提出多模式适应路由,实现模式适应切换,在多基准测试中效果与效率双升。

深度学习自然语言处理