「模型性能提升」共找到 9292 篇相关文章
HBM更“热”了
HBM正从高性能计算领域向消费电子等市场渗透,技术迭代迅速。TSV等关键技术推动其性能提升,各企业技术路线有差异。应用领域广泛,但推广面临挑战。市场竞争激烈,各企业积极布局。
别再手搓测试数据了!AE测试数据智造系统揭秘
本文介绍基于大语言模型的AE测试数据智造Agent,解决AliExpress跨境电商测试数据构造难题。它结合大模型与原子工具库,实现自然语言驱动的全链路测试数据生成,提升测试效率与智能化水平。
DeepSeek-V3-0526 闪现后秒删!
Unsloth文档页面惊现DeepSeek新模型DeepSeek-V3-0526后秒删。该模型性能佳,团队还准备了技术描述。Daniel Han预测其可能端午节前发布,社区对此反应热烈,大家期待DeepSeek下一步动作。
李飞飞万字长文爆了!定义AI下一个十年
李飞飞新文指出AI下一个前沿是「空间智能」,揭秘其「世界模型」核心框架和三大核心支柱。构建具备空间智能的AI需世界模型,其应用涵盖创意、机器人、科学医疗等领域,有望提升人类生活。
Scaling Laws起源于1993年?OpenAI总裁:深度学习的根本已揭秘
人工智能扩展定律(Scaling Laws)把模型性能和资源投入联系,是构建大模型的参考标尺。其起源说法不一,康奈尔博士生将其推至1993年贝尔实验室论文,OpenAI总裁称它揭示深度学习根本。
GPT-6 真要来了!OpenAI全新推理架构“循环深度”首次曝光:可榨出14倍参数潜能
OpenAI将推旗舰模型GPT - 6(内部代号Astra),采用“循环深度”新技术,能榨出14倍参数潜能,降低成本,但会使AI推理过程不可读,加重安全担忧。OpenAI已因该模型“能力过强”踩刹车。
一段 signature,不仅撬开了 Opus 的隐藏推理,还让 Kimi、GLM 露出了"熟悉感"
研究者发现,将 Opus 等强模型返回的加密推理块交给同家族弱模型,弱模型可能转写出隐藏内容。如用 Haiku 读取 Opus 的加密信息。此外,公开的 Agent 轨迹存在隐私泄露风险,部分开源模型易受 Opus 风格影响。
AI越会思考,越容易被骗?「思维链劫持」攻击成功率超过90%
独立研究者Jianli Zhao等人新研究发现,思维链劫持攻击通过在有害请求前填充无害解谜推理序列,能对推理模型实现越狱攻击。在HarmBench基准上,对多模型攻击成功率超90%,揭示思维链推理存在新安全漏洞。
杨植麟带 Kimi 团队深夜回应:关于 K2 Thinking 爆火后的一切争议
上周,月之暗面发布并开源 Kimi K2 Thinking,主打“模型即 Agent”,引发广泛关注。今日凌晨,杨植麟等团队成员在 Reddit 开展 AMA 活动,回应 K2 Thinking 相关问题,如 KDA 机制应用、训练成本、速度与准确性平衡等。
出价算法新SOTA——快手首提生成式强化学习出价
文章介绍快手新提出的生成式强化学习出价模型GAVE,回顾出价算法发展历程。GAVE结合生成式与强化学习优势,有Score-based RTG等创新,经竞赛、实验验证效果佳,为出价技术带来新方向。