大模型越狱」共找到 9155 篇相关文章

算法论文8

模型训练的不稳定性有望彻底解决,MIT新研究用谱正则化替代层归一化

MIT团队创造Lipschitz Transformer,用谱正则化替代层归一化,认为或解决训练不稳定根本原因。他们对比多种方法权衡,发现Muon + 奇异值裁剪推动权衡边界,且工作完全开源。

AGI Hunt
新闻资讯7

Cursor滑跪开源技术报告:Kimi基模这样微调能干翻Claude

Cursor放出Composer 2技术报告力证‘自研’,基于Kimi K2.5经持续预训练和异步强化学习,测试表现好。同时,杨植麟分享Kimi团队最新思考,认为模型要规模化,断言模型训练进入第三阶段。

量子位
算法论文7

老牌Transformer杀手在ICLR悄然更新:Mamba-3三改进趋近设计完全体

Transformer架构仍是AI主流,Mamba作为挑战者影响力。Mamba-3在ICLR 2026盲审,有梯形离散化、复数化状态空间模型、多输入多输出状态空间模型改进,实证表现佳,适合多场景。

机器之心
算法论文8

模型外挂“三维物体知识库”来了,幅增强机器人长程自主操作能力

现有视觉语言模型(VLM)能让机器人理解指令,但在操作中缺三维空间知识。近日研究提出 RAM 框架,它像“三维物体知识库”,为 VLM 补充空间知识,经 14 项实验验证其操作能力,还探索了在铰接与柔性物体操作中的应用。

DeepTech深科技
算法论文8

解决特斯拉「监督稀疏」难题,DriveVLA-W0用世界模型自动驾驶Data Scaling Law

自动驾驶领域VLA模型面临‘监督稀疏’难题,特斯拉公布此挑战。DriveVLA - W0研究提出用世界模型解决,将‘预测未来图像’作自监督训练任务,还提出轻量级架构降低推理延迟。

机器之心
产品应用8

模型测试不再跳来跳去,VS Code + Hugging Face = 真香

Hugging Face 发布新功能,让开发者在 VS Code 的 GitHub Copilot Chat 中直接接入 Inference Providers,可调用 Kimi K2 等开源模型测试,无需频繁切换平台。该功能有统一 API 等优势,定价门槛低。

InfoQ
开源动态8

腾讯开源最强3D生成模型,消费级显卡就能跑 | CVPR

在CVPR上,腾讯混元3D 2.1模型宣布开源。相比前一代,它实现几何与纹理双重优化,纹理贴面提升,达当前开源3D模型SOTA水平。全链路开源,适配消费级显卡,Hugging Face下载量超180万。

量子位
新闻资讯7

拒稿警告,靠模型「偷摸水论文」被堵死,ICLR最严新规来了

ICLR 2026出台语言模型使用政策,规范作者与审稿人使用LLM做法,明确需如实披露使用情况并担责,违规将受处罚。其他顶会如NeurIPS、ICML等也有相关规定。

机器之心
新闻资讯8

陶哲轩敲警钟!谷歌DeepMind联手五神殿,用AI向世纪难题宣战

谷歌DeepMind发起「AI赋能数学计划」,集结五顶尖机构,用最强数学AI探索数学难题。陶哲轩警示要警惕AI滥用风险,还提出论文使用AI的三建议,如声明使用、讨论风险及明确责任。

新智元
开源动态8

OpenAI深夜开源HealthBench,60个国家合力开发5000段真实对话

今天凌晨1点30,OpenAI开源医疗模型测试评估集HealthBench。其5000段核心测试对话由60个国家/地区的262名医生打造,采用多轮对话测试。测试显示模型在医疗保健领域表现显著提升,还介绍了其构建及评估等情况。

AIGC开放社区