「开放权重语言模型」共找到 1773 篇相关文章
刚刚国产双响炮炸场!智谱「牛来模型」和阿里Qwen3.8-Flash双双亮相屠榜
智谱发布GLM - 5.3 - Flash(牛来模型),原生多模态,支持1M token上下文,运行在国产芯片,价格实惠。阿里开源Qwen3.8 - Flash - Next权重,成本低性能优,在四大维度重构架构。
刚刚,Anthropic这篇论文上了Natrue
Anthropic关于“潜意识学习”的研究发表于《Nature》杂志。研究揭示大语言模型能通过与语义无关的数据传递行为特征,如偏好、不对齐行为等,还探究了其机制,并在MNIST上验证。
刚刚,MiniMax新模型接管「音乐圈」!20秒出歌Cover全风格
4月10日,MiniMax带来重磅更新,上线Music 2.6模型并发布专属Music Skills,核心新功能Cover翻唱可自由进行风格置换。Music 2.6在速度、音乐性和音质上改进明显,还开放三个Music Skills套件。
仅用1/9的token拿下SOTA,用LLM当知识路由:全新RAG框架DeepSieve
大语言模型遇「最新」或「垂直领域」知识易出错,传统RAG做法有痛点。全新RAG框架DeepSieve把LLM当知识路由器,四步筛选信息,实验精度高、成本低,消融实验明确各模块价值,还有救场案例。
马斯克的Neuralink梦想成真?意识连续谱理论震惊科学界!
美国发育生物学家Michael Levin探讨意识与自我组装关系,强调意识是连续谱系。他从生物自我组装过程、意识与身份特性等多方面阐述,还呼吁用开放视角理解意识本质,并提出研究方向。
从文心开源谈起,论大模型发展新生态
6月30日百度宣布开源ERNIE 4.5即文心4.5系列模型,实现预训练权重+推理代码完全开源。文心团队提出创新架构,增强多模态理解能力。今晚7:30,CSDN邀专家深度解读文心开源及行业趋势。
在一台1970年代的PDP-11上训练Transformer需要多久?答案是5.5分钟
近日,开发者复现1970年代技术环境,用PDP - 11汇编语言实现Transformer并训练成功,项目叫ATTN - 11。在低资源下实现功能闭环引热议,大家思考Transformer到底需要什么。
Vercel发布skills 1.1.1:让Skills跨平台共享
Vercel发布skills 1.1.1命令行工具,解决AI助手技能发现和管理标准化问题。它打破技能孤岛,让技能跨27种AI助手共享。更新有交互式发现等功能,项目开源,使用方便,欲建开放标准。
年终总结,通用Agent在企业落地,为什么这么难?到底要怎么做?
文章指出通用Agent在企业落地难,原因有模型本身问题、工程化落地难度被低估、安全合规要求高。还介绍金蝶苍穹Agent平台,它嵌入企业管理场景,有业务模板、开放标准和安全保障。
Cloudflare 增强robots协议:对“AI白嫖”说不
互联网面临开放内容被利用或封闭内容失读者的困境,AI加剧此局面。Cloudflare持近20%网站流量,先推抓取付费策略,又推“内容信号政策”,升级robots.txt,限制AI训练使用内容。