「大语言模型(LLM)」共找到 8349 篇相关文章
腾讯混元最新开源成“最强翻译”:国际机器翻译比赛获30个语种第一
腾讯混元团队的Hunyuan-MT-7B以7B总参数量获国际翻译比赛冠军,还开源了该模型及翻译集成模型Hunyuan-MT-Chimera-7B。其Shy框架有三大创新,在多方面表现优异,还为垂直领域优化提供模板。
多模态需求井喷,智能视频云如何靠分布式处理破局?
国内多模态AI发展中,模型层火热但应用层落地慢。多模态应用落地面临体验升级、视频化扩展、大模型部署下沉挑战,催生智能视频云升级需求。火山引擎在FORCE大会展示分布式多媒体处理实践,推出MIPP平台,未来将开源并推商业化产品。
拿下开源生图第一,千问Qwen-Image-2.1把生图卷出新高度
本文介绍阿里千问最新开源的7B参数量生图模型Qwen-Image-2.1,该模型拿下公开评测开源生图第一,实现文生图与图像编辑一体化,原生支持透明图生成,最多支持10张参考图输入,强化了局部编辑与人像商品保真,轻量且实用性强
AI音乐王座易主!Mureka V8硬刚全球巨头斩获双榜第一,V9即将来袭
AI音乐大模型Mureka V8在权威Artificial Analysis榜单上,斩获vocal与instrument双榜单第一,碾压Suno V4.5等主流模型。其核心技术是MusiCoT,在多维度获正向反馈。昆仑万维还与太合合作,V9将探索创作意图可控表达。
Claude最强领域被GPT反超!GPT 5.5最难编程基准破0
编程领域曾由Claude引领,如今GPT 5.5在大模型解决率为0%的最难编程基准上实现突破。程序重建基准测试(ProgramBench)考验严苛,过往模型解决率为0,GPT 5.5高和超高推理模式成功破局,展现了不同解题风格。
Claude Opus 5.5 浪费 token?这 4 步拦住它
本文分享网友总结的实用优化方法,针对Claude Opus 5.5浪费token的问题,给出4个可落地步骤,帮助降低大模型调用成本
千问负责人突然离职,阿里回应
3月4日凌晨,千问团队核心人物林俊旸突然宣布卸任,引发业内关注。其离职时间点较突然,且前后千问团队还有其他核心成员变动。3月5日,阿里巴巴CEO吴泳铭回应,称公司将坚持开源策略,加大AI研发和人才吸纳。
当面试官说「回去等通知」时,他们到底在等什么?
Chip Huyen的开源书《Machine Learning Interviews》被热议,其用200+道题拆解机器学习面试真相,指出多数人挂在三环节。书还摊开不同岗位考察点,建议关注解题路径,还给出资源指路。
姚顺雨现场颁奖,吉嘉铭、董冠霆等15位青年人才获腾讯「青云奖学金」
腾讯「青云奖学金」在深圳颁奖,首期选出 15 位获奖者,每人获 20 万现金和价值 30 万云异构算力资源。姚顺雨现身颁奖,获奖者有白雨石、陈俊松等青年 AI 学者,各有出色研究成果。
炫酷全能,一个窗口搞定所有,狂揽 1.5w 星!
Wave Terminal是开源跨平台终端应用,将命令行与图形化工具集成,操作在自由拖拽布局界面完成,减少上下文切换。有灵活布局、强大编辑器等特性,安装简单,创造全新高效工作流。