大模型3.0」共找到 9997 篇相关文章

新闻资讯8

刚刚,阿里旗舰模型Qwen3-Max-Thinking发布,编程能力“踢馆”Gemini与Claude

阿里发布旗舰模型Qwen3-Max-Thinking,总参数超1万亿,在多项权威基准测试中表现优异,可与顶级闭源模型竞争。千问团队为其引入两项核心创新,提升推理性能,该模型已可免费体验。

InfoQ
产品应用8

横扫海外的阿里模型,有自己的APP了,叫“千问”

11月17日,阿里巴巴上线“千问App”,将Qwen系列模型装进面向C端用户的独立App。它设计极简,功能强,免费使用。主模型为Qwen3,问答结构化,多模态交互方便,还有翻译等特色功能,背后是强的Qwen模型生态。

MacTalk
新闻资讯8

中国AGI深度时刻!杨强、唐杰、林俊旸、姚顺雨咖们2026开年重磅交锋

2025年中国开源模型表现出色,AI模型探索新范式。AGI - Next前沿峰会嘉宾探讨AGI发展,指出模型To C与To B市场逻辑分化,还谈及自主进化、智能体变革及中国AI发展路径等问题。

AIGC开放社区
开源动态8

HF日趋榜一!真端到端模型AutoDeco终结手动调参解码

语言模型手动调参解码繁琐,腾讯AI Lab王琰团队联合港中(深圳)唐晓莹教授团队推出AutoDeco架构,通过创新训练策略让模型动态预测解码参数,在多模型实验中表现出色且已开源。

机器之心
产品应用8

2秒终结AI 3D不可能三角,我们和VAST首席科学家曹炎培聊了聊

速度、质量、管线可用性是AI 3D生成的不可能三角。VAST发布的Tripo P1.0首次在原生三维空间概率生成,2秒输出专业3D资产,效率提升百倍,生成结果可直接用于多场景,突破了这一困境。

机器之心
新闻资讯7

突发!微软与OpenAI同日开火:语音之战+通用模型,AI霸权决战打响

OpenAI发布语音模型时,微软同日推出自研语音模型MAI-Voice-1和通用模型MAI-1-preview。MAI-Voice-1效率高、表达丰富,MAI-1-preview采用MoE架构。微软此举在语音战场布局,也为与OpenAI谈判增加筹码。

新智元
算法论文8

两个LLM互相对线,推理能力起飞:康奈尔团队发布模型版类GAN训练法

康奈尔学团队提出面向语言模型的类GAN训练框架PasoDoble,通过对抗训练两模型提升推理能力,不依赖外部监督,在多模型实验中显著提升数学基准表现,不过在部分领域外任务有局限。

机器之心
产品应用7

面壁MiniCPM4推理速度3倍,碾压同尺寸Qwen3,阿里上眼药了~

面壁发布包含10个模型的MiniCPM4系列,其推理速度快。它有高效模型架构、学习算法、高质量训练数据和推理系统等创新点,还给出了MiniCPM4实战代码及启用InfLLM v2的参数设置。

CourseAI
新闻资讯7

1/8成本比肩Claude 3.7,Mistral Medium 3来了

“欧洲OpenAI”Mistral AI发布多模态新模型Mistral Medium 3,主打编程和多模态理解,成本仅Claude 3.7的1/8,性能达其90%,API已上线,还推出企业聊天机器人服务,引发网友不同看法。

量子位
算法论文8

工行x上交发布多智能体研究成果,通过群体智能刷新翻译新高度!

2025年多智能体系统成模型研发新高地。工行数据和人工智能实验室与上海交人工智能学院推出多智能体翻译系统TACTIC,以认知翻译学为指导,在相同模型配置下提升翻译效果,在小模型下提升更明显。

深度学习自然语言处理