自研模型」共找到 8207 篇相关文章

新闻资讯8

编码器-解码器架构的复兴?谷歌一口气发布32个T5Gemma模型

谷歌在xAI吸引眼球时更新Gemma系列模型,发布多模态模型MedGemma,还一口气推出32个T5Gemma模型。该模型基于适应技术,性能表现佳,引发编码器 - 解码器架构复兴讨论。

机器之心
新闻资讯8

击败PI ,清华系具身公司包揽「具身奥林匹克」三项全球第一,刷新世界纪录!

在Benjie's Olympics赛事中,星动纪元凭借具身智能模型获三项全球第一,击败具身领域老牌公司PI。该赛事规则严苛,星动纪元在剥橘子、开锁、翻袜子任务中表现出色,此前其在技术发和场景落地也成果颇丰。

AI科技评论
新闻资讯7

火速吃瓜,OpenAI模型还没发又惹出争议了??

GPT - 6发布前夕消息不断,OpenAI新模型引入的“循环深度”技术因可能让模型思考难监控引争议,同时模型名或被API剧透,图像模型GPT Images 2.1也将更新。

量子位
算法论文8

用MoE打造DNA基础模型更强范式!人大实现seq2func全新突破

中国人民大学团队提出SPACE模型,通过引入物种感知编码器和谱系分组增强解码器,革新架构,提升了DNA基础模型性能与泛化能力,在多项测试中表现优于主流模型

新智元
产品应用7

Ollama升级模型调度系统:内存管理更精准,多GPU性能提升

Ollama升级模型调度系统,精确测量运行模型所需内存,带来内存崩溃减少、GPU利用率提高等改进。Gemma3、Mistral - small3.2等模型性能提升,更多模型正迁移,还在开发iGPU支持,评估NPU支持。

AI工程化
算法论文8

英伟达发布 Jet-Nemotron 系列小模型,理论最大加速比 56 倍

英伟达发布 Jet - Nemotron 系列小模型,在多项基准测试中表现出色,实现高吞吐量加速和高准确率。其训练采用 PostNAS 方案,对既有模型针对性优化,展示了在小模型优化上的可行技术路径。

AI科技评论
产品应用8

新一代AI教师是什么样?学而思让它从L2「助手」跃迁至L3「老师」

在AI应用落地成关键的当下,教育成AI融合创新前沿。好未来CTO田密提出「AI教师L1 - L5分级」理论,指出当前AI老师达L2水平,L3正演进。学而思学习机的「小思AI一对一」迈向L3,依托硬件和模型,结合优质内容,从可用走向可信。

机器之心
推荐文章8

忘记大模型,英伟达:小模型才是Agentic AI的未来!

截至2024年末,Agentic AI领域获超20亿美元初创公司融资。NVIDIA究报告显示,多数Agentic AI场景中,小型语言模型已足够强、更适配、更便宜,LLM-to-SLM迁移是必然趋势。

PaperAgent
新闻资讯8

LeCun点赞:国产开源模型占领硅谷,性价比超10倍

硅谷被中国开源模型占领,Cursor、Cognition等公司模型被曝套壳或基于中国开源模型后训练。巨头如Meta也用Qwen做训练,爱彼迎等青睐Qwen。因性价比高,中国开源模型在硅谷走红。

量子位
新闻资讯7

模型能复刻这些系统吗?ProgramBench给出了残酷答案

斯坦福NLP组发布ProgramBench,用200个完整代码库重建任务测试主流大模型,要求模型仅根据可执行文件还原如SQLite等项目完整代码,结果所有模型实际解决率为0%,说明模型更擅模仿代码表面结构。

AI工程化