编程性能」共找到 2913 篇相关文章

开源动态8

ROLL:面向大规模语言模型的高效强化学习框架

本文介绍阿里推出的ROLL强化学习框架,专为LLM训练优化。它设计灵活,不同用户可用其满足业务、探索或线上指标需求。在多任务训练中性能出色,还采用创新机制提升效率,支持自定义操作,适合学术和业务场景。

阿里云开发者
新闻资讯8

semianalysis 长文 | 关于Meta 砸钱、抢人、领导力、建帐篷、计算、数据和超级智能

Meta在基础模型性能落后,扎克伯格亲自挂帅开启AI军备竞赛。他砸钱收购、挖人、堆算力,建GPU集群,还面临Llama 4失败问题,试图通过一系列举措追赶超级智能。

AGI Hunt
新闻资讯7

突发!OpenAI收购失败,windsurf被谷歌一锅端

原定OpenAI收购AI编程初创公司Windsurf交易取消,其CEO等核心人员转投谷歌DeepMind,围绕Gemini研究“代理编码”。谷歌是“人才聘用”,获部分技术非排他许可,Windsurf继续运营。

AI寒武纪
开源动态8

还在为AI数据发愁?张文涛和鄂维南院士团队推出Data-centric AI系统

近年来大模型发展由科技公司主导,其数据资源不公开,学术界构建优化数据难。张文涛和鄂维南院士团队推出DataFlow系统,可实现数据治理,有算子和流水线,支持文本模态,多模态版待推出。

机器之心
产品应用7

Cursor 免费平替:Gemini Code Assist (附开启隐藏 Agent 模式教程)

文章介绍了 Cursor 的免费平替 Gemini Code Assist,可在多种 IDE 免费使用,基于 Google 先进的 Gemini 模型。还给出安装指南,以及开启隐藏 Agent 模式教程,开启后能调用 MCPs 增强能力。

AI寒武纪
算法论文8

MoCa:首个大规模双向多模态表征模型

为解决VLM用于嵌入的痛点,中国人民大学等机构研究者提出MoCa框架,可将单向注意力VLM训练成双向多模态编码器。它分两阶段,实验效果好,未来可拓展模态、提升多语言适应等。

PaperAgent
算法论文8

LLM进入「拖拽时代」!只靠Prompt,几秒定制一个大模型,效率飙升12000倍

新智元报道,NUS、UT Austin等机构研究人员提出「拖拽式大语言模型」(DnD),它基于提示词生成模型参数,无需微调适应任务,效率最高提升12000倍,零样本泛化能力出色。

新智元
新闻资讯8

谷歌CEO劈柴震撼预言:2030年AI直逼超人智能,80亿人认知被颠覆

谷歌CEO劈柴在采访中称AI是人类历史上影响最深远的技术,进步极快且能力上限未知。他谈到AI会释放80亿人认知潜能,还从多方面阐述了AI对各领域的影响及未来发展。

新智元
新闻资讯8

2025 Google I/O 大会开发者主旨演讲干货盘点

今年 Google I/O 大会开发者主旨演讲亮点多。展示在 Google 平台应用构建,利用 Google DeepMind 的 AI 模型创新。如 Google AI Studio 集成 Gemini 2.5 Pro,还有 Jules 等工具,以及多款新模型发布。

AIGC开放社区
算法论文8

Agent进入下一篇章!Alita:不靠人工预设,自己造工具,成绩碾压OpenAI

当前AI Agent依赖人工预设,存在工具不够用、缺乏创造力、兼容性差等问题。Alita秉持少预设多进化理念,用MCP协议,架构含三大模块,实验成绩超OpenAI,还能让小模型提效。

深度学习自然语言处理