彭宇新团队」共找到 6174 篇相关文章

算法论文8

性能不减,吞吐量提升6.4倍!英伟达用混合算子和架构定义小模型标准

NVIDIA研究团队通过Nemotron - Flash系列模型,打破对‘深而瘦’架构迷信,修正缩放定律,用进化算法搜索混合算子、改进训练策略。该模型在性能、延迟和吞吐量上表现出色,远超同类产品。

AIGC开放社区
算法论文8

Meta通过简单算术解锁LLM SoTA性能

大型语言模型训练耗算力与时间,传统模型融合方法有局限。本文提出SoCE方法,通过筛选专家模型、非均匀加权平均融合,在多评测中实现先进性能,为LLM优化提供思路。

深度学习自然语言处理
开源动态7

Dev Proxy v1.3.0:HAR 文件生成、LLM 使用跟踪、增强的 API 测试功能

Microsoft 365 开发团队发布 Dev Proxy v1.3.0 版,引入 HAR 文件生成、OpenAI 使用跟踪等功能,改善调试、测试和 API 监控,还改进 OpenAPI 规范生成等,同时更了 VS Code 工具包。

InfoQ
新闻资讯8

OpenAI Atlas等AI浏览器暴露Web Agent安全风险!南洋理工破解底层机制

OpenAI Atlas等AI浏览器提升网页自动化效率,但使智能爬虫威胁加剧。南洋理工等团队研发的WebCloak,混淆网页结构与语义,打破爬虫技术依赖,为数据安全筑防线,适用于数据敏感场景。

新智元
开源动态7

今天,好像见证了属于SD时代的消亡。

liblib宣布升级到2.0,作为国内最大SD生态开源社区,其转型宣告SD时代落幕。曾几何时,SD让普通人感受AI绘图魔力,如今技术迭代,AI绘图门槛降低,模型受大众青睐。

数字生命卡兹克
算法论文7

AI 模拟消费者,预测购买意图准确率达 90%

PyMC Labs和高露洁棕榄团队研究发现,让大语言模型扮演消费者,用另一AI评分可90%准确预测购买意图,还提出SSR方法。虽有优势,但也面临质疑和局限,可增强市场调研。

AI工程化
算法论文8

大模型“精细化”对齐,真实性提升25.8%刷SOTA!token级精准编辑,无需训练即插即用

北航团队在EMNLP 2025提出Token - Aware Editing (TAE)方法,从token层面解决传统表征编辑技术问题,无需训练、即插即用,在多个对齐维度显著提升,如在TruthfulQA任务上真实性指标提升25.8%。

量子位
新闻资讯7

视远·正心明智——机器之心2025年度AI榜单正式启动

2025年人工智能浪潮奔涌,大模型快速迭代,催生应用形态,中国AI发展精彩。机器之心精心策划2025年度榜单,涵盖最强技术实力企业等多个类别,有意企业可扫码申报。

机器之心
新闻资讯7

Meta CTO打脸扎克伯格:首秀翻车全因致命bug,AI智商捉急、语音交互全面崩盘

Meta Connect开发者大会上,Meta发布三款智能眼镜,现场演示却屡屡翻车。扎克伯格归咎于Wi-Fi,CTO Bosworth否认,称是资源管理失误和软件bug所致,但网友对此解释并不买账,质疑团队能力。

InfoQ
新闻资讯8

ACL最佳论文幕后的北大人!北大张铭带出顶会常胜军和百亿CEO天团|智元十周年峰会

北大张铭教授团队十年两度获世界顶会「最佳论文」,学生有人写大奖论文,有人创办百亿企业,高中生也能参与科研拿奖。其将科研思维与创教育结合,走出独特人才培养路径。

新智元