「企业 LLM」共找到 2162 篇相关文章
GPT之父把AI扔回1930年:没见过一行代码,却「发明」了Python!
GPT之父Alec Radford带队发布总参数130亿的大模型「talkie」,其训练数据冻结在1930年,没学过编程却能写Python代码,证明LLM可用旧知识推理。团队后续还有升级计划。
ICML Desk Reject 引发热议,AI审稿究竟该如何科学检测
ICML 2026 部分论文被 desk reject,因 reviewer 用 LLM 写 review。ICML 用带诱导的隐式水印检测,引发支持与反对争议。有论文提出从文本检测转向判断检测,还开发 J - Detector,结合文本检测准确率达 99.3%。
线性注意力回归!Kimi新模型引爆,MiniMax却悄悄换回传统架构
LLM领域线性注意力机制正在回归,工程实践主要由国产模型推进。早期线性注意力因牺牲精度未获主流认可,今年下半年多个国产模型采用其变体,MiniMax却又换回传统架构,Kimi新模型带来新解法。
《AI时代下,中国低/零代码市场发展研究》报告正式发布 | LowCode低码时代
《AI时代下,中国低/零代码市场发展研究》报告发布,指出低/零代码技术渗透率提升,主流厂商提供全链路方案。生成式AI与低/零代码融合成趋势,市场稳定增长,企业对平台综合能力要求提高。
上海交大团队发布首篇「搜索智能体」综述!四个维度深度剖析搜索智能体
上海交大团队发布首篇「搜索智能体」综述,从如何搜索、优化、应用、评估四个维度剖析。随着LLM兴起,搜索从传统模式向搜索智能体转变,虽有潜力但缺统一研究视角与评估框架,该综述提供了路线图。
又上Trending,这个项目赋予AI灵性,可以和你一起玩游戏看电视!
项目 AIRI 可让用户轻松拥有数字生命。与其他项目不同,它支持多种 Web 技术,能在现代浏览器和设备运行,还能玩游戏、看视频。目前已完成部分基础功能,支持众多 LLM API 服务,还衍生出多个子项目。
一年后,DeepSeek-R1的每token成本降到了原来的1/32
几天前,DeepSeek更新R1论文至86页,公开训练全路径等细节。英伟达发表博客展示在Blackwell GPU上对其降本增效,通过软硬协同提升每瓦特Token吞吐量,还介绍了TensorRT - LLM软件及相关技术提升性能的情况。
MIDAS:快手可灵发布实时交互式数字人生成框架
近年来交互式数字人视频生成受关注,但实时处理多模态输入有挑战。快手可灵团队提出MIDAS框架,基于LLM驱动的自回归模型,结合轻量级扩散头,实现低延迟、交互式多模态控制,还构建大规模数据集等。
GPT-5最大市场在印度?Altman最新访谈:可以聊婚姻家庭,但回答不了GPT-5为何不及预期
2025年8月8日OpenAI发布GPT - 5引热议。个人消费者多有不满,反馈体验差、性能不强;企业级市场却很欢迎,多家公司已采用。Sam Altman在访谈谈其特性,还聊了职业、家庭、AI发展等话题。
荣登HuggingFace周榜首位, 人大高瓴与快手提出ARPO实现智能体高效训练!
人大高瓴与快手提出的ARPO项目受高度关注,荣登Huggingface Paper日榜、周榜双首位。它是为多轮交互型LLM智能体设计的强化学习算法,在基准测试中,用一半工具调用预算就显著优于现有方法。