应用研究」共找到 3904 篇相关文章

算法论文8

LLM内部竟藏着众多策略模型?自所&腾讯团队首次揭示大模型RL新机制

中国科学院自动化研究所与腾讯AI Lab团队,从可解释性分析出发,发现LLM内部含多个可采样内部策略,揭示不同模型推理熵模式,提出BuPO算法,在复杂推理任务上表现优于传统算法。

PaperAgent
新闻资讯7

Cursor“自研”模型套壳国产开源?网友:毕竟好用又便宜

美国顶流AI产品Cursor和Windsurf发布新模型,被指“套壳”中国开源大模型。Cursor新模型干活时说中文,Windsurf或用智谱GLM。中国开源模型物美价廉,在榜单和下载量上表现出色。

量子位
算法论文8

TPAMI 2025 | AI对抗迁移性评估的「拨乱反正」:那些年效果虚高的攻防算法们

本文第一作者赵正宇来自西安交大,针对现有迁移攻击方法缺乏系统公平对比分析的问题,将其分为五大类,在 ImageNet 上对 23 种攻击与 11 种防御方法开展评估,证实评估缺陷会误导结论,解决后有新见解。

机器之心
推荐文章8

迈向可信AI:LLM幻觉的分析与优化

随着LLM广泛应用,其幻觉现象成AI落地关键挑战。文章分析LLM幻觉成因、优缺点,结合RAG、SFT、强化学习等技术,提出多维度优化方案,为构建可信大模型应用提供理论与实践路径。

腾讯技术工程
算法论文8

重塑注意力机制:GTA登场,KV缓存缩减70%、计算量削减62.5%

GTA由多所高校联合研发,提出大模型框架,解决传统多头注意力机制弊端。通过分组共享注意力矩阵和压缩潜在值表示,削减计算量、缩减KV缓存,实验验证其性能优、效率高,虽有局限但前景好。

机器之心
新闻资讯7

14%论文都有AI代写?Nature:每7篇就有1篇藏有ChatGPT特征词

据Nature报道,研究发现在2024年PubMed上超20万篇生物医学研究摘要频繁出现LLM特征词。部分国家和学科中,AI辅助写作比例超五分之一且趋势上升,作者还会引导LLM规避痕迹。

量子位
开源动态7

Arch Gateway: AI Gateway的前瞻选择

AI Agent开发易陷入复杂维护困境,借鉴云原生思路,一些云原生产品朝着AI gateway进化。介绍开源项目Arch Gateway,它是AI原生gateway,具备智能路由、工具调用等能力,能让开发者专注核心业务逻辑。

AI工程化
新闻资讯7

重磅!Telegram官宣Grok将登陆!Ton应声暴涨16%

Telegram创始人宣布与xAI达成1年合作,将Grok AI集成到应用中,今年夏天用户可使用。Telegram获3亿现金加股权及50%订阅分成,此合作改写聊天应用格局,也引发用户不同反应。

AGI Hunt
产品应用7

Spring AI 实战|Spring AI入门之DeepSeek调用

文章介绍Spring AI框架,它简化企业数据或API服务与大模型集成,降低开发复杂度。还给出调用DeepSeek的实战步骤,包括手动请求、代码自动发起、实现流式响应等,也提及OpenAI starter的兼容性及生产环境监控。

阿里云开发者
新闻资讯8

阿里成立Token Hub事业群,打碎钉钉,做成龙虾!

阿里巴巴成立Alibaba Token Hub事业群,首席执行官吴泳铭挂帅。旗下设5大事业部,目标是创造、输送和应用Token。还发布企业级旗舰应用悟空,重写底层架构,打造专属文件系统与Skill生态,展示多款智能硬件。

AIGC开放社区