速度提升」共找到 3366 篇相关文章

算法论文8

成本暴降88%!通义实验室、北大发布ZeroSearch,无需搜索即可激活LLM检索能力

信息检索能力对提升大语言模型推理表现至关重要,但现有方法在训练中面临文档质量不可控和搜索 API 成本高昂两大挑战。为此,通义实验室和北大提出 ZeroSearch 框架,无需真实搜索即可激活 LLM 检索能力,显著降低成本。

机器之心
推荐文章7

在软件工程中,对 AI 的过度依赖,会加速工程师的无能

资深软件工程师Doug Slater指出,在软件工程中对大语言模型(LLM)过度依赖会加速工程师无能。LLM无法取代人类批判性思维,它在输出、输入、开发速度和用户技能等方面存在风险,且无法掌握程序理论和抵抗程序熵。

宝玉AI
产品应用7

Codex正式开放1M上下文!解除GPT-5.6 Sol封印,三行配置搞定

现在3行配置就能让GPT - 5.6 Sol封印解除,在Codex里用上1M上下文。不过有网友警告轻易别用,因超出默认窗口,模型消耗token速度会翻倍,且模型上下文利用能力会下降。此外,Codex确定会上Astra。

量子位
产品应用8

阿里 Qwen3.8 正式发布:2.4T 规模,自主编程 16 天搓出一个 Hermes Agent

8月3日,阿里发布新一代基座大模型Qwen3.8,总参数量2.4万亿,编程和办公能力提升,在权威榜单中表现出色。其API已上线,价格有优势。‘千问办公’公测,Qwen3.8性能强大,还适配阿里真武M890超节点。

InfoQ
产品应用8

Qwen3.8-Max:编程与办公,全面跃升

今日正式发布Qwen3.8-Max,下周将开源其及Qwen3.8 - 27B模型权重。它参数达2.4万亿,在多方面全面提升。开发者可通过千问AI平台获API服务,性价比高。在编程、办公等场景表现出色,用户反馈良好。

千问大模型
推荐文章8

一个文件让 AI Coding 效率翻倍:AGENTS.md 实践指南

文章围绕如何写好 AGENTS.md 展开,介绍其是给 AI 看的项目指令,能解决项目对 AI 不友好的痛点。还阐述了编写原则、实践方法、选择原因、模板和实施建议等,可让 AI 高效理解项目,提升开发效率。

阿里云开发者
算法论文8

停止迷信“超级Prompt”:要想AI不犯错,你得专门雇人“怼”它

这篇来自Isotopes AI的论文指出,在生成式AI落地中,迷信‘超级Prompt’不可取。对于高风险场景,单体LLM有局限,论文构建‘AI Office’架构,引入‘对手团队’概念,实验使准确率从60%提升到92.1%,但也有成本和局限。

深度学习自然语言处理
新闻资讯8

2026:ASI奇点之年!

马斯克断言2026是奇点之年,称AI发展如超音速海啸。从AI编程能力提升、任务时长指数级增长,到‘品味奇点’概念提出,各方面迹象显示AI正深刻变革各行业。杨静与李建忠对谈探讨了ASI奇点相关话题。

新智元
新闻资讯7

没想到 2025 年 AI 领域爆发最猛烈的居然是它

文章指出2025年AI编程领域爆发式增长,一年营收从几亿到百亿美金。因其适合编程场景,能帮助各用户群体,未来渗透率有望大幅提升。还分析了发展猛的原因,且认为其潜力大,赛道仍在加速。

MacTalk
新闻资讯8

LeCun离职前的吐槽太猛了

年底将离开Meta的LeCun在播客直言,不看好大语言模型通往AGI,也吐槽Meta封闭。他将创办开源公司AMI研究世界模型,认为其与LLM本质不同,还回顾AI学习史引出JEPA架构。

量子位