低提示词」共找到 1494 篇相关文章

算法论文8

0.01%参数就能接近全量微调!数据微调极致省参方案来了 | ACL'26

瑞典隆德大学与Google DeepMind团队研究大模型微调省参方案。发现数据场景下,微调Value投影中的b(v)比b(q)或b(k)性能更好。该研究已被ACL 2026接收,集成进Hugging Face - PEFT库。

量子位
新闻资讯8

马斯克Grok 4.6重回一梯队!更价格反超Fable 5,这Cursor是真没白收购

马斯克携Grok 4.6让SpaceXAI重回大模型牌桌。它跑分超GPT - 5.6 Sol和Fable 5 Max,价格更。此次升级聚焦长程agent任务,还发布了Grok Bot智能体,后续Grok 4.7也将登场。

量子位
算法论文8

北大 & 作业帮团队提出 Text-to-SQL 新框架 Interactive-T2S,攻克宽表处理与资源对齐难题

北大与作业帮联合研发的论文提出 Interactive-T2S 框架,将 LLM 塑造成智能代理,通过多轮交互解决传统 Text-to-SQL 方法在宽表处理、资源对齐等方面的难题,已入选国际顶会 CIKM2025。

AI前线
产品应用7

突袭Cursor,Windsurf抢发自研大模型!性能比肩Claude 3.5、但成本更,网友好评:响应快、不废话

当地时间5月16日,Windsurf推出首个AI软件工程模型家族SWE - 1。此系列含三款模型,性能比肩Claude 3.5且成本更。开发者试用评价不错,但也指出存在幻觉问题。Windsurf旨在提升软件开发速度,后续将持续投入。

InfoQ
开源动态8

延迟的端到端语音模型!首次生成音频仅需53ms,比同级别模型快3-5倍!

随着语音应用场景普及,语音大模型响应慢成瓶颈。VITA团队开源端到端语音模型VITA - Audio,7B参数模型首次生成音频仅53毫秒,比同级别快3 - 5倍,完全开源,有超延迟等优势。

开源星探
推荐文章7

“烧掉94亿个OpenAI Token后,这些经验帮我们省了43%的成本!”

作者以月耗94亿OpenAI Token实战经历,分享优化成本经验,如选对模型、用提示缓存、设账单预警等,降成本43%,不过网友对此有不同看法。

AI科技大本营
新闻资讯7

Cloudflare 构建了面向 LLM 的高性能基础设施

Cloudflare发布全新基础设施,可在全球边缘网络运行大型AI大语言模型。它将模型输入处理与输出生成拆分,自研Infire推理引擎,还推出Unweight模型压缩系统,分享提示缓存优化方案。

InfoQ
推荐文章8

超棒!打造顶级智能体Claude Code的经验教训

Claude Code工程师Thariq文章受开发者盛赞,揭示打造智能体经验。提示缓存是关键,要合理排列顺序;管理动态上下文需避免破坏缓存;为智能体选适配工具,随模型进化调整行动边界。

AIGC开放社区
新闻资讯8

刚刚,Gemini 2.5 Pro升级,成编程模型新王

Google DeepMind发布Gemini 2.5 Pro (I/O edition),编程能力大幅提升,在编程排行榜超Claude 3.7 Sonnet。用户用一个提示或草图+描述就能构建应用,谷歌大佬站台,网友实测效果佳。

机器之心
新闻资讯7

盘点AI爆火以来的割韭菜骗局,我的照片都被偷拿去搞诈骗了。。。

作者作为AI行业博主,分享AI爆火以来的割韭菜骗局,包括卖盗版软件、天价提示、卖课、证书与算法课、克隆声音形象等,提醒大家擦亮双眼,避免成为下一个受害者。

开源AI项目落地