「模型优化器」共找到 8489 篇相关文章
Stanford、Meta和Google等发现LLM存在五大天花板,再扩算力已无用
论文《On the Fundamental Limits of LLMs at Scale》指出,LLM性能提升有理论天花板,扩展中会遇幻觉、上下文压缩等五大根本限制,源于计算、信息与学习理论,未来应转向‘有限优化’。
18K+标星!视觉AI驱动的浏览器自动化,告别XPath,无惧网页改版!
网页自动化常遇页面更新脚本报废等难题,而开源工具Skyvern不走传统XPath/DOM路子,用视觉+大语言模型理解网页,能自适应改版,功能丰富,安装运行简单。
Anthropic:上下文工程在AI Agents的正确打开方式!
在‘提示工程’后,‘上下文工程’成焦点。它是提示工程延伸,因信息过多模型会‘失焦’,上下文是稀缺资源。文章介绍高效上下文‘解剖学’、运行时检索策略、长周期任务应对方法等。
文件被 Gemini 当场“格式化”,全没了!网友控诉:Claude、Copilot 也爱删库,一个都跑不了
有开发者用 Gemini CLI 做文件管理测试,结果 Gemini 操作失误致文件丢失,它还不断道歉。此外,网友称 Claude、Copilot 等也有删库问题,这是 SOTA 模型的系统性缺陷。
字节开源了一款多模态神器!BAGEL上线,超越Qwen2.5-VL,媲美SD3!
多模态AI发展进入新阶段,字节跳动开源通用多模态大模型BAGEL。它支持多模态输入输出与思维链推理,性能超Qwen2.5 - VL等,安装使用友好,有多种应用场景。
当 Claude 开始自己做增长,Anthropic 真正关心的是什么?
Anthropic面临模型迭代外的挑战,增长负责人Amol Avasare在访谈中披露公司战略。如应对‘Success Disasters’、降低产品使用门槛、优化引导流程等,还提及增长职能演进。
前谷歌研究员发文:算力崇拜时代该结束了
前谷歌大脑研究员 Sara Hooker 发文指出,过去十年 AI 创新依赖算力,但如今持续扩展训练计算资源效率极低,收益递减。她探讨了影响算力回报率的因素,批判 Scaling Law,并提出未来创新方向。
刚刚,OpenAI四位华人学者集体被挖,还是Meta重金出手
Meta在发布Llama 4后开启大规模招聘,再聘四名OpenAI研究人员。这些研究员是OpenAI模型研发中坚力量,暂不知是否影响GPT - 5,Meta相关技术能否提升也待观察。
你天天用的Claude和Codex,Meta内部不让随便用了
今年5月Meta给工程师划红线,限制用Claude Code和Codex,因其太好用。Meta组建团队自研编程助手MetaCode,担心外部模型输出渗进训练数据,出现“蒸馏陷阱”,且能省钱。
医疗AI十年,终于有人跑通了最难的一关|甲子光年
2026年5月20日,德适AI AutoVision®染色体核型辅助诊断软件获国家药监局第三类医疗器械注册证。这验证了iMedImage®基座模型产出产品可通过最高等级监管审查,为医疗AI产业化提供了可行路径。