「开发者效率」共找到 2362 篇相关文章
快慢Reasoning综述!
大型语言模型在复杂推理任务中有‘无差别计算’缺陷,阻碍其在多场景应用。本文提出双层效率优化框架,梳理两类前沿技术,通过实验揭示瓶颈,为轻量化推理指明路径。
什么!ChatGPT也要刷脸实名认证了?
OpenAI和Anthropic两大AI巨头同时推进身份验证。OpenAI此前已上线年龄预测模型,对开发者和消费端用户进行身份验证;Anthropic 7月8日起更新隐私政策引入身份验证。匿名使用AI的时代或结束。
开源模型终于有了自己的 Opus 时刻
智谱深夜发布的新一代旗舰模型 GLM - 5,此前以匿名模型 Pony Alpha 被开发者热测。2026 年编程大模型风向转变,GLM - 5 参数提升,测试成绩优异,实测能完成复杂工程任务,适配国产算力平台。
前谷歌研究员发文:算力崇拜时代该结束了
前谷歌大脑研究员 Sara Hooker 发文指出,过去十年 AI 创新依赖算力,但如今持续扩展训练计算资源效率极低,收益递减。她探讨了影响算力回报率的因素,批判 Scaling Law,并提出未来创新方向。
砂之船 × 炎黄盈动:基于企业级AI平台,加速智能商业运营落地
砂之船集团作为大型奥莱运营商,2025年选择炎黄盈动企业级AI平台,从现场运营切入推进AI落地。该平台解决业务挑战,提升管理效率超60%,助力集团多方面价值提升,为行业提供示范。
刚刚,这家0产品0模型就估值854亿的公司,终于发布了首款产品!
Thinking Machines Lab推出首款产品「Tinker」,这是专为语言模型微调而生的API,让开发者摆脱底层架构束缚,用简单Python代码专注创新。它功能强大,目前免费私测,已获普林斯顿、斯坦福等团队使用。
“零人”搞医学研究:清华AI智能体从灵感到论文全程自主
清华大学自动化系索津莉课题组发布全自主AI研究框架OpenLens AI,实现医学研究全链条自动化闭环,解决医疗信息学研究效率困局,将科研周期从“月级”缩至“小时级”,还在质量控制上设新标杆。
扩散LLM推理新范式:打破生成长度限制,实现动态自适应调节
随着扩散大语言模型成为热门,但其推理时存在预设固定长度的限制。香港中文大学 MMLab 等提出 DAEDAL,赋予模型根据问题自主调整回答长度的能力,在性能和计算效率上有提升。
这个扩散LLM太快了!没有「请稍后」,实测倍速于Gemini 2.5 Flash
AI初创公司Inception Labs推出首款专为聊天定制的商业级扩散LLM——Mercury。它速度超快、效率高,能实时响应对话。实测显示其速度优于Gemini 2.5 Flash等,不过生成质量有待提升。
字节跳动2步突破,复杂文档布局解析,为啥如此惊艳?
文章指出现有文档图像解析方案有局限,介绍字节跳动的Dolphin解决方案。它采用分析 - 解析范式分两阶段解析文档,避免传统方法弊端,运行效率高,还给出训练方案、实战代码和试用链接。