线性扩展效率」共找到 1686 篇相关文章

开源动态7

Dev Proxy v1.3.0:HAR 文件生成、LLM 使用跟踪、增强的 API 测试功能

Microsoft 365 开发团队发布 Dev Proxy v1.3.0 版,引入 HAR 文件生成、OpenAI 使用跟踪等新功能,改善调试、测试和 API 监控,还改进 OpenAPI 规范生成等,同时更新了 VS Code 工具包。

InfoQ
开源动态8

音画同步视频生成重磅开源!Character AI和耶鲁大学推出Ovi,让音、画在一个大脑里思考

Character AI和耶鲁大学团队推出开源模型OVI,它采用双骨干交叉模态融合架构,让音视频同步生成。其架构对称,用旋转位置嵌入技术对齐时间,训练策略分步进行,生成效果佳,为开源音视频生成提供新路径。

AIGC开放社区
算法论文8

Meta提出数据筛选的理论:何时“少即是多”成立?

Meta针对机器学习领域‘少即是多’悖论提出理论框架,用高维统计等方法推导测试误差缩放定律,揭示数据筛选‘相变’条件,为实践提供指导,还重新定义‘数据效率’意义。

深度学习自然语言处理
算法论文8

Thinking Machine新研究刷屏!结合RL+微调优势,小模型训练更具性价比了

Thinking Machine新研究提出On - Policy Distillation方法,结合RL与微调优势。该方法让学生模型每步由教师模型指导,用KL散度评估分歧。实验表明其训练小模型性价比高,还能解决AI“灾难性遗忘”问题。

量子位
算法论文8

拜拜了GUI!中科院团队“LLM友好”计算机使用接口来了

中科院软件所团队研究指出,现有LLM智能体成功率低、效率差的瓶颈在于GUI。其设计与LLM能力错配,团队提出声明式接口GOI,实现策略 - 机制分离,经测试性能提升显著。

量子位
算法论文7

AI人格分裂实锤!30万道送命题,撕开OpenAI、谷歌「遮羞布」

Anthropic联合Thinking Machines研究,用30万个场景和压力测试拷问OpenAI、谷歌等前沿大模型。发现模型规范有矛盾漏洞,不同模型价值优先模式不同,如Claude重道德,Gemini重情感等。

新智元
产品应用8

论文秒变PPT!西湖大学AGI Lab推出Auto-Slides,科研汇报难度骤降

西湖大学AGI Lab推出Auto - Slides,输入论文PDF可自动生成演示文稿,支持自然语言交互修改。它采用多智能体协作框架,经实验验证优势明显,有望用于学术会议等场景,助力知识传递。

量子位
产品应用7

Spring AI Alibaba实践|后台定时Agent

文章参考Langchain,探讨Agent新运行形态,Spring AI Alibaba(SAA)为开发提供框架。介绍自主运行Agent优势、适用场景,说明构建方法,还给出店铺经营分析和评价舆情分析两个实践案例代码。

阿里云开发者
产品应用8

Claude Code 推出插件功能

Anthropic宣布Claude Code支持插件系统,开发者用一条命令就能安装定制化工具集合。插件把斜杠命令等打包,可按需开关。使用简单,已有多种插件,还能自行创建和托管,插件功能或成其生态重要进化。

AGI Hunt
算法论文8

大模型“精细化”对齐,真实性提升25.8%刷新SOTA!token级精准编辑,无需训练即插即用

北航团队在EMNLP 2025提出Token - Aware Editing (TAE)方法,从token层面解决传统表征编辑技术问题,无需训练、即插即用,在多个对齐维度显著提升,如在TruthfulQA任务上真实性指标提升25.8%。

量子位