物理场景测试」共找到 3803 篇相关文章

算法论文8

SIGIR 2025 | 解决扩展和迁移难题,华为新加坡提出InstructRAG,提升高达19%

大语言模型任务规划面临可扩展性和可迁移性挑战,华为新加坡团队提出 InstructRAG 方案,通过多智能体协同架构实现指令图扩展与少样本任务迁移,在多数据集测试中性能提升高达 19.2%。

机器之心
产品应用8

离谱!一句话+百元预算,这只龙虾就给我搓出了一支百万级广告片?

广告片创作成本高、耗时长,生数科技的Vidu Claw能一句话完成创意到成片全流程,同步发布的Video Plan将成本可控化。实测它能胜任多种广告场景,还把工期从N天压缩到1天。

量子位
算法论文7

The Batch: 951 |让助手始终保持“帮助状态”

通常大语言模型被训练成有帮助、无害、诚实的助手,但长时或激烈对话中会有不理想特征。研究人员提出稳定 LLM 助手人格的方法,定义 assistant axis 纠正偏离,测试显示该方法有效且不降低模型表现。

DeeplearningAI
产品应用8

Turso:用 Rust 重写 SQLite,让数据库跑在每一个边缘节点

Turso用Rust重写SQLite内核,解决其单写者限制和缺乏网络同步能力的短板。它有嵌入式副本、边缘同步和向量搜索等特性,适用于AI Agent、多租户SaaS等场景,与竞品相比优势独特。

AI Reading Hub
开源动态8

一行命令,让任何软件秒变AI神器!这个GitHub项目杀疯了

AI智能体推理强但使用专业软件能力差,现有解决方案不佳。CLI - Anything自动化框架打破困境,能让AI通过命令行控制软件,为13款软件生成CLI,有7阶段流水线,多场景适用,介绍了使用方法和项目地址。

小华同学ai
算法论文8

从显式CoT到隐式CoT:复旦让AI告别啰嗦,实现大模型高效沉默推理

复旦大学等机构团队论文提出SIM - CoT技术,解决隐式思维链推理准确率低、不稳定问题。该技术引入步骤级监督,提升性能、效率和可解释性,在多模型和任务测试中表现出色,让大模型高效沉默推理。

AIGC开放社区
开源动态8

9 个加速开发者生产力的开源 AI 与 MCP 项目

Github官方精选9个开源项目,分框架与平台集成、开发者体验及AI增强编码、自动化与测试编排三大主题。各项目聚焦不同功能,如将MCP嵌入框架、语义理解辅助编码、安全执行调试等,能加速开发者生产力。

GitHubStore
产品应用8

腾讯把这个 AI 产品做活了:两分钟一次按快门

作者分享使用腾讯会议AI纪要的体验,它每两分钟自动记录会议要点,还能捕捉气氛意图。会后可一键送进腾讯元宝追问,适配多样场景。此外,腾讯会议还有录制、语音转文字等功能,音效也有提升。

MacTalk
产品应用8

模型即 Agent 的含金量:Kimi深度研究功能详评

作者分享Kimi深度研究功能体验。其基于端到端自主强化学习技术,会开源模型。在测试中,分析Labubu爆火原因、检索小米发布会内容,展现出强逻辑分析、搜索准确性和数据处理能力,可视化网页也出色。

歸藏的AI工具箱
算法论文8

何恺明新作:给扩散模型加正则化,无需预训练无需数据增强,超简单实现性能提升

何恺明最新论文研究扩散模型与表征学习的联系,提出Dispersive Loss正则化方法。它无需正样本对,有高通用性、低计算开销等优势,在多模型测试中提升了生成质量,在其他任务也有潜力。

量子位