架构发布」共找到 4549 篇相关文章

开源动态8

如何科学地“设计”SFT 数据?一次关于 ODA 的完整平台级验证

大模型后训练阶段,SFT数据构建常依赖‘直觉’或‘试错’。上海人工智能实验室OpenDataLab团队发布报告,基于OpenDataArena提出新范式,将数据集构建从‘随机艺术’变为‘确定性工程’,并进行平台级验证。

深度学习自然语言处理
开源动态8

微软重磅开源!22K星的 VibeVoice 再添新成员,60分钟音频 ASR 端到端统一输出!

现在的 ASR 模型处理长音频存在断章取义、说话人错乱等问题。微软开源 VibeVoice-ASR,可一次性处理 60 分钟音频,实现“三位一体”输出,补齐 VibeVoice 生态,还介绍了特点、架构、使用方法与应用场景。

开源星探
开源动态7

一夜爆火,Clawdbot是否才是真正的AI入口产品?

文章介绍近期在GitHub爆火的开源项目Clawdbot,它是运行在本地设备、有“手脚”和“记忆”的AI智能体。还分享部署方案,从产品层面分析其特点,最后提醒安全风险。

腾讯技术工程
产品应用7

Qwen3满血版上线,第一件事就是把搜索按钮干掉了。

Qwen3-max满血版发布,去掉搜索按钮,因模型能力提升无需手动控制。它具备自适应工具调用能力,能自行判断何时使用搜索等工具,思考过程结构化,跑分接近一线模型。

探索AGI
新闻资讯8

中国团队首次在Nature子刊发布医疗AI标准,未来医生MedGPT摘得全球桂冠

中国AI医疗公司“未来医生”协同专家制定CSEDB,首次提出评估医疗大模型临床能力的系统性框架,被《npj Digital Medicine》收录。在其评估下,未来医生的MedGPT在主流大模型中夺冠。

量子位
新闻资讯8

AI 会取代你的工作吗?Anthropic 用 200 万对话告诉你答案

Anthropic发布Economic Index第四期报告,分析200万次Claude对话,提出“经济原语”框架。发现AI对高学历任务加速效果更好但成功率低,还揭示Claude.ai与API差异,引入“有效AI覆盖率”等。

宝玉AI
新闻资讯8

硅谷AI战火烧进医院!终于可以告别「天书」化验单了

OpenAI和Anthropic的战火燃至医疗领域,OpenAI发布ChatGPT健康,Anthropic推出医疗健康版Claude,还打通数据壁垒,提供个性化健康解答。其还在提升模型能力,保障隐私安全,且各有应用场景。

新智元
开源动态8

把RoPE扔掉,AI更能看懂长上下文!Transformer作者团队开源大模型预训练新方法

Transformer架构核心作者之一Llion Jones团队开源新技术DroPE,可丢弃位置嵌入扩展上下文,解决RoPE长序列处理缺陷,在多模型实验中表现卓越。该团队来自Sakana AI,此前还有相关研究成果。

量子位
推荐文章8

Anthropic 最新博客:构建 AI Agent 评估体系完整指南

Anthropic 工程团队发布博客《Demystifying evals for AI agents》,揭秘内部对 AI Agent 的评估方法,涵盖评估结构、构建原因、常见 Agent 类型评估技术、评估非确定性处理、构建路线图及与其他方法配合策略等。

AGI Hunt
推荐文章8

今年最具启发的Claude Code用例:她用cc搭了8个Agent监控自己的生活

文章介绍Molly Cantillon用Claude Code搭建8个并行Agent实例监控生活,涵盖产品运营到睡眠管理等。她21岁辍学创业,其架构新颖,还提出权力关系逆转观点,最后给出使用建议与警告。

花叔