「新算法框架」共找到 5216 篇相关文章
红杉中国xbench全球首发,AI智能体真实战力揭榜!
红杉中国推出全新AI基准测试工具xbench及相关论文,采用双轨评估体系和长青评估机制,首期发布两个核心评估集并综合排名,还提出垂类评测方法论。它能追踪模型能力与实际场景价值,解决现有评估难题。
可解释性杀疯了!结合机器学习,发顶会轻轻松松!
在机器学习领域,模型可解释性愈发重要。结合XAI技术能提升模型透明度与可信度,如预测儿童饮食多样性、心血管疾病分类准确率很高。还整理9篇相关论文,解析两篇文章创新点、方法和结论。
瘦身不降智!大模型训推效率提升30%,京东大模型开发计算研究登Nature旗下期刊
京东探索研究院大模型研究登Nature旗下期刊。其提出系统与方法,经四大创新使大模型推理提效30%、训练成本降70%。成果支撑JoyBuild平台,可帮企业将通用模型转化为专业模型,加速商业化落地。
微软 Build 2025:AI 智能体时代与开放智能体网络的构建
微软 Build 2025 大会展示迈向 AI 智能体时代路径,如发布新功能助力开发者,让 AI 智能体更强大安全,支持开放智能体网络,还推出平台加速科学发现。
新型开源端到端 AI 语音模型!Voila:195ms 超低延迟引领全双工对话!
Maitrix团队发布开源AI端到端语音模型Voila,以195ms超低延迟及全双工对话受关注。它功能强大,支持多语言,有多种使用方式,适用于多个场景,架构采用模块化设计。
一个跑智能体,一个专门找漏洞:Google发布Gemini 3.8双版本
9月2日,Google发布Gemini 3.8 Flash和Gemini 3.8 Flash Cyber。前者用于编程等,已稳定上线;后者专用于发现修复漏洞,仅向特定方开放。二者共享基础能力,采用不同安全限制和部署环境。
让 AI Scientist 真正“做出材料”, 鼎犀智创完成数亿元 Pre-A 轮融资
AI新材料研发公司鼎犀智创完成数亿元Pre - A轮融资,资金用于模型及技术研发等。该公司技术路线独特,案例显示能大幅缩短研发周期,还将中试放大纳入体系,推动材料研发走向平台化。
Anthropic求锤得锤!Mythos 2被曝雪藏,Mythos 3正秘密研发
SemiAnalysis内部播客爆料,Anthropic新模型Mythos 2训练完成却被雪藏,正用其生成数据研发Mythos 3。Anthropic曾呼吁监管,如今自食其果。此外,OpenAI的Astra也因安全问题暂停部分活动。
720次攻击0成功!Claude Code默认放权,AI替你点「同意」
本周五起,Claude Code在新会话默认让AI替用户点「同意」。其开发者底气源于720次攻击0成功测试。不过业内人士对此不乐观,且测试有局限性,审批权移交AI有风险。
YC 总裁:2026,个人 AGI 已来
YC总裁Garry Tan在演讲中指出AGI已来,给出全新定义框架,强调其可成个人资产。他介绍了个人AGI存在形态、搭建步骤,还探讨其归属,鼓励大家主动构建。