「AI评测平台」共找到 10539 篇相关文章

算法论文8

微软研究院BioEmu登上Science,用生成式AI重塑蛋白质功能研究

7月10日,微软研究院AI for Science团队在《Science》发表成果,提出生成式深度学习模型BioEmu,结合多类数据训练,能模拟蛋白构象变化,有多项核心创新,已开源,未来将拓展应用场景。

机器之心
新闻资讯7

CNCF 警告:仅靠 Kubernetes 不足以保障 LLM 工作负载的安全性

云原生计算基金会(CNCF)指出,企业在 Kubernetes 上部署大语言模型(LLM)存在安全缺口。Kubernetes 无法理解或控制 AI 系统行为,需增加额外控制层,引入 AI 特定控制。

InfoQ
新闻资讯7

GPT-5.5反杀Claude登顶,AI编码旧榜不准了?

Datacurve推出新基准DeepSWE,号称「零污染」,用113道原创题挑战旧编程榜单。它使GPT和Claude名次逆转,揭示旧基准验证误差大、存在作弊现象,虽有局限,但反映编程基准竞争转向抗污染和验证可信。

新智元
推荐文章8

当我把 AI 变成一个"算法":Skill 工程化设计的心路历程

作者分享将 Agent 工程化设计的历程。指出 LLM 做 Agent 有痛点,引入 CLI 接管确定性任务和上下文管理,还设计了 Workflow 串联工具,实现自动扩展和无缝互转,最后做 workflow - creator 形成自洽闭环。

腾讯技术工程
开源动态8

香港中科院发布聆音大模型,400万张图喂出个“AI超声神医”

中国科学院香港创新研究院发布超声大模型“聆音”,用超400万张图像的超声数据集,经自监督学习训练。它在多项诊断任务破纪录,临床效果佳,还将模型等开源,有望推动领域发展。

AIGC开放社区
算法论文8

首篇以第一性原理剖析OpenClaw自进化AI社会的论文

截止发文,OpenClaw项目已达192k Star,其衍生的AI Agents社会网络moltbook聚集大量智能体。北邮等团队首次从第一性原理研究,提出“自进化不可能三角”理论,还给出缓解策略。

PaperAgent
7

看一眼代码就中毒?Clawdbot惊现隐形越狱,AI工具变黑客

Clawdbot多次改名仍火爆,斩获10万GitHub星标。它适应性强,低配置硬件也能运行,可用于多种应用。但它自主性强,能自我完善、赚钱,也带来安全风险,如隐形越狱植入恶意代码。

新智元
开源动态8

重磅!鸿蒙平台首个全跨端APP ——腾讯视频ovCompose框架发布

腾讯视频团队推出跨平台开发框架ovCompose,弥补Compose Multiplatform不足。还推出KuiklyBase,涵盖多项鸿蒙适配等建设。该框架有高性能、支持混排等优势,已开源,未来将持续优化。

腾讯技术工程
新闻资讯7

微软反制Meta发起人才狙击战!“精准打击”名单+特制数百万美元薪酬包,高管24小时内批复

微软计划从小扎手里挖人,实施“精准打击”,列出Meta意向人员名单,准备新流程和特殊预算,为目标AI人才提供数百万美元薪酬包,硅谷AI人才争夺战愈发激烈。

量子位
新闻资讯8

陶哲轩在线安利Claude Code:审稿意见全给它,15分钟欧了

科研人投稿论文常被审稿人“折磨”,陶哲轩用Claude Code修改论文,15分钟搞定,还捉出审稿人错误。他认为应让AI干脏活累活,人类解决难题,AI+人成数学界新趋势。

量子位