「个性化助手评测」共找到 1117 篇相关文章
账上仍有30亿元现金,王小川不下牌桌|甲子光年
1月13日百川智能开源新一代医疗大模型Baichuan - M3,在医疗AI评测中夺冠,超越GPT - 5.2。王小川带领百川转型AI医疗,虽面临挑战但账上有30亿现金,选择院外商业化,预计2027年考虑上市。
相机参数秒变图片!新模型打通理解生成壁垒,支持任意视角图像创作
S-Lab等机构研究员提出Puffin统一多模态模型,它能整合理解相机参数与按参数生成对应视角图片的能力。通过“用相机思考”和400万组数据训练,解决此前模型问题,还构建相关数据集和评测基准,性能出色。
AI低质代码泛滥、API经济盛行,老牌科技厂商 F5 如何应对大模型应用“后遗症”?
F5亚太区CTO Mohan Veloo指出AI编程工具带来安全、低质代码、‘黑盒子’等问题。F5调查显示企业业务AI驱动下,安全成挑战。F5推出ADSP平台应对,还发布AI Gateway、AI助手等产品。
Chain-of-Agents: OPPO推出通用智能体模型新范式,多榜单SOTA,模型代码数据全开源
OPPO个性化AI实验室团队推出智能体推理范式CoA及模型AFM,解决传统多智能体系统通信效率低等问题。AFM在近20项测试中刷新记录,降低推理成本,还介绍了架构、数据构建等,也指出待探索方向。
Coinbase CEO:全员强制 AI 编程,违者开除!
Coinbase CEO Brian Armstrong在播客透露,因部分工程师拒绝使用AI编程助手,他解雇了几人。公司为工程师买了AI工具企业许可证,他强制全员注册使用,认为AI是必选项。Stripe联合创始人对依赖AI代码存疑。
4000万样本炼出AI读心术,刷新七榜SOTA,最强「人类偏好感应器」开源
Skywork-Reward-V2全新发布,构建超高质量千万级人类偏好样本,刷新七大评测基准SOTA。8款模型覆盖6亿至80亿参数,小体积也能媲美大模型性能。团队引入多样大规模真实人类偏好数据,提升数据规模与质量。
AI辩论能力碾压人类,81.7%概率让你信服!研究登Nature子刊
《自然·人类行为》研究指出,在线辩论中,大语言模型根据对手特征个性化论点时,比人类更具说服力。实验显示,与GPT - 4辩论的参与者有81.7%更高概率认同其观点,应加强对大模型舆论操控的监管。
狂涨10.3K star!最近爆火的微信记录训练专属数字分身,支持语音克隆,绝了!
在AI大模型时代,大家想让模型更个性化。最近GitHub爆火的开源项目`WeClone`,用微信聊天记录训练专属AI打造数字分身,还能语音克隆。它全链路覆盖、支持多模型,有隐私保护等特色,操作也有介绍。
腾讯悄悄出了个插件版“Cursor”,还跟微信小程序打通了。
腾讯云发布代码助手CodeBuddy 3.0,它是插件而非IDE产品,可在多代码产品安装。其亮点是打通微信开发,能直出小程序。作者体验后用它半小时做出小程序,期待腾讯AI生态发展。
一个Skill让DeepSeek V4 Pro超越Fable 5?热门插件被锤了
前两天J-Space凭夸张测试结果刷屏,宣称一份Skill接入Agent环境,能让V4 Pro在多基准大幅提升,部分成绩超Fable 5。但社区复测结果相反,作者未公开完整评测记录,还删质疑帖,引发公开打假。