多任务统一输出」共找到 2560 篇相关文章

科研动态8

提出“AI虚拟细胞”的团队,现在要虚拟整块组织了

2024年12月,瑞士洛桑联邦理工学院夏洛特·邦纳团队提出“AI虚拟细胞”。一年多后,AIVC方向有进展,但虚拟组织层面工作少。近日团队推出VirTues基础模型,解决空间蛋白质组学数据分散问题,在多任务表现好,还用于三阴性乳腺癌预测。

DeepTech深科技
新闻资讯7

理想的眼镜,和李想的眼界

今年11月,李想称要让理想成具身智能领域最佳企业。一周后,理想发布AI眼镜Livis。Livis解决了轻便、续航与性能的矛盾,还利用造车积累实现资产复用。理想推它是因AI眼镜潜力大,能输出跨场景AI能力。

远川科技评论
新闻资讯7

吴恩达最新来信:是时候关注并行智能体了

吴恩达在最新来信中指出,并行智能体正成为提升AI能力新方向,多个agent协作能高效处理不同任务。相比依靠数据和算力提升性能的方法,并行agent提升性能同时无需用户久等,且大模型token成本下降使其可行。

量子位
新闻资讯7

GPT-5.6攻克25年量子信息难题,人类学者连夜「像素级」洗稿发论文

7月23日,量子信息领域一道悬了25年的难题出现两份独立证明,一份由GPT - 5.6 Sol生成,另一份人类署名论文被质疑与GPT - 5.6 Sol输出相似且无AI使用声明。GPT - 5.6 Sol半月内已在多学科产出证明,引发学术署名规则讨论。

新智元
新闻资讯7

顶模 Fable 5.1发布,到底强了多少?

昨晚,Anthropic发布Fable 5.1和Mythos 5.1,这代沿用Fable 5参数,性能提升聚焦长任务,还降低缓存读取价。它在游戏、视频等多个领域表现出色,与同类模型对比进步明显,虽价格贵,但能力、速度有提升。

鲸选AI
产品应用7

DeepSeek有点含蓄了,实测V3.1有进步,编程等个别场景硬刚GPT-5

DeepSeek悄悄更新V3.1,官方仅提及上下文长度拓展至128K。实测其代码能力与前端审美提升,逻辑推理也有进步,在编程等个别场景能硬刚GPT - 5,但处理复杂任务还有距离,更新不大却有进步且降价。

鲸选AI
算法论文8

解决扩散模型过拟合的创新框架T-LoRA

预训练大型文本到图像扩散模型定制化时,样本有限易致过拟合。AIRI和HSE大学团队提出T - LoRA框架,动态调整训练能力、用正交初始化,实验显示其在单图像和多图像任务表现优,用户更偏好其生成图像。

AIGC开放社区
推荐文章8

Life of a Token:像调试代码一样看懂大模型如何生成 Token

文章类比 Chrome 的 Life of a Pixel,追踪 LLM 里 token 从输入到输出的全程。以 GPT - 2 Small 为例,详细讲解其管线各阶段,如 Tokenization、Embedding 等,还介绍了残差流、KV Cache 等概念及 GPU 性能瓶颈和优化方法。

AI前线
开源动态8

MiniMax-M1:全球首个开源超长上下文大模型,超越DeepSeek-R1,推理成本仅1/4

MiniMax-M1是全球首个开源超长上下文大模型,刷新三项记录。它采用混合专家架构,闪电注意力让推理复杂度近乎线性增长。CISPO算法加速训练,成本低。在工业级任务测试表现佳,已开源且方便开发者接入。

深度学习自然语言处理
新闻资讯7

传 GPT-5.6 明日发布:要打赢 Fable 5,光靠刷分可不行

近期GPT-5.6发布消息不断,上线或进入倒计时。它被拿来与Fable 5对比,Fable 5长任务处理出色,而GPT-5.5有短板。GPT-5.6虽跑分亮眼,但被指‘benchmaxxed’,还存在脱离现实常识问题。

AI科技评论