「π0模型」共找到 8122 篇相关文章
三分之一arXiv沦陷!CS论文65%被判「AI味」,数学仅0.7%
一份unslop研究显示,过去一年arXiv计算机科学领域65%新论文被检测器标红,但可能只是闻起来像AI。数学论文仅0.7%,或因检测器只认文字。研究有局限性,真实用AI比例可能更高。
Nature Machine Intelligence颠覆有机化学研究范式,上海交大发表化学合成大语言模型
上交大AI4S团队依托平台,联合多团队在AI for Chemistry领域获突破。相关研究发表于《Nature Machine Intelligence》,介绍白玉兰化学合成大模型Chemma,它加速有机合成全流程,在多任务表现出色,还能解决数据稀疏等问题。
DeepSeek接入智慧小浪,「评论罗伯特」爆梗进化!背后大模型全揭秘
新浪新闻推出AI辅助工具「智慧小浪」,接入DeepSeek深度思考能力,依托知微大模型,能总结资讯要点、提供延伸阅读。微博「评论罗伯特」升级,更懂用户情绪、回复有深度。此外,微博还有博主AI助手等爆款应用。
Lucide 1.0 发布,移除品牌图标,并缩减数百万个项目的包大小
Lucide 1.0 发布,它是开源图标工具包,是 Feather Icons 分支。此次移除品牌图标,缩减 lucide - react 包大小,还引入上下文提供程序等改进,社区反响有赞有弹。
10万token自然语言推理,让30B-A3B模型站上奥赛金牌线
上海人工智能实验室报告显示,30B - A3B规模的SU - 01模型不依赖外部工具,经训练在IMO、USAMO、IPhO等奥赛评测达金牌水平。研究还验证更高效科学推理系统路线,有望用于更多科学问题。
抨击 AI 炒作、曝企业需求为先,Anthropic 联创:模型提 0.01 性能就血赚,算力烧钱但值!
Anthropic 由 7 位前 OpenAI 核心成员创立,联合创始人兼总裁 Daniela Amodei 在接受采访时表示,“AI 安全”是核心优势,企业客户对安全性的高要求与之匹配。Anthropic 以“不要相信炒作”为价值观,谨慎对待支出和算法效率。
Claude两个新模型实测流出!空间推理封神,算力直接榨干了
Claude两款新模型“棉花糖”和“甜瓜”实测流出,在3D强化学习和建筑空间布局上性能强大,还能直接理解并生成复杂3D坐标和空间关系。它们对算力吞噬疯狂,引发对其身份的猜测。
Mistral的首个强推理模型:拥抱开源,推理速度快10倍
本周二,欧洲人工智能公司 Mistral AI 发布全新大语言模型 Magistral 系列,有企业版 Magistral Medium 和 24B 参数开源版 Magistral Small。它推理强、多语言表现好,速度比竞品快 10 倍,应用于主流云平台,成本有竞争力。
揭开大模型“伪遗忘”,港理工等团队:结构不变就是没忘
近年来大语言模型隐私风险受关注,机器遗忘技术应运而生。港理工等团队构建表示空间诊断工具,区分‘可逆性遗忘’与‘不可逆遗忘’,揭示遗忘现象背后表示结构变化规律,还做了相关实验并得出核心结论。
ChatGPT默认模型大升级,GPT-5.5 Instant正式上线:新增记忆来源功能
OpenAI宣布ChatGPT默认模型升级为GPT-5.5 Instant,面向所有用户开放。升级核心是准确性,在高风险领域幻觉内容减少,能力全面提升,回复更简洁。还提升了个性化能力,引入记忆来源功能。