「模型能力连续体」共找到 9165 篇相关文章
对话Noitom Robotics CEO戴若犁:没有人比我更适合解决机器人的数据问题 | GAIR 2025
本文是对诺亦腾机器人CEO戴若犁的专访。他表示因机器人业务营收两年涨40倍,年初拆分成立机器人数据公司。该公司以数据为交割界面,有产品交付能力,已与六七十家头部公司合作。
Gemini 3+Nano Banana Pro+3D 生成+手势控制=?藏师傅教你炫酷展示运动成果
作者作为户外运动爱好者,用Nano Banana Pro做户外运动成果展示的图片提示词和海报效果佳,还将图片转3D模型、加手势控制,文章分享制作方法、提示词及工具使用方式。
谷歌DeepMind最新论文,刚刚登上了Nature!揭秘IMO最强数学模型
谷歌DeepMind的AlphaProof在IMO获接近金牌的银牌成绩。它结合大模型直觉、强化学习和Lean形式化证明解题,虽在速度、泛化和读题上有局限,但开启了人类数学家与AI协作新阶段。
告别微调!腾讯提出Training-Free GRPO:无需更新参数,还能保证泛化性,成为传统RL的有力替代
大型语言模型在专业领域表现不佳,传统微调方法成本高、易过拟合。腾讯优图实验室提出Training - Free GRPO,无需更新参数,通过上下文学习提升性能,成本低且泛化性好,是传统强化学习有力替代。
27 岁,市值三万亿刀
9月27日Google迎27岁生日,Alphabet市值突破三万亿美元。Gemini 2.5等模型发布显进攻态势,AI成市值增长引擎。不过,Google面临反垄断案和监管压力,同时在多领域布局AI重塑商业版图。
阿里开源 Wan2.2-Animate!统一角色动画和视频人物替换
阿里通义实验室开源 Wan - Animate,这是用于角色动画与替换的统一框架。它构建于 Wan 模型之上,支持角色动画和角色替换两项核心功能,性能超现有算法,还通过独特设计实现多种效果。
GPT-5-Codex 一手实测
OpenAI推出新编程模型GPT - 5 Codex,Every团队实测显示其表现狂野。它能动态选思考时间,可在不同开发环境无缝切换,代码审查更优。但也存在对任务挑剔、环境设置麻烦等问题。
谷歌最新「0.27B」Gemma 3开源!身板小却猛如虎,开发者直呼救命稻草
大模型时代开发者算力焦虑严重,谷歌Gemma 3系列另辟蹊径。新成员Gemma 3 270M参数规模小但性能强,如在IFEval测试表现突出,有小体积强架构、省电等亮点,适用于多场景。
微软深夜发布SambaY架构,Phi-4min加速10倍推理
微软基于Phi-4-mini版本,针对特定推理任务微调出Phi-4-mini-Flash-Reasoning 3B模型,将其扩展到200064 tokens。采用新型SambaY架构,支持64K token上下文长度,运行快10倍,有诸多优点。
赵晓卉,你老板知道你用飞书AI爆改绩效评价吗?
本文介绍飞书AI新功能,如多维表格和知识问答,让工作变简单。赵晓卉用其改绩效、写周报。多位CEO分享工作流改造成果,飞书还发布开发套件、应用成熟度模型,破圈企业众多。