「云小二Aivis」共找到 1466 篇相关文章
o3-pro正式推出!说声“嗨”就花了80美元,思考1+1用时16分钟
OpenAI推出推理模型o3 - pro,同时o3降价80%。官方测评o3 - pro表现佳,但价格贵、响应慢。o3‘是否降智’引争议,奥特曼发小作文探讨AI对人类社会影响,还透露公开权重模型推迟。
大模型之后,AI 开始“自己动手”了
从生成式AI到Agentic AI,互联网从“信息获取”转向“任务完成”。全球科技巨头抢滩智能体,国内腾讯云升级智能体开发平台。腾讯吴运声表示,技术与业务需求双轮驱动其发展,还分享了应对落地挑战的办法。
都在卷「让大模型多循环几遍」,这个7B模型LoopCoder v2说:多循环 1 次就够了
一项新研究表明,7B小模型LoopCoder v2在正常计算外多循环一次,就能在SWE - bench Verified基准上大幅提分。继续增加循环次数,性能反而下降。研究还算了‘收益 - 成本’账,给出选择循环次数的诊断方法。
极端天气也不怕漏检!RDA-YOLO:面向微小绝缘子缺陷检测的鲁棒动态自适应网络
文章指出传统绝缘子检测方法面临人工巡检效率低、小目标检测难等挑战,现有YOLO系列算法也有局限。为此提出RDA - YOLO网络,在YOLOv8基础上有三项创新,实验显示其精度、速度和极端天气鲁棒性表现出色。
里程碑!Artificial Analysis:Mac能跑的两款开源模型正式追上GPT-5
据Artificial Analysis报告,32B以下开源模型比肩GPT - 5。Qwen3.5 27B、Gemma 4 31B分别与GPT - 5中杯、小杯智能水平相当,虽知识全面性落后,但智能体表现和批判性推理进步大,硬件门槛低。
求码10天,我终于过上了在微信上使唤🦞的日子
腾讯鹅虾产品QClaw升级,将微信入口变为小程序,支持传文件,上线灵感广场。作者求码10天体验它,测试其在微信和电脑端操作能力,肯定便捷性,也指出执行流程不透明等问题。
Anthropic:警惕评测排行榜!差别可能只是机器的内存更大,而已
Anthropic发工程博客指出,AI编程评测排行榜上排名前列的模型分差小,而运行环境硬件配置能让分数波动6个百分点。同一模型在不同沙箱策略下分数不同,资源配置影响评测结果,排行榜分数差距或因硬件。
32岁,全球第一开源模型掌舵人,说了声bye就走了
3月2日阿里千问发布Qwen3.5小尺寸模型系列获马斯克点赞,次日林俊旸提交辞职申请。他带领千问三年成绩斐然,但开源竞争格局生变,且阿里组织调整与他理念冲突,他和团队成员选择离开。
字节悄咪咪上线了 AI 版抖音「随变」,在下什么棋?
临近春节,字节跳动 1 月初上线的「随变」App 在年轻人中流行。它类似「纯净版」AI 抖音,核心功能有 AI 形象生成等。字节借此在小体量社区验证功能,解决抖音年轻用户留存问题,也想抢占 AI 视频市场。
被OpenAI开除的天才少年:联手谷歌,围剿英伟达!
为打破英伟达算力垄断,谷歌扶持云服务商Fluidstack分发自研TPU芯片,该公司正洽谈7亿美元融资,潜在领投方是被OpenAI开除的天才研究员阿申布伦纳。谷歌与Fluidstack合作深化,不过市场对芯片租赁盈利模式存疑。