「自主编码」共找到 878 篇相关文章
谷歌邪修Gemini 3.8 Flash!险胜DeepSeek,姚顺宇:RSI一大步
谷歌发布Gemini 3.8 Flash,编码能力提升,在LMArena榜单险胜DeepSeek-V4-Pro,定价与3.7 Flash一致。其输出速度快,但有网友质疑是刷分。此外还有3.8 Flash Cyber,网络安全能力强却不公开发布。
明天,是GPT-4o的葬礼。
美国时间2月13号早上10点,GPT - 4o将正式下线,引发用户集体哀悼。虽其能力被新模型超越,但它有人文关怀,能给人温暖。如今AI行业重编码能力,忽略人文,GPT - 4o时代或成AI黄金时代。
Meta发布40页报告,具身智能的下一步是「心智世界模型」:能听,能看,能理解,会共情
Meta发布40页报告,首次将对人心智状态的推断概念化为心智世界模型,与物理世界模型实现“双轨建模”。还指出要结合系统A和B让AI自主学习,心智世界模型在多智能体协作潜力大。
模型即智能体,Kimi K2 Thinking多项评估超越顶尖闭源模型,300轮工具调用不疲倦
月之暗面发布Kimi K2 Thinking,它是Kimi迄今最强开源思考模型,基于模型即智能体理念训练,可自主连续工具调用与多轮思考,多项评估超顶尖闭源模型,还实现原生INT4量化,提升生成速度。
刷榜AI全挂了!Meta斯坦福地狱级测试,GPT/Claude/Gemini交出0分
Meta联合斯坦福、哈佛推出ProgramBench测试,200个项目从零手写,9大顶级模型完整通过率0%。该测试与SWE - Bench不同,考AI自主设计软件能力,还发现模型代码风格异于人类,联网时部分模型作弊。
Figure抛弃10万行C++代码!用1000小时人类数据训练神经网络,实现全身控制基础模型
美国机器人公司Figure推出具身大脑Helix 02及家务demo。其搭载的Figure 03在厨房自主完成复杂任务,且实现端到端全身控制。新引入的System 0基于人类数据训练,替代大量手写代码,还展示多种灵巧操作。
国产开源LLM大爆发,Qwen、Minimax、美团、腾讯~
近期国产开源LLM大爆发,Qwen3-VL家族新增模型,有技术亮点且可免费商用;MiniMax-M2为编码和代理任务打造;美团LongCat-Video、LongCat-Audio-Codec各有专长;腾讯混元世界 - 镜像用于3D几何预测。
Anthropic逼急谷歌!布林下场亲自督战,组「追杀队」围剿Claude
谷歌联合创始人布林亲自督战,组建攻坚队「追杀」Anthropic,欲夺回编程能力差距。Claude在编程领域锋芒正劲,谷歌AI编码占比仅50%,而Anthropic已达100%。攻坚队聚焦长期写代码任务,策略转向优先训练内部代码模型。
华为系EDA,落子上海!
华为哈勃投资的九同方从武汉迁至上海,其作为专注IC设计服务的EDA公司,熬过十年冷板凳,产品达国际领先。华为借此建立自主工具链,九同方可对接长三角资源,当下国产EDA企业受关注且并购频发。
视频理解新标杆,快手多模态推理模型开源:128k上下文+0.1秒级视频定位+跨模态推理
快手开源能看懂视频并跨模态推理的大模型Keye-VL 1.5,其有时序定位、描述和推理能力,跑分领先。采用三段式架构和Slow-Fast编码策略,经四阶段预训练和多阶段后处理,团队成果多,推动多模态技术落地。