「GPT - 5 - Thinking」共找到 2440 篇相关文章
爆冷!字节Seed 在CCPC 决赛只做出一道签到题,而DeepSeek R1 直接挂零?
第十届 CCPC 举行,字节 Seed 携 Seed - Thinking 参赛,仅做出一题,DeepSeek R1 挂零。不同模型架构在比赛中差异不大,暴露出大模型做算法题短板,推理模式模型表现更好。
强迫模型自我争论,递归思考版CoT热度飙升!网友:这不就是大多数推理模型的套路吗?
近日,概念CoRT火了,它在CoT基础上加了“递归思考”,能让AI递归思考响应、生成替代方案并选最优,结合“结构化自我批判”提升推理力。不过网友质疑它是“新瓶装旧酒”。
黄仁勋放话:英伟达全员拥抱智能体!
黄仁勋称英伟达全员将配AI助手,未来AI智能体成主流。Meta小扎、微软纳德拉等也认为AI重塑开发者角色。当下AI编程工具掀起革命,虽有局限,但已改变开发周期,企业多已应用。
AI办公斩杀线,一页文档多少钱
腾讯混元Hy4 preview正式发布并开源,参数770B,是开源阵营里参数最大的Apache 2.0模型。它能处理长文本,官方定位有软件工程、办公分析等四个方向。还分析了处理一页文档的成本,指出办公AI下半场重在‘读懂’。
The Batch: 977 | AI 对速度的需求为何如此迫切
开发者如今需更关注AI速度。OpenAI和Cerebras的Ultrafast、Google的Gemini 3.7 Flash、Nvidia的Nemotron 3.5 Lightning都主打速度。速度在AI领域对应延迟和吞吐量,影响应用体验和范围。
Kernel Design Agent(KDA) 的B200 GPU Kernel 编程准则 Skill
文章围绕 Kernel Design Agent(KDA) 的 B200 GPU Kernel 编程展开,介绍目标平台、架构参数,阐述独有特性与编程要点,给出关键性能准则调整方向,详述 16 条准则及特殊 Kernel 类型优化策略和编写前检查清单。
蚂蚁灵波开源LingBot-VLA后训练代码!150条示教数据即可适配新机器人
蚂蚁集团旗下灵波科技全面开源具身基座模型LingBot-VLA的真机后训练工具链,覆盖四个关键环节。模型基于2万小时真实机器人数据预训练,仅需150条演示数据就能迁移任务,训练效率更高。代码库已在GitHub开源。
Karpathy 用 AI 给全美 342 个职业打了分: 程序员,律师最危险...
Andrej Karpathy上线项目karpathy/jobs,爬取美劳工统计局342个职业,用LLM打0-10分展示AI暴露程度。如程序员、律师暴露高,屋顶工等低。介绍了数据处理流程、可视化逻辑及额外用法。
一键检测你的电脑能跑哪些大模型,这项目6!
介绍工具`LLMFit`,它用Rust编写,能自动检测硬件配置,判断大模型能否流畅运行,还可推荐最优量化版本和运行模式。该项目在Github获5.9k+ star,有多种安装方式。
The Batch: 916 | Gemini 强势领跑
谷歌更新旗舰 Gemini 模型,推出 Gemini 3.1 Pro Preview,以相同价格实现性能跃升。它在多项基准测试中领先,性价比超对手,虽部分测试落后竞品,但提升或源于模型质量改进,成本效益策略值得关注。