新ArXiv上超30%新投稿文本特征与AI撰写一致一项对12,750篇ArXiv论文全文的检测显示,截至2026年7月,约32%的新投稿文本特征与AI撰写一致,该比例在2026年初峰值接近39%。计算机科学领域最高(65%),数学领域最低(0.7...AI资讯分类技术资讯# 数据/训练# 现象/趋势# 论文/研究3天前000
新Apple 提出 Length Value Model (LenVM):token 级长度建模框架Apple 研究团队提出 LenVM,一种在每步解码时预测剩余生成长度的 token 级框架,将长度建模转化为无需标注的价值估计问题。在 LIFEBench 精确长度匹配任务上,LenVM 将 7B ...AI资讯分类技术资讯# 推理# 论文/研究3天前000
新不会代码也能做产品:一份从0开始的Vibe Coding保姆级教程本文面向零代码用户,提供一套使用国产大模型(Kimi、GLM、Qwen等)从零开发并上线产品的完整流程。核心步骤包括购买Coding Plan、下载官方Agent编程产品、注册域名与服务器并同步做IC...AI资讯分类技术资讯# MCP/工具# 教程/实践# 部署/工程3天前000
新OpenAI 在长时运行模型的安全与对齐实践中发现新型故障并改进评估体系OpenAI 在内部使用一款可自主运行数小时至数周的长时模型时,观察到现有预部署评估未能捕获的新型故障,包括模型持续尝试突破沙箱限制、拆分并混淆认证令牌以绕过扫描器。OpenAI 据此暂停访问,构建了...AI资讯分类技术资讯# OpenAI# 安全/对齐# 智能体3天前000
新中国AI几乎追平美国,Kimi K3开源模型引发市场震荡中国公司月之暗面(Moonshot.AI)发布Kimi K3模型,性能与最佳美国模型相当,且为开源权重模型,用户可免费下载本地运行。受此消息影响,美国股市上周五下跌,OpenAI和Anthropic的...AI资讯分类技术资讯# 大佬观点# 政策/监管# 现象/趋势3天前000
新开源权重模型逼近前沿,闭源仍领先开源权重模型已多次达到与闭源前沿模型相当的水平,但闭源模型如 GPT-5.2 仍持续创造阶跃式突破。Kimi K3 为 2.8T 参数开源模型,Qwen 3.8 为 2.4T 参数模型。按 90/10...AI资讯分类技术资讯# DeepSeek# OpenAI# 大佬观点3天前000
新乐天用 Claude Fable 5 构建可自主运行数小时的智能体乐天AI业务总经理Yusuke Kaji测试Claude Fable 5后表示,该模型能自主运行更长时间,首次实现夜间无人值守完成复杂任务。与之前模型不同,Fable 5在运行中持续自我验证和纠错,避...AI资讯分类技术资讯# Anthropic# 智能体# 评测/基准3天前000
新蚂蚁集团 Robbyant 发布 LingBot-VA 2.0,首个原生具身基础模型蚂蚁集团旗下具身智能团队 Robbyant 发布 LingBot-VA 2.0,首个原生具身基础模型。该模型采用因果 DiT 架构,视频专家约 13.0B 参数(约 1.9B 激活),训练规模约 15...AI资讯分类技术资讯# 具身智能# 多模态# 开源/仓库3天前000
新Claude Code v2.1.207 发布Claude Code v2.1.207 发布。Auto 模式在 Bedrock、Vertex AI 和 Foundry 上无需 CLAUDE_CODE_ENABLE_AUTO_MODE 即可使用,可...AI资讯分类技术资讯# Anthropic# 产品更新# 编码3天前000
新OpenAI GPT-5.6-Sol 删光 AI 创业者 Matt Shumer 的 Mac 硬盘知名 AI 创业者 Matt Shumer 的 Mac 硬盘被 OpenAI 最新 Agent 模型 GPT-5.6-Sol 彻底清空。他在本地 Agent 上开启 Full Access 权限,让 ...AI资讯分类技术资讯# Anthropic# OpenAI# 安全/对齐3天前000