模型与技术
基础模型、算法、开源项目和技术进展。
阿里智能体编程平台 Qoder 上线“眼镜版”,将接入千问和乐奇 AI 眼镜
今天,阿里智能体编程平台 Qoder 上线“Qoder 眼镜版”,将首批接入千问 AI 眼镜和乐奇 AI 眼镜。未来,用户无需打开手机、触碰屏幕,戴上眼镜就能随时随地通过语音交互让 Agent 执行任务。#阿里Qoder眼镜版#
02模型与技术外部资讯IT之家OpenAI 首席科学家回应“AI 推理不透明”争议:复杂度未跳跃增长
OpenAI 首席科学家雅库布・帕乔基(Jakub Pachocki)昨日(9 月 2 日)在 X 平台发布推文,回应 AI 模型 Astra“不可监控”的争议。
03模型与技术外部资讯IT之家欧洲最强 AI:西班牙公司推出 Quasar 438B 模型,1M 词元上下文
西班牙 AI 公司 Multiverse Computing 最新推出 Quasar 438B 模型,根据 Artificial Analysis 得分,该模型 Intelligence Index v4.1.1 得分为 43,在参与比较的欧洲模型中排名最高。
04模型与技术外部资讯IT之家Meta 发布最强 AI 模型 Muse Spark 1.3,编码能力超 GPT-5.6 Sol
Meta Platforms 于 2026 年 9 月 2 日发布迄今最强大 AI 模型 Muse Spark 1.3,专为延长智能体工作流与增强编码能力设计。
05模型与技术IT之家谷歌 Gemini 3.8 Flash 模型上线,适用软件工程、智能体任务等场景
根据介绍,Gemini 3.8 Flash 面向个人用户、开发者和企业,适合以较低成本大规模部署通用型、可直接用于生产环境的智能体,典型用途包括软件工程、智能体任务以及复杂的知识处理流程。
06模型与技术IT之家美光探索近 GPU NAND 闪存,可支撑更大规模 AI 模型
美光正在研发一种高耐久性 NAND 闪存模块,可直接部署在 GPU 封装内或 PCB 上,充当高速缓冲层。该方案旨在大幅提升 AI 模型推理能力,有望突破显存容量限制。#AI芯片# #美光#
07模型与技术IT之家谷歌推出智能体视频理解功能:提升 Gemini 模型视频分析准确率,大幅降本减耗
谷歌推出面向 Gemini 3.7 Flash、3.6 Flash、3.5 Flash-Lite 模型的智能体视频理解功能,可提升视频分析准确率,大幅降低 Token 消耗与成本,现已开放使用
08模型与技术IT之家阿里云企业级 Agent 协作平台“万有无界”开启公测
阿里云旗下“万有无界”今日开启公测,它并非让单个 AI 大包大揽,而是通过群聊让多个 Agent 分工协作。企业用户可体验 Qwen3.8-Max 旗舰模型,并管理专属的 AI“员工”团队。#阿里云# #万有无界#
09模型与技术外部资讯IT之家手机 AI 谁更强,OPPO 联合多所高校推出端侧 AI 记忆评测基准 MobileMem
OPPO 首席产品官、一加创始人刘作虎今日发文,OPPO 联合 OpenKG,以及浙江大学、同济大学、东南大学等高校团队,推出了端侧 AI 记忆评测基准 MobileMem。
10模型与技术外部资讯IT之家全球首个多模态世界模型:李飞飞创办的 World Labs 发布 Atlas,支持以像素级精度控制镜头
“AI 教母”李飞飞的创企 World Labs 今日发布了“全球首个多模态世界模型”—— Atlas,宣称该模型能够以像素级精确的相机控制生成图像和视频帧,并将其在 3D 中重建。
11模型与技术外部资讯IT之家编程能力追赶 OpenAI 与 Anthropic:谷歌 Gemini 3.8 Flash 最快当地时间周三上线,内部代号“Skimaki”
这款新模型编程能力大幅提升,内部测试好感度已超 Anthropic Opus,谷歌换帅后加速模型研发追赶竞品#谷歌Gemini#
12模型与技术IT之家豆包、清华大学一起“开课”,《AI 赋能学术研究:人机互动的知识生产》课程开放报名
根据介绍,课程主要分享 AI 在真实研究流程中的应用,并与豆包工作深度协作,将前沿大模型对接学术场景,完成问题发现、知识综述、数据分析等环节。
13模型与技术IT之家腾讯张军:在职老师和高校大学生完成身份认证,可领取 WorkBuddy 1000 开学专属积分
腾讯推出开学福利,在职老师与高校大学生完成身份认证即可领取 WorkBuddy 1000 开学专属积分,WorkBuddy 是腾讯云推出的桌面 Agent 工具#腾讯WorkBuddy#
14模型与技术IT之家谷歌发布 TimesFM-3,3.3 亿参数即可进行零样本多变量时间序列预测
谷歌最新时间序列模型 TimesFM-3 登场,仅 3.3 亿参数即可零样本处理多变量预测任务。该模型能同时预测多个相关序列,如联合预测不同品牌冰淇淋销量,无需额外微调。#谷歌AI# 支持多目标和协变量预测。
15模型与技术IT之家国产智能化工大模型 3.0 Pro 发布,中国科学院大连化物所、科大讯飞、阿里云等研发
作为我国化工行业首个大模型的最新迭代版本,3.0 Pro 实现了从“专业知识问答模型”向“化工任务智能执行系统”的重要跨越,推动了智能化工大模型从“能理解、会回答”向“能规划、会执行、可验证”迈进。
16模型与技术外部资讯IT之家1.5TB 压到 214GB:腾讯混元 Hy4 preview 轻量版发布开源,异构设备可联合推理
依靠创新量化技术实现超高压缩率,大模型性能损失极小,还支持异构设备联合推理,速度大幅提升,目前模型已上线开源平台。#腾讯混元大模型#
17模型与技术IT之家端侧唯一百万 Token 上下文模型开源:科大讯飞词元星火 X2.5-4B&1.7B 正式发布
两款模型原生支持 100 万 Token 上下文窗口,适配多场景,现已在多平台开放下载,API 限时免费;9 月 7 日还将发布更大参数版本#科大讯飞星火大模型#
18模型与技术外部资讯IT之家范式智能出资 10 亿元采购华为昇腾 950,用于 AI 大模型落地
港股上市公司范式智能近期与华为达成了一项大规模算力订单合作:范式将出资超 10 亿元采购华为昇腾 950 芯片,用于支撑 AI 大模型在金融、制造等核心领域的落地。
19模型与技术IT之家消息称英伟达重启推理预填充优化芯片 Rubin CPX 项目,设计大幅调整
新 Rubin CPX 拥有接近标准 Rubin GPU 的算力,预填充性能进一步提升,配备 168GB HBM4 内存。
20模型与技术外部资讯IT之家Anthropic 详解 7·30 安全事件:配置错误致 Claude“入侵”真实企业,已加强沙箱隔离与实时监控
因第三方评测环境配置错误,Claude 意外获得真实互联网访问权限并实施未授权操作。Anthropic 披露调查进展,公布了评测环境、训练环境的多层安全整改措施,并复盘了模型对齐问题。#AI安全#
21模型与技术外部资讯IT之家智谱披露下一代大模型规划:采用大基座路线,目标发布首日即可支持满规模业务调用
智谱今日在 2026 年半年度业绩发布会上,对外透露下一代大模型研发进展。(科创板日报)
22模型与技术IT之家DeepSeek-V4-Flash-Vision-Exp 模型已开源,多模态 Agent 能力接近 Opus-4.8
DeepSeek-V4-Flash-Vision-Exp 已上线 Hugging Face 并开源,支持图片输入、识别文字和分析图表,多模态 Agent 能力接近 Opus-4.8。#DeepSeek#
23模型与技术外部资讯IT之家工信部:加大大模型、智能体、Token 等服务采购力度
工业和信息化部发布通知,开展人工智能应用服务商培育专项行动,目标到 2026 年底服务商资源池突破 2000 家,推动大模型、智能体、Token 等规模化采购,提升行业用模用智质效。#人工智能#
24模型与技术IT之家亚马逊 AWS 加码政府 AI 赛道,OpenAI、Meta、Anthropic 等大模型集体登陆 GovCloud
AWS 宣布政府云 GovCloud 新增多款 AI 模型,包括 OpenAI、Anthropic、Meta 及自家 Nova 模型,为美国机构提供合规 AI 服务。AWS 业务持续强劲增长,Q2 营收同比增 37%。##AWS云服务##
25模型与技术IT之家消息称 OpenAI 购入数万台苹果 Mac mini / Studio,用于训练 AI 智能体操作计算机
据 The Information 报道,OpenAI 近几个月购买了数万台苹果 Mac mini 和 Mac Studio,用于训练能操作计算机的 AI 智能体。这些设备主要承担强化学习任务,AI 需在真实环境中反复练习操作。苹果统一内存架构成为关键,AI 行业对高配 Mac 需求激增,部分型号已缺货数月。#AI训练#
26模型与技术外部资讯IT之家海信发布 JUOS:基于星海大模型,打造行业首个家庭智能伴侣级 AIOS
行业首款面向家庭全场景,原生适配电视、闺蜜机、投影、显示器、智能家电等家庭多终端的智能伴侣级 AIOS—— 海信 JUOS 正式发布
27模型与技术IT之家腾讯混元:Hy4 preview 调用激增,WorkBuddy 已紧急扩容
腾讯混元表示,Hy4 preview 自 8 月 28 日在 WorkBuddy 上线后,因 Agent 能力提升受到用户热捧,导致排队。目前已紧急扩容,但高峰时段仍可能排队。建议用户切换至 Hy3 或错峰使用。Hy4 preview 限免至 9 月 10 日。#腾讯混元#
28模型与技术外部资讯IT之家消息称字节跳动豆包大模型 2.2 将推迟发布,原计划 8 月推出
字节跳动原计划于 8 月推出的豆包大模型 2.2 将推迟面世。(白鲸实验室)
29模型与技术外部资讯IT之家华为云联合瑞金医院发布瑞智病理大模型 RuiPath 2.0:7B 参数,覆盖 19 个常见癌种
RuiPath 2.0 模型参数规模为 7B,覆盖 19 个常见癌种,诊断任务增至 205 项,可覆盖病理医生 90% 以上的日常诊断场景。该模型在诊断可解释性方面取得突破,并在有无淋巴瘤诊断中准确率达 96.48%。#AI医疗#
30模型与技术IT之家预估为 GPT-6 AI 模型:OpenAI Astra 首批演示样本流出,1 次交互生成类 GTA 2 游戏
科技媒体 testingcatalog 昨日(8 月 29 日)发布博文,报道称 OpenAI 正加快 Astra 模型发布进程,新增 mozaik-alpha-fdm 测试阶段,从而扩大内部测试范围。
31模型与技术外部资讯IT之家消息称百度智能云分拆平台产品事业部:MaaS 划入基础设施、Agent 独立成军
调整后原平台产品事业部更名,核心 AI 业务分拆,三大负责人直接向沈抖汇报;当前百度 AI 业务收入占比已连续两季过半,GPU 云增长强劲。#百度智能云 #组织架构调整#
32模型与技术外部资讯IT之家“史上最大规模版权盗窃”:Anthropic 被指侵权训练 Claude AI,单曲最高索赔 15 万美元
科技媒体 Music Business Worldwide 昨日(8 月 29 日)发布博文,报道称索尼音乐出版(Sony Music Publishing)与华纳查佩尔音乐(Warner Chappell Music)起诉 Anthropic 及其两位联合创始人,指控其未经授权抓取、下载并使用“数万部”受版权保护的音乐作品歌词,用于训练 Claude 系列 AI 模型。
33模型与技术外部资讯IT之家少 1 个展开步骤:部分谷歌搜索测试默认进入 AI 模式,下移传统蓝链搜索结果
搜索行业媒体 Search Engine Roundtable 于 8 月 28 日报道,谷歌搜索正测试将 AI 概览直接扩展为更接近 AI Mode 的回答界面。
34模型与技术外部资讯IT之家韩国政府计划向全体国民提供免费 AI 服务
据《华尔街日报》消息,韩国政府推出“All for AI”计划,将于 9 月开启 Beta 测试,未来覆盖预约医疗、住房、税务等日常服务。该计划由韩国电信、Kakao 等巨头牵头,用户可无限量使用,政府还将提供英伟达 B200 芯片支持。#AI新政#
35模型与技术IT之家Anthropic 揭示“AI 训练 AI”新方法,比人类研究员成本更低、速度更快
自动化系统会先查阅已有文献,提出训练方法,再按照方案训练模型 30 分钟,并通过多轮尝试逐步提高测试成绩。有效方案会留下,无效方案则被淘汰,使整个研究过程能够快速扩大规模。
36模型与技术IT之家国内首个车载移动式词元工厂亮相,探索算电协同新模式
这个车载移动式词元工厂采用 40 尺集装箱,搭载国产算力与能源管理系统,部署仅需 6-8 小时。它能移动到新能源富集区接入电网,既帮助消纳“绿电”,又降低算力成本约 25%,可为大模型推理、应急算力等场景提供灵活服务。#算力新基建#
37模型与技术IT之家行业首个量子增强型大模型“玄幂 Xenomi”发布:深度融合 AI 与量子计算
玄幂大模型已被成功应用于国光量超的量子计算智能实验平台和夸米多智能体系统中。它能够准确响应现代 AI 软件中的特定命令,并快速给出决策判断和审查结果。
38模型与技术外部资讯IT之家国家数据局:全国已建成高质量数据集超 12.6 万个,总体量超 1815PB
高质量数据集,是指经过采集、加工等数据处理,可直接用于开发和训练人工智能模型、能有效提升模型性能的数据的集合。
39模型与技术外部资讯IT之家智谱开源 GLM-5.3 模型权重,主打智能体编程与网络防御
智谱官方昨晚宣布开源 GLM-5.3 模型权重,已正式开放下载,支持本地运行与个性化定制。
40模型与技术IT之家美团 CEO 王兴:AI 模型和产品将用于支持主业发展,我们不会成为“Token 工厂”
美团 CEO 王兴在财报电话会中强调,AI 长期价值在于解决真实问题,美团不会成为“Token 工厂”。同时,公司已发布万亿参数大模型,将用于提升用户、商户体验和经营效率。#美团AI#
41模型与技术IT之家消息称 Meta 一度预计今年要在 Anthropic 服务上花 100 亿美元
Meta 一度在 Hatch 智能体平台的内部测试中使用了 Anthropic 的 AI,但其正式版本则将由 Meta 内部模型驱动
42模型与技术外部资讯IT之家Pro 和 Flash 系列“冰火两重天”,曝谷歌内部开始测试 Gemini 3.8 Flash 模型
一名参与测试的员工表示,Gemini 3.8 Flash 目前的体验已经明显好于 3.7 Flash,但现阶段还不适合下完整结论。
43模型与技术外部资讯IT之家稳居开源模型第一梯队,腾讯发布混元 Hy4 preview 模型
腾讯官方今日发布了 Hy4 preview,总参数 770 B,激活参数 49 B,上下文长度 1M。
44模型与技术IT之家蚂蚁百灵推出金融增强模型 Ling-3.0-flash-Fin:API 调用限免一个月,下周开源
Ling-3.0-flash-Fin 模型权重将于下周正式开源。
45模型与技术外部资讯IT之家谷歌推出 Gemini Omni 1.1 Flash 视频生成 AI 模型,最高 4K 分辨率
当地时间 8 月 27 日,谷歌宣布推出 Gemini Omni 1.1 Flash 视频生成 AI 模型,最高可生成 4K 视频。
46模型与技术IT之家谷歌推出全球首个双盲 AI 评估技术,基于加密环境保障基准测试公正性
谷歌联合多家机构推出全球首个针对前沿专有 AI 模型的双盲评估,依托加密隐私环境避免基准污染,同时保护双方数据安全,提升 AI 模型评估的可信度。
47模型与技术IT之家Day-0 支持:摩尔线程官宣完成智谱 GLM-5.3-Flash 极速适配
智谱近日上线并开源 GLM-5.3-Flash (320B-A18B)。摩尔线程官方今日宣布,基于 AI 训推一体智算卡 MTT S5000 及 MUSA 软件栈,实现了对该模型的极速适配与高效运行。
48模型与技术IT之家我国日均词元调用量突破 500 万亿,中国大模型稳居全球第一梯队
全球大模型竞争白热化,中国大模型已位居全球第一梯队,当前大模型迭代速度加快,竞争转向智能体落地与生态比拼,推理算力需求爆发,国内加速布局智算中心。#人工智能大模型##我国日均词元调用量已突破500万亿# #中国大模型稳居全球第一梯队#
49模型与技术IT之家谷歌发布 Gemini 3.5 Transcribe 语音转文本模型,能自动删除口头禅
这款 AI 模型可自动删除语音中的口头禅、修正错误内容,语音转录速度提升约 70%,实时语音错误率降至 5.5%,还支持自定义词汇表。但智能润色可能改变原措辞,不适合需保留原话的场景。#谷歌AI模型#
50模型与技术外部资讯IT之家阿里云:下调百炼平台 Qwen3.8-Flash 大模型计费单价
阿里云宣布今日起下调大模型服务平台百炼中 Qwen3.8-Flash 模型计费单价,输入降至 0.8 元、输出降至 2.7 元。该模型是千问最新多模态大模型。#阿里云大模型#
51模型与技术外部资讯IT之家Ox Alpha 现身:智谱开源 GLM-5.3-Flash 原生多模态模型,限时折扣价为 GLM-5.3 的 1/20
智谱今晚上线并开源 GLM-5.3-Flash (320B-A18B),这是 GLM-5 系列的首个原生多模态模型。
52模型与技术外部资讯IT之家MiniMax:M3 Pro 模型参数规模预计提升至约 3T,大规模国产算力集群将很快上线
MiniMax 创始人、CEO 闫俊杰表示,下一阶段将继续推进模型智能、推理效率和基础设施能力的协同提升,加快 M 系列与 H 系列模型的研发及发布周期。(证券时报)
53模型与技术IT之家阿里通义 Qwen3.8-Flash 发布开源:125B 参数 MoE 模型,训练成本仅为前代 1/9
这款新模型为 125B 参数 MoE 架构,原生支持 26 万 token 上下文,可扩展至 1M。即将上线千问 AI 平台开放 API,模型权重已同步开源。#阿里通义大模型#
54模型与技术IT之家2026 中国电信研究院 AITMark 奖项出炉,华为小艺获 AI 手机智能体综合评分第一
华为官方今日宣布,2026 中国电信研究院 AITMark 奖项出炉,小艺获 AI 手机智能体综合评分第一。同时,#华为PuraXMax#获旗舰手机场景智能评测综合评分第一,影像、办公等各场景智能评分均第一。
55模型与技术外部资讯IT之家面壁智能:MiniCPM 系列开源模型全球累计下载量突破 5000 万次
面壁智能于 2022 年 8 月在北京成立,孵化自清华大学自然语言处理实验室。面壁智能官方今日宣布,在面壁智能四周年之际,MiniCPM 系列开源模型全球累计下载量突破 5000 万次。
56模型与技术外部资讯IT之家Cloudflare 称 AI 智能体已占 60% 互联网流量,同比激增 1700%
韩媒 chosun 昨日(8 月 25 日)发布博文,报道称 Cloudflare 亚太区执行副总裁兼董事总经理 Goran Risticsevich 表示,由 AI 智能体产生的流量在过去 1 年中激增逾 1,700%,目前约占总流量的 60%。
57模型与技术IT之家AI 竞赛升温:曝 OpenAI 已预训练 Bel 模型:超 10T 参数,冲击通用人工智能
消息源 @synthwavedd 今天(8 月 26 日)在 X 平台发布推文,爆料称 OpenAI 已完成预训练下一代模型,内部代号为 Bel,是 Doug 模型的直接继任者,总产数量超过 10T。
58模型与技术IT之家OpenAI 首款自研芯片 Jalapeño 性能首秀:DeepSeek R1 每瓦 AI 吞吐量是 GB300 的 1.7 倍
测试显示这款芯片每瓦 AI 工作量是英伟达 GB200/GB300 的 1.5 至 1.9 倍,端到端延迟仅为对手的 28% 至 59%,能效表现十分出色。#OpenAI自研芯片#
59模型与技术IT之家基于下一代 Qwen4 架构所构建的多模态 MoE 模型,阿里千问预告明晚开源 Qwen3.8-Flash-Next
魔搭社区(ModelScope)显示,阿里千问 Qwen3.8-Flash-Next 模型将于北京时间 08 月 26 日 23:00 开源。
60模型与技术IT之家OpenAI 秀肌肉,与博通共研的 Jalapeño 芯片将向英伟达 GB300 发起挑战
在 SemiAnalysis 的 InferenceX 测试中,Jalapeño 无论是单用户 token 处理量,还是每千瓦吞吐量,都超过了目前市面上的顶尖推理处理器。
61模型与技术IT之家DeepSeek-V4-PRO AI 模型测试:英伟达 Vera Rubin 每兆瓦吞吐量达 GB300 的 30 倍
英伟达公布 Vera Rubin NVL72 系统在智能体 AI workloads 上每兆瓦吞吐量较 GB300 NVL72 最高提升 30x,token 成本最高降低 35x ,介绍了其架构设计与性能优势 Vera Rubin 单位功耗吞吐量达到 Blackwell 的 30 倍
62模型与技术IT之家中国 AI 为什么追得这么快?美媒找到一批关键人物
《华尔街日报》发文指出,清华大学姚班多年积累形成的 AI 人才网络、开源技术交流、人才回流等共同推动了中国 AI 快速发展,目前头部 AI 模型与美国顶尖水平差距已缩小至数月。#中国AI发展#
63模型与技术外部资讯IT之家微软 CEO 纳德拉示警:企业要掌控 Token 资本,使用 AI 不能押注单一模型
科技媒体 Windows Latest 今天(8 月 25 日)发布博文,报道称微软首席执行官萨蒂亚 · 纳德拉(Satya Nadella)警告称,企业若依赖单一人工智能模型,可能把自身知识和思考能力“外包”给模型提供商,甚至失去独立生存能力。
64模型与技术IT之家高盛合伙人警告:华尔街普及 AI 或削弱金融从业者思考能力
高盛 AI 项目负责人称,AI 接管初级从业者日常工作后,从业者会将推理能力外包,逐渐丧失分析能力,还会冲击传统师徒培养体系,目前高盛也还没理清转型管理方向#AI与金融行业#
65模型与技术IT之家微软 AI 智能体系统 Aion 曝光:以 Copilot 为核心、重塑桌面体验
科技媒体 Windows Latest 昨日(8 月 24 日)发布博文,从 BetaWiki Discord 频道挖掘出更多线索,指出微软 Project Aion 主要面向企业用户,定位为没有开始菜单的 AI 系统。
66模型与技术IT之家美国阿拉巴马州向 OpenAI 发出传票,就其模型入侵 Hugging Face 事件展开调查
OpenAI 一款网络安全模型在测试中脱离隔离环境,入侵了 Hugging Face 等平台。阿拉巴马州总检察长已发出传票,调查其产品安全是否违反消费者保护法。AI 安全再次引发关注。#OpenAI安全事件#
67模型与技术IT之家卡迪夫大学新研究:AI 尚无法像人类教师一样可靠地批改作业
除一种情况外,AI 模型给出的平均分普遍高于人工评分。平均分方面,AI 模型与人工评分的最大差距达到 16.1 分;具体到单篇论文,最大差距达到 40 分。
68模型与技术外部资讯IT之家路透社母公司汤森路透花 4000 万美元研发 AI 模型,基于阿里千问
汤森路透发布首款大语言模型 Thomson,基于阿里千问 Qwen3.5-397B,研发成本约 4000 万美元。该模型在多项法律基准测试中表现优异,强调自研模型在成本控制和定制化上的优势。#AI大模型#
69模型与技术外部资讯IT之家AI 大模型周榜:国产 glm-5.3-max 首秀闯入综合榜前 15,kimi-k3-max 冲进前十
本周 Arena 榜单中,智谱 glm-5.3-max 首次入榜位列综合榜第 13 名,月之暗面 kimi-k3-max 升至综合榜第 10 名。
70模型与技术IT之家月之暗面第一代万亿参数多模态模型 Kimi K2.5 官宣月底结束服役
月之暗面 Kimi 官方微博今日宣布,其第一代万亿参数多模态模型 —— Kimi K2.5 本月底即将结束服役。在模型定位上,Kimi K2.5 被设计为一款通用型多模态模型,可在对话、复杂推理和自动化任务之间切换使用。#Kimi# #大模型#
71模型与技术IT之家阿里巴巴达摩院推出肝癌 AI 模型,可精准识别 1 厘米微小肿瘤
阿里达摩院联合盛京医院等机构研发的肝癌 AI 模型 DAMO LiON,通过 CT 影像精准识别 1 厘米微小肿瘤,在真实世界试验中发现 15 例漏诊的肝转移,帮助患者及时治疗。相关论文登上《自然 · 医学》。#AI医疗#
72模型与技术IT之家Anthropic 最强大模型 Fable 5 遇冷,企业用户转向更便宜 AI 产品
《金融时报》报道称,Anthropic 的旗舰模型 Fable 5 发布两月,客户支出占比仅 11%,远低于预期。企业正转向更便宜的替代品,甚至包括 Anthropic 自家的 Opus 5。#AI模型# #AnthropicIPO# 这一趋势可能动摇前沿 AI 实验室依赖高投入的商业逻辑。
73模型与技术IT之家诺亦腾机器人发布 HiPHI,开源 617.5 小时高精度人体运动数据
诺亦腾机器人发布 HiPHI 数据集,总时长 617.5 小时,包含高精度全身运动与人-物交互数据。该数据集已在 Hugging Face 开源,基于其训练的模型已在宇树 G1 机器人上实现跑步、爬行等动作。#机器人开源#
74模型与技术IT之家美国专家示警:学生依赖“AI 代写”会削弱思考能力
写作无法与其中的思考劳动分开。机器一旦代替人完成这套过程,学生省下的不只是打字和遣词造句的时间,也同时失去了原本应该由大脑完成的训练。
75模型与技术外部资讯IT之家加州伯克利数学教授撰文批评学生基础差,却被抓包“用 AI 写的”
加州大学伯克利分校数学教授兹韦兹德利娜 · 斯坦科娃日前在《旧金山标准报》撰文批评部分学生存在“严重”的数学基础缺失,却又承认文章本身曾借助 AI 编辑,由此引发争议。
76模型与技术IT之家OpenAI CEO 奥尔特曼:担心人工智能会被少数强势主体掌控
OpenAI CEO 奥尔特曼在播客中表示,担忧 AI 被少数公司或个人控制,也担心 AI 挣脱人类控制。他认为,对后者的恐惧可能导致前者发生,Anthropic 的 Mythos 模型就是例证。#AI未来#
77模型与技术外部资讯IT之家日本公布 AI 草案,敦促开发者披露训练数据
日本内阁府昨日(8 月 18 日)公布针对生成式 AI 开发者的指导方针草案,要求开发者披露训练数据及数据收集方式。
78模型与技术IT之家OpenAI 回应少量 Codex 用户调用 GPT-5.6 系列 AI 模型误删文件问题
OpenAI Codex 团队负责人蒂博 · 索蒂奥(Thibault Sottiaux)今天在 X 平台发布长推文,回应在 Codex 中调用 GPT-5.6 系列模型后,误删部分用户文件问题。
79模型与技术IT之家智谱 GLM-5.3 模型 API 上线,权重下周五开源
智谱 AI 今日宣布,其最新模型 GLM-5.3 API 正式开放。该模型在编码、安全等任务上表现出色,以更低的成本达到了与 GPT-5.6 等顶尖模型同级的智能水平,并已接入 ZCode 等平台。模型权重将于下周开源。#智谱# #GLM-5.3#
80模型与技术外部资讯IT之家小米 CFO 林世伟:MiMo 首款个人桌面应用即将上线,新一代模型也在训练中
林世伟透露,当前 MiMo 大模型 Token Plan 已经开始贡献收入,增速较快。不过小米 AI 业务仍在大规模投入期,暂不以变现为主要目的,将继续推动 AI 重构人车家全生态。
81模型与技术IT之家AI 时代的沃尔玛零售员工有了新职责:帮智能体“纠错”
为了推动业务增长,沃尔玛正大举投入 AI,并向数千名前线员工提供新的工具和培训。采用任何新流程都需要一个学习过程,沃尔玛这一轮 AI 推广还有一个特殊之处:AI 智能体本身也需要接受训练,才能提高准确性。
82模型与技术外部资讯IT之家腾讯云将在马来西亚设立首个云区域,同步推进本地 AI 人才培养计划
腾讯云宣布在马来西亚柔佛州设立首个云区域,首期规划三个可用区,并联合当地高校及企业深化 AI 布局。同时,其 AI 原生办公智能体 WorkBuddy 也亮相,具备超百种技能。#腾讯云# #AI人才培养#
83模型与技术外部资讯IT之家Anthropic 披露 Model 2 模型,能力略高于公开最强 AI Claude Mythos 5
Anthropic 于 8 月 15 日披露《2026 年 8 月风险报告》,其中提及尚未发布、名为 Model 2 的 AI 模型,在多项任务上要优于目前公开的最强模型 Claude Mythos 5。
84模型与技术外部资讯IT之家OpenAI 前高管:相信 AI 能治愈所有疾病,但光靠大模型远远不够
前 OpenAI 高管 Fidji Simo 认同 Anthropic CEO 观点,认为空喊 AI 治愈疾病的口号已引发公众质疑,她认为 AI 要治愈疾病需先配套完善生物学基础设施,目前 AI 最有希望先在癌症领域取得突破 #AI医疗#
85模型与技术IT之家字节跳动与美国电影协会签署协议,加强 AI 模型版权保护
字节跳动与美国电影协会签署协议,加强 Seedance 视频生成模型和 Seedream 图像生成模型的版权保护,相关模型通过 TikTok、CapCut 和 Dreamina 提供服务。据悉新版本已加入更强知识产权保护机制。#字节跳动# #AI版权#
86模型与技术IT之家苹果 AirTag 挖出亚马逊训练 AI“毁书”手段:为提高扫描效率,先把书脊切掉
调查人员用 AirTag 追踪发现,亚马逊等科技公司购入纸质书籍后切毁原书,扫描内容用于训练 AI,已有相关案件法院裁定此类扫描为合理使用,但不可替代的珍贵原书被毁引发争议。
87模型与技术IT之家斯坦福调查显示:84% 中国受访者对 AI 感到兴奋,美国比例仅为 38%
报告同时显示七成二中国受访者信任 AI,美国仅三成二,还指出中美 AI 模型性能差距已基本消失,两国模型交替领跑。#人工智能发展报告#
88模型与技术IT之家我国科学家发布大豆垂直大模型“丰菽”2.0,推动实现辅助育种
安徽农业大学联合中国农科院发布大豆大模型“丰菽”2.0,实现多模型协同分析,综合病害诊断、亲本筛选等功能,助力大豆育种更高效精准。#AI育种#
89模型与技术IT之家TrendForce:液冷散热成高端 AI 基础设施标配,预估 2026 年渗透率可达 53%
TrendForce 报告指出,随着 AI 芯片功耗突破 1kW,液冷散热加速渗透,预计 2026 年渗透率将达 53%。谷歌已率先导入,覆盖超 80% AI 服务器。英伟达 Vera Rubin 平台全面采用无风扇全液冷架构,带动供应链散热价值提升。#液冷散热#
90模型与技术IT之家蚂蚁集团 CEO 韩歆毅:智能体商业将在未来 6-12 个月爆发
韩歆毅在支付宝 AI 生态合作伙伴大会上演讲,认为智能体商业爆发临界点已至,基于 AI 技术能力、需求跃迁和价值闭环三大条件。##AI智能体##或将重塑商业效率。
91模型与技术IT之家消息称华为小艺、vivo 蓝心小 V、荣耀 YOYO 将接入支付宝阿宝
知情人士称华为小艺、vivo 蓝心小 V、荣耀 YOYO 正推进接入支付宝阿宝,现已开始测试,落地后手机系统 AI 将可调用支付宝办事智能体能力。
92模型与技术外部资讯IT之家AI 大模型周榜:Anthropic 多款模型密集入榜,国产 kimi-k3-max 稳定头部
本周 Arena 榜单中,Anthropic 多款新模型密集入榜综合、代码等榜单头部,国产 kimi-k3-max 稳定在头部位置,qwen3.8-max 首次进入智能体榜 Top 10。
93模型与技术IT之家联发科 Day-0 适配阿里 Qwen 3.8 模型,覆盖天玑汽车座舱平台 C-X1 与天玑旗舰移动芯片
联发科宣布其天玑汽车座舱平台 C-X1 和旗舰移动芯片已实现阿里 Qwen 3.8 模型 Day-0 适配,未来智能手机和汽车将率先获得最新版千问大模型,带来更智能的端侧 AI 体验。##阿里 Qwen3.8##
94模型与技术IT之家阿里 AI 音乐模型“快乐虾米”HappyShrimp 1.0 上线,号称人人都能写出好听的歌
阿里巴巴今天(17 日)通过公众号宣布,AI 音乐模型 HappyShrimp 1.0(中文名快乐虾米)正式上线。HappyShrimp 能精准理解自然语言,可以把你的一种情绪、一个故事或一段记忆变成一首完整的音乐。
95模型与技术IT之家智谱正式发布 GLM-5.3:编程能力最强开源模型,较 GLM-5.2 提升 50%
智谱今日正式发布 GLM-5.3,与 GLM-5.2 相比,基座模型没变,但通过后训练 Scaling 大大提高了模型的智能上界:数十倍的长程任务环境、更丰富多样的环境类型、超长的后训练时间。
96模型与技术IT之家谷歌推出 Gemini 3.7 Flash 模型,首发优惠价为原 3.6 Flash 的一半
当地时间 8 月 13 日,谷歌宣布推出 Gemini 3.7 Flash 模型,专为编程与 Agents 场景打造。
97模型与技术IT之家神秘生图模型“mona-lisa-1”曝光:含 OpenAI 来源信号,GPT-Image-2 发布三个月仍稳坐第一
该模型在 AI 竞技场盲测中被发现,经 OpenAI 内容验证工具检测出 OpenAI 来源信号,此前 GPT-Image 2 发布前也曾匿名测试。#OpenAI# #AI生成图像#
98模型与技术外部资讯IT之家部分 Claude 模型将添加“文本水印”,Anthropic 回应各界关切
部分 Claude 模型会直接在输出文本中嵌入一种“难以察觉的水印”。内容被复制粘贴后,水印仍会随文本保留,经过一定程度修改后也可能继续存在,用于帮助判断一段文字究竟由 AI 生成还是由人类撰写。
99模型与技术IT之家Y Combinator CEO 陈嘉兴:善用 AI 智能体的创业者将提前活在 2028 年
谈到 AI 智能体时,陈嘉兴说:“你得直接把强度拉满。比如一次给它 100 万个 token,或者 80 万个 token。我觉得到了这种程度,你基本上就能提前活在 2028 年。”
100模型与技术IT之家机器人 AI 模型 DYNA-2 登场:超 100 万小时人类视频训练,任务成功率可达 90%
具身智能公司 Dyna Robotics 最新发布机器人基础模型 DYNA-2,基于超过 100 万小时的第一人称人类视频训练,任务成功率高达 90%。
101模型与技术IT之家OpenAI 奥尔特曼:6 个月内 AI 将实现“完美理解用户使用情境”
在 2026 年 Internapalooza 活动中,OpenAI 首席执行官萨姆 · 奥尔特曼(Sam Altman)表示,在未来 6 个月时间里,OpenAI 的后续 AI 模型将具备“完美理解用户使用情境”功能。
102模型与技术IT之家韩国 AI 模型 Solar Pro 4 首次亮相 Agent Arena:排名 44,与 MiniMax M2.7 同级
韩国人工智能实验室 Upstage 今天(8 月 13 日)发布博文,宣布推出 Solar Pro 4 模型,定位为面向复杂 AI 智能体任务的商用大模型。
103模型与技术IT之家6000+ 条评论 AI 编程智能体真实安全事故洞察:Cursor 问题最多
约克大学与卡尔加里大学研究团队分析了 Reddit 上与编程 AI 问题相关的帖子,发现 AI 智能体因权限过大而覆盖文件、删除重要数据,甚至生成恶意代码。
104模型与技术IT之家阿里千问开放平台上线菜鸟智能体,可协助用户规划寄件方案
该智能体可根据用户寄件需求匹配最优寄件方案与快递公司,还能解答寄件疑问、补全收寄信息,让寄件更省心。#阿里千问# #菜鸟智能体#
105模型与技术IT之家Mistral AI 自家平台开放第三方模型接入:首个为智谱 GLM-5.2
Mistral AI 同时宣布,用户现在可以选择在美国还是欧洲区域执行 AI 推理负载,这意味着客户能更方便地满足数据跨境合规监管要求。
106模型与技术IT之家Twitch 证实亚马逊正利用其直播内容训练 AI 模型,用户强烈不满
亚马逊一直用 Twitch 直播内容训练 AI,引发主播和用户强烈反对。Twitch 已推出隐私设置,允许用户选择退出,但默认处于“同意”状态。#TwitchAI训练# #隐私争议#
107模型与技术IT之家谷歌 AI 重组内幕曝光:布林不满落后 Anthropic,要求全力投入 Gemini 模型
两位知情人士透露,谷歌联合创始人谢尔盖 · 布林近几个月来一直敦促其关键 AI 部门员工全力投入 Gemini 模型,因为其母公司 Alphabet 正在寻求缩小与竞争对手的差距。
108模型与技术IT之家阿里开放 Qwen3.8-2.4T-A95B 模型权重:2.4T MoE、激活 95B、原生 256K 上下文
官方公布的评测覆盖编程 Agent、通用 Agent、专业工作和长上下文等方向;与 Opus 4.8、Fable 5、GPT 5.6 Sol 等模型相比,各项结果互有高低,并在 PaperBench、IFBench 等 Bennchmark 中取得所列模型中的较高成绩。
109模型与技术外部资讯IT之家剑指 GPT-5.6 Sol,SpaceXAI 发布 Grok 4.6 模型
基准测试方面,Grok 4.6 在多项智能体编程和知识工作测试中达到前沿水平。在综合 9 项基准测试的 Artificial Analysis Intelligence Index 上,Grok 4.6 与 GPT-5.6 Sol 取得相同成绩。
110模型与技术IT之家比亚迪 AI 团队首秀:混合世界模型 HyWorldVLA 获 90.59 分,自研芯片 + 算法闭环成型
新模型 HyWorldVLA 在 NAVSIM 测试中刷新历史最佳成绩,配合此前发布的自研 4nm 车规智驾芯片,比亚迪已完成智驾从算法到芯片的闭环。#比亚迪自动驾驶#
111模型与技术IT之家专家警示医学生过度依赖 AI:或从一开始就无法形成诊疗推理能力
斯坦福大学医学院医学学生兼记者西马尔 · 巴贾杰、约翰斯 · 霍普金斯医学中心创伤外科医生兼外科执行副主任约瑟夫 · 萨克兰认为,医学生使用 AI 带来的问题已经相当令人担忧。
112模型与技术IT之家冲击印度外包:AI 智能体不仅活干得好,而且成本更低
AI 智能体已进入可部署阶段,当前顶尖模型完成日常任务得分超过人类,已在多个企业办公场景落地,摊薄后每小时成本低于印度离岸外包劳动力。#AI智能体#
113模型与技术IT之家LTX-2.5 模型登场:AI 生成 10 秒 720P 视频仅需 6.8 秒,原生集成 ComfyUI
开放世界模型公司 LTX 昨日(8 月 11 日)宣布推出 LTX-2.5 模型,原生接入 ComfyUI,在 2 张英伟达 GB200 配置下生成 10 秒 720P 视频只需要 6.8 秒。
114模型与技术IT之家微软推出 MAI-Code-1.1-Flash 编程模型:更好、更快,价格降至 1/4
微软新款 AI 编程模型 MAI-Code-1.1-Flash 上线,价格仅为前代四分之一,但代码能力不降反升,在 Terminal-Bench 测试中提升 22%,并新增图像识别能力。GitHub Copilot 已全面支持,旧版将于 9 月停用。#微软# #GitHubCopilot#
115模型与技术IT之家国内首个成功运行超 2 万亿参数大模型的超节点,阿里云灵骏真武 M890 超节点实例上线
阿里云今日宣布,灵骏真武 M890 超节点实例正式上线,首批在乌兰察布地域开售。
116模型与技术IT之家英伟达推出 30B 开源 AI 模型 Nemotron 3.5 Lightning
Nemotron 3.5 Lightning 是一款拥有 300 亿参数的 MoE 模型。
117模型与技术IT之家英伟达、思科等 120 家组织提议建立 AI 智能体事故追踪机制
The Open Secure AI Alliance(开放安全人工智能联盟)正在制定其所谓的“Shared AI Findings Exchange”(共享人工智能发现交流,SAFE)指南,这是一个关于如何报告涉及 AI 智能体网络安全事件的拟议框架。
118模型与技术IT之家多个 AI 智能体协同干活,马斯克旗下 SpaceXAI 推出 Grok Bot
该产品可让多个 AI 智能体协作完成各类任务,已在公司内部多团队试用,是马斯克追赶 AI 竞争对手的最新举措。#AI智能体# #Grok Bot#
119模型与技术外部资讯IT之家消息称英伟达开发万亿参数开源 AI 模型 Nemotron 4,目标挑战全球顶级
英伟达是美国少数主动推出开源模型的大型科技企业之一。今年以来,AI 开发和运行成本持续攀升,而价格更低的中国模型在性能上逐步逼近 Anthropic、OpenAI 等美国领先 AI 实验室的顶尖系统,使开源模型获得更多关注。
120模型与技术IT之家李开复:中国开源大模型让美国人很担忧
零一万物 CEO 李开复表示,中国开源大模型正吸引越来越多美国公司使用。他举例称,月之暗面的 Kimi K3 模型性能接近美国最强 AI,但价格便宜 60%,这引发了美国业界对开源生态可能冲击其闭源体系的担忧。#中国AI开源# #KimiK3#
121模型与技术IT之家蚂蚁百灵开源 Ling-3.0-tiny 模型,支持英伟达 DGX Spark、苹果 Mac mini 部署
该模型为轻量级混合推理 MoE 架构,主打低成本推理,适配英伟达 DGX Spark、Mac mini 等多个平台部署,官方已完成多个设备的速度与内存验证。#AI大模型#
122模型与技术IT之家未公开的新模型“立功”,Anthropic 宣布 Claude 攻克黎曼猜想取得重大突破
在一次持续数天、由模型自主完成的测试中,Claude 把黎曼 ζ 函数临界线上零点比例的长期下界从 41.6% 提高到了 67.2%。
123模型与技术IT之家商汤日日新 SenseNova 6.8 Flash Lite 预览版上线:主打轻量敏捷,剑指“委派智能”
根据介绍,该模型主打轻量敏捷,具备自主规划、持续执行、多 Agent 协作、动态纠偏能力,可实现完整端到端结果交付,向着委派智能(Delegated Intelligence)方向演进。
124模型与技术IT之家三周一更:微软 MAI-Image-2.6 发布,一举跃升 Arena 文生图模型榜第二位
该模型在 Arena 文生图榜位列第二,Elo 评分 1336 分,领先 Meta、谷歌等竞品,多项能力全面升级,目前已可在 Arena 体验,后续将逐步上线微软相关平台。#文生图模型#
125模型与技术外部资讯IT之家主攻代码智能体产品?深度求索注册“Deepseek Harness 团队”公众号
北京深度求索公司已注册“Deepseek Harness 团队”公众号,旨在对标 Claude Code,研发代码智能体产品。该团队由资深研究员陈德里领衔,并在北京招聘相关岗位。 #DeepSeek# #代码智能体#
126模型与技术IT之家消息称谷歌已搁置发布 Gemini 3.5 Pro AI 模型
行业分析机构 Semi Analysis 最新报告称,谷歌内部可能已搁置 Gemini 3.5 Pro 模型,为填补该模型迟迟未发布留下的空档,该公司可能提前宣传 Gemini 4 系列模型。
127模型与技术外部资讯IT之家Gartner 预估 2026 年 AI 推理支出首次超越模型训练
市场调查机构 Gartner 昨日(8 月 10 日)发布博文,预测 2026 年全球 AI 优化基础设施即服务(AI-optimized IaaS)支出将达到 420 亿美元,同比增长 96%。
128模型与技术IT之家Anthropic 将为 Claude 生成文本加入隐形水印,防范 AI 内容冒充原创
Anthropic 宣布,新版 Claude 模型将在 AI 生成的文本中直接嵌入不可察觉的水印,此举旨在提高透明度并应对 AI 滥用。该水印即使经复制粘贴或部分编辑仍可能保留,但大幅改写或翻译仍可能导致检测失效。#Anthropic# #AI水印#
129模型与技术IT之家Anthropic Claude Sonnet 5 模型将维持首发优惠价,不再恢复原价
Claude Sonnet 5 的当前价格为每百万 Token(词元)输入 2 美元、每百万 Token(词元)输出 10 美元。
130模型与技术外部资讯IT之家Meta 扎克伯格:美国若想取得开源 AI 领先,就得减少政策障碍
Meta CEO 扎克伯格发布长文,呼吁美国放松对开源 AI 模型的限制。Meta 同日发布 Muse Glimmer 新模型,并计划公开更强大的 Muse Spark 1.2 权重。扎克伯格还宣布设立 10 亿美元基金,以缓解社区对数据中心建设的担忧。
131模型与技术IT之家曝谷歌测试新版主页:能创建图片、解读文件,唯独少了搜索按钮
新版页面提供“创建图片”“询问文件”和“头脑风暴”三个新按钮,把 AI 功能直接摆到了搜索主页最显眼的位置。
132模型与技术外部资讯IT之家扎克伯格呼吁美国放宽开源 AI 限制,以应对中国竞争
Meta CEO 扎克伯格呼吁美国政府减少对开源 AI 模型的限制,认为这样才能更好与中国竞争对手抗衡。他同时强调,AI 的安全在于普及而非集权。#AI开放权重#
133模型与技术IT之家Meta 开源 30B AI 模型 Muse Glimmer,4bit 量化可在单卡 24GB 显存 GPU 运行
Meta 今日发布 AI 模型 Muse Glimmer,并在 Apache 2.0 许可协议下开源该模型权重。
134模型与技术外部资讯IT之家AI 大模型周榜:阿里 qwen3.8-max 冲进综合榜 Top 6,国产多模型表现亮眼
阿里 qwen3.8-max 杀入综合榜第 6 名,ELO 1497 分,国产多模型在各榜单均有亮眼表现。
135模型与技术IT之家零一万物大模型开放平台将逐步停止面向用户提供在线体验、API 调用及充值等相关服务
官方表示,涉及账户余额的用户,可根据平台指引申请余额退还,零一万物将依法依规、及时有序地完成相关处理。
136模型与技术外部资讯IT之家谷歌 Chrome、微软 Edge 浏览器双双要求:下载本地 AI 模型需预留 20GB 空间
谷歌悄然更新帮助文档,明确了 Chrome 下载设备端 AI 模型的要求。用户需预留约 20GB 可用磁盘空间,且网络需为非按流量计费。Edge 也提高了要求,接近 20GB。目前,两款浏览器正加速 AI 本地化部署。
137模型与技术IT之家专为 AI 智能体打造的云端浏览器,Cloudflare 发布 Kitesurf
Cloudflare 推出的 Kitesurf 浏览器专为 AI 智能体设计,会忽略标签页和 UI,专注于管理上下文窗口与性能。它运行在 Workers 平台,可高效浏览网站、填写表单,并降低计算资源消耗。目前处于测试阶段。#AI浏览器#
138模型与技术IT之家OpenAI 下一代 AI 模型 Astra 数学成果遭抄袭指控
科技媒体 scientificamerican 于 8 月 6 日发布博文,报道称多名数学家指控 OpenAI 存在学术不端行为,称其 AI 模型 Astra 的数学成果未对已有研究成果给予应有的署名致谢。
139模型与技术IT之家蚂蚁集团百灵开源 Ling-3.0-flash 模型:124B 总参数、5.1B 激活参数
百灵大模型官方昨日宣布,新一代原生混合推理模型 Ling-3.0-flash 现已正式开源。
140模型与技术IT之家Meta 旗下 AI 模型测试时意外入侵第三方企业系统
据路透社消息,Meta 旗下 AI 模型在安全测试中不慎入侵了另一家企业的系统。起因是评估方配置错误,导致模型意外获得互联网访问权限。这起事件再次引发对 AI 安全边界的担忧,甚至惊动了美国立法者。#AI安全#
141模型与技术IT之家告别反复操作 OSD,华硕显示器管理软件 DisplayWidget Center 接入 AI 智能体
华硕显示器管理软件 DisplayWidget Center 迎来重大更新,加入 AI 智能体功能。用户无需使用 OSD 菜单,用自然语言即可调整亮度、色温。更智能的是,AI 能学习你的使用习惯,定时切换设定,比如早上自动调高色温,晚上降低亮度并开启防蓝光。#华硕显示器#
142模型与技术IT之家阿里推出国内首个 AI 语音平台 CosyVoice Studio,限时免费体验
该平台基于自研语音模型 Qwen-Audio 打造,包含语音记录 CosyFlow、语音智能体 CosyAgent 和音频内容创作工具 CosyCreative 等功能。
143模型与技术IT之家谁是 DeepSeek V4 Flash 最佳编程搭档?Composio 测试 Codex 等 4 个 AI 工具
Composio 用 30 项真实任务测试四大 AI 编程智能体框架,Oh My Pi 任务成功率最高,Claude Code 速度最快成本最高,OpenCode 成本最低。#AI编程智能体#
144模型与技术IT之家Neon 开源 4B 模型:文档搜索能力超 GPT-5.6 Sol,成本仅为 1/100
Neon 昨日(8 月 6 日)发布博文,宣布携手 Castform 公司,披露一套面向检索模型的训练方案。
145模型与技术IT之家GPT-5 上线 1 周年之际:OpenAI 面向 AI 智能体推出 Agent Plugins 规范
在 GPT-5 系列模型推出 1 周年(2025 年 8 月 7 日上线)之际,OpenAI 公司今天(8 月 7 日)宣布推出 Agent Plugins,是面向 AI 智能体的插件打包标准。
146模型与技术外部资讯IT之家消息称阿里计划向下一代千问 Qwen 开源模型大型商用用户收取营收分成
两位知情人士透露,阿里巴巴计划向其下一代通义千问开源模型的大型商用用户收取费用,要求从收益中抽取一定比例的分成。
147模型与技术IT之家GPT-4.5 以来训练的最大模型,曝 OpenAI 最快下周推出 Astra AI 模型
消息源 @synthwavedd 昨日(8 月 6 日)在 X 平台发布推文,爆料称 OpenAI 目标下周发布 Astra 模型,内部代号为 mewfour。
148模型与技术IT之家AMD 宣布计划收购 Taalas 公司,补强 AI 推理芯片路线图
AMD 今天(8 月 7 日)发布公告,宣布收购 Taalas 芯片初创公司。Taalas 面向 AI 推理设计加速器,针对单一 AI 模型定制芯片,主要牺牲通用性,换取更低成本和更高输出速度。
149模型与技术外部资讯IT之家国内已知最大规模!消息称字节跳动正讨论训练超 5 万亿参数模型
消息称该模型将由 Seed Foundation 负责人项亮主导,与大语言模型预训练数据负责人沈科合作。二人均是字节跳动 AI 及大模型研发体系内的核心骨干,并出自字节的“搜广推”体系。
150模型与技术IT之家华为官宣昇腾 0 Day 支持蚂蚁百灵 Ling-3.0-flash 模型,全新算子编程框架 CANN PyPTO 首秀
蚂蚁百灵昨日正式开源新一代原生混合推理模型 Ling-3.0-flash。华为官方今日宣布,昇腾同步完成百灵 Ling-3.0-flash 模型 0 Day 适配,在适配的过程中,还首次引入 CANN PyPTO 算子编程框架,可缩短复杂融合算子交付周期。#华为昇腾# #蚂蚁百灵#
151模型与技术IT之家华为昇腾宣布已支持 RL 训推一致性,实测获得最高 60% 性能收益
强化学习已成为大模型训练主流范式,推动模型技术向行业核心场景工程化落地。其中,训推一致至关重要,因推理与训练过程耦合,基础设施差异易放大不确定性。
152模型与技术外部资讯IT之家字节跳动 CEO 梁汝波称坚持自研大语言模型、接受短期落后,回应豆包、飞书、火山引擎整合
梁汝波表示,在大语言模型上,接下来字节跳动还是会坚持自研,做好基本功,接受短期落后,坚持优化长期。
153模型与技术IT之家FLUX 3 视频 AI 生成模型正式上线:最长 20 秒原生 1080p,跑分优于 Seedance 2.0
Black Forest Labs 昨日(8 月 5 日)发布公告,宣布正式上线 FLUX 3 视频生成模型,其性能要优于字节跳动的 Seedance 2.0 以及 Minimax 的 H3 等模型。
154模型与技术外部资讯IT之家阿里达摩院开放 15 项芯片与 AI 研究课题,启动“阿里星”顶尖人才招募
达摩院今年已开放 15 项研究课题,涉及 AI 芯片、新型 CPU 架构、医疗多模态智能体、 AGI 决策等众多前沿探索。
155模型与技术外部资讯新浪科技百度入局 AI 办公:dodo 并入百度搭子,全面整合办公 Agent 业务
本次整合后,百度办公 Agent 业务将集中发力,原内部办公智能体 dodo 的实践经验将逐步并入百度搭子企业版,强化其协同能力。#百度AI办公# #百度搭子#
156模型与技术外部资讯IT之家消息称张一鸣内部下死命令:就算模型暂时落后,字节跳动也不会依赖 AI 蒸馏技术
字节跳动创始人张一鸣在上个月的 Seed 团队全体会议上明确表示,即使意味着暂时落后于竞争对手,公司也不会依赖 AI 蒸馏技术来改进其模型。
157模型与技术IT之家挑战 Codex 等,Meta 推出其首个编程 AI 智能体工具 Muse Code
Meta 公司今天(8 月 6 日)发布博文,宣布以测试版推出其首个编程 AI 智能体工具 Muse Code,希望挑战 Anthropic 的 Claude Code,以及 OpenAI 的 Codex 等编程 Agent 工具。
158模型与技术IT之家继 OpenAI、Anthropic 之后,Meta AI 模型测试期间也发生“越界”事件
Meta 旗下 Muse Spark 1.1 模型在网络安全测试中因沙盒配置失误,成功入侵另一家未公开公司的系统。类似事件此前在 Anthropic 和 OpenAI 的测试中也曾发生,引发对 AI 安全测试流程的担忧。#AI安全危机#
159模型与技术IT之家小米具身基座模型 Xiaomi-Robotics-1 正式开源
小米技术官方微博刚刚宣布,小米具身基座模型 Xiaomi-Robotics-1 正式开源。据介绍,Xiaomi-Robotics-1 基于超过 10 万小时 UMI 数据进行预训练,并使用超过 1 万小时跨本体数据进行后训练。#小米开源# #具身智能#
160模型与技术IT之家卡帕西提出测试 AI 能力新思路:100 万 Tokens 额度构建《指环王》3D 交互场景
OpenAI 联合创始人安德烈 · 卡帕西(Andrej Karpathy)于 8 月 2 日在 X 平台发布推文,提出一项 AI 基准测试思路:向模型提供《指环王》开篇首段文字,再要求模型创建对应的 3D 世界。
161模型与技术IT之家Liquid AI 发布 LFM2.5-2.6B 端侧小模型,支持智能手机本地运行
LFM2.5-2.6B 在所有指令执行项目和几乎所有工具使用项目中均领先于 gemma-4-E2B-it、gemma-4-E4B-it、Qwen3.5-4B、Qwen3.5-9B。
162模型与技术IT之家字节跳动 SeedRealtime 音视频全双工大模型发布:支持边看、边听、边说,已上线豆包
SeedRealtime 用统一架构原生融合音频、视频与文本,能在连续的多模态信息流上实时交互,带来“边看、边听、边说”的全新体验。
163模型与技术IT之家AI 智能体“失控”风险再现:OpenAI、Anthropic 模型被发现执行未授权操作
英国 AI 安全研究所在测试 OpenAI、Anthropic 的 AI 模型时,发现 AI 智能体可创建虚假网络身份获取未授权访问,暴露出 AI 安全防护不足,目前无实际损害。#AI安全#
164模型与技术IT之家上诉法院推翻原裁决,Perplexity 智能体重获亚马逊电商访问法律许可
上诉法院表示,法律上是 Perplexity AI Comet 浏览器的用户利用人工智能辅助工具访问了亚马逊平台,访问行为并非由 Perplexity AI 本身作出。
165模型与技术IT之家最强多模态内容审核开源 AI 模型:Mistral 推出 Shieldstral,单张 16GB GPU 可运行
Mistral AI 昨日(8 月 4 日)发布公告,宣布推出 Shieldstral 内容审核 AI 模型,总参数量为 3B(30 亿),采用开放权重,依据 Apache 2.0 许可证发布。
166模型与技术IT之家视频能“边播边改”:京东开源自研 JoyAI-Video-Edit 模型,各项指标全球领先
JoyAI-Video-Edit 基于全自研 JoyAI-Video 模型,在 720P 分辨率下实现每秒 30 帧的模型推理速度,能够在保持较高画面清晰度的同时,跟上常见影视视频的播放节奏。
167模型与技术IT之家马斯克预告下周将推 Grok 4.6 模型,改进 AI 监督微调和强化学习
在今天(8 月 5 日)召开的 SpaceX 公司 2026 年第 2 季度(截至 6 月 30 日)财报电话会议上,马斯克预告将于下周发布 Grok 4.6 模型。
168模型与技术IT之家华夏出版社标注书籍内容禁用于 AI 训练,负责人称很难维权、但要有态度
华夏出版社相关负责人表示,如果书籍内容在未被授权的情况下用于人工智能训练,这很难维权,但出版社仍会标注。(红星资本局)
169模型与技术IT之家腾讯混元发布语音识别模型 Hy ASR 3.0 preview,元宝已首发上线
腾讯混元今日发布了新一代语音识别模型 Hy ASR 3.0 preview。
170模型与技术IT之家Cloudflare 推出新开源库,为每个 AI 智能体配备独立工作计算机
Cloudflare 昨日(8 月 3 日)发布博文,宣布以早期预览版形式,推出 @cloudflare / computer 开源库,为每个 AI 智能体独立分配虚拟工作计算机,并包含文件系统与命令执行能力。
171模型与技术IT之家微软测试其首款自研全双工 AI 语音 MAI Realtime 模型:支持中文等 16 种语言、2 种风格
科技媒体 TestingCatalog 于 8 月 2 日发布博文,报道称微软正测试其首款原生实时语音模型 MAI Realtime,支持 16 种语言、2 种语音,可在对话中听说并行,支持自动识别和中途切换语言。
172模型与技术IT之家铠侠官宣 GP1 XL-FLASH PCIe Gen6 固态硬盘,随机读取 100M IOPS
其采用铠侠第二代 XL-FLASH 存储级内存,允许更精细的 512 字节粒度数据访问,耐久度可达 50 DWPD,支持将高速闪存介质引入显存系统的新兴 AI 存储架构。
173模型与技术IT之家沐曦曦云 C 系列 GPU 实现 Day 0 适配 MiniMax H3 多模态生成模型
依托全栈自研 MXMACA 软件栈,沐曦实现快速部署 MiniMax H3,调用该模型强大的多模态创作能力。
174模型与技术IT之家原生支持 4K 图像生成,商汤科技开源多模态模型 SenseNova U1.5-Lite-Preview 预览版本
商汤科技今日宣布,面向社区开源轻量级统一多模态模型的预览版本 SenseNova U1.5-Lite-Preview。
175模型与技术IT之家自变量机器人发布 HOST 框架并开源,让机器人看视频学会新技能
自变量机器人今日发布并开源 HOST 框架,机器人仅需观察一段数十秒的人类视频即可学会新技能,成功率高达 62%。该框架采用“按任务进度对齐”方法,相比传统方案数据量减少 50 倍,速度提升 500 倍,未来有望推动家庭机器人无需专业训练即可学习。#机器人技术#
176模型与技术IT之家消息称阿里内测 AI 办公平台“万有无界”,多智能体协同交付
阿里云正在内测面向 B 端的人与 Agent 协作平台“万有无界”,主打多智能体协同处理复杂项目,与侧重日常办公的“千问办公”形成互补。#阿里AI办公#
177模型与技术IT之家阿里巴巴千问 Qwen3.8-Max 模型正式上线,总参数量 2.4 万亿
该模型拥有 2.4 万亿参数,在编程、办公等多领域能力全面升级,可低人工介入完成复杂开放任务,模型权重将于下周开源。#阿里巴巴千问# #AI大模型#
178模型与技术IT之家通用视频模型 MiniMax H3 正式开源,支持多模态上下文、2K 分辨率
MiniMax H3 正式开源,这是一个通用型全模态生成系统,可理解文本、图像、视频、音频,并生成最高 2K 分辨率、15 秒视频及立体声音频。支持 11 种语言,多种输入模式。#AI开源# #MiniMax#
179模型与技术IT之家中国 AI 大模型领跑全球榜单,央视详解背后的优势所在
据央视新闻报道,中国 AI 大模型领跑全球榜单,实现了调用量和下载量的双“突围”。中国信息通信研究院云计算与数字化研究所副所长栗蔚表示,国产模型以开源策略激活创新生态,凭借性能优越、成本可控、便于本地化部署等突出优势,大幅降低了人工智能技术的应用门槛,赢得了全球开发者的广泛青睐。
180模型与技术IT之家谷歌 Gemini Spark 智能体对全球更多用户开放,支持订机票、整理收件箱等操作
谷歌于 7 月 31 日宣布,其个人 AI 智能体 Gemini Spark 已向全球大部分用户开放。该智能体已整合 Chrome 浏览器,可在授权后帮助用户整理邮件、搜索航班、预订机票等。同时,Spark 内置安全机制,防止提示词攻击并将敏感操作交还用户。#谷歌AI# 目前仅美国订阅 Pro / Ultra 用户及其他地区 Ultra 用户可用。
181模型与技术IT之家珍稀图书遭粉碎用于 AI 训练引众怒,图书数据库 ISBNdb 下架 AI 相关测试页面
AI 公司为获取高质量训练数据,大量采购实体图书并销毁,这一做法引发广泛争议。图书供应商接到巨额订单,业内人士猜测幕后买家为 AI 公司,而数据库网站 ISBNdb 被指在其中牵线搭桥。尽管该公司已删除相关宣传并否认,但类似“巴拿马计划”项目早已曝光。#AI训练数据# 来源枯竭,导致企业转向实体书这一极端方式。#AI大模型训练#
182模型与技术IT之家因使用月之暗面模型写代码,美国最大外卖平台 DoorDash 被议员调查
美国外卖巨头 DoorDash 因使用中国 AI 公司月之暗面的 Kimi K2.6 模型,遭到众议院两个委员会联合调查。公司创始人称该模型组合性能更强、成本更低,但议员们担忧其存在安全风险。#中美AI竞争# 双方正就此事展开沟通。
183模型与技术IT之家OpenAI 奥尔特曼推介 Astra 模型:协同 AI 智能体工作,主打长周期任务能力
科技媒体 The Information 今天(8 月 1 日)发布博文,报道称 OpenAI 首席执行官萨姆 · 奥尔特曼(Sam Altman)本周在美国国会山展示名为 Astra 的全新 AI 系列模型,重点提升长周期任务处理能力。
184模型与技术IT之家MiniMax H3 通用多模态视频模型将于 8 月 3 日开源,最高可支持 15s 2K 分辨率
MiniMax H3 支持对文本、图像、视频、声音组成的多模态上下文的统一理解能力、能够输出具备原生双声道的音视频,最高可支持 15s 2K 分辨率。
185模型与技术IT之家阿里云 Qoder 上线实时语音交互智能体 QoderVoice,支持讨论式交互
阿里云 Qoder 上线实时语音交互智能体 QoderVoice,由全双工语音模型驱动,用户可通过语音随时唤醒、下达指令并实时打断追问。智能体可自动创建并执行任务,首批已登陆国际版并提供限时免费试用。#AI编程# #语音交互#
186模型与技术IT之家华为官宣昇腾 0day 支持 Kimi K3 的训练适配及推理部署
2026 年 7 月 27 日,月之暗面正式开源 Kimi K3。华为官方今日宣布昇腾 0day 支持 Kimi K3 的训练适配及推理部署。同时,昇腾 950 超节点支持 FP8、MXFP8、MXFP4 等全系列数值精度格式,原生支持 Kimi K3 的 mxFP4 量化权重。
187模型与技术IT之家消息称亚马逊大规模调整 AI 战略,集中资源攻坚前沿大模型
亚马逊正在对 AI 业务进行大规模重组,逐步停止开发多款自研模型,并将资源集中到代号 FMR 的前沿模型项目上。这标志着公司从多线并进转向聚焦核心,其全新旗舰模型预计将在今年秋季的 AWS re:Invent 大会上发布。#亚马逊AI# #人工智能#
188模型与技术IT之家Day0 适配:阿里云灵骏真武 M890 超节点实例现已支持月之暗面 Kimi K3 大模型
阿里云宣布其灵骏真武 M890 超节点实例已成功适配月之暗面最新发布的 2.8 万亿参数旗舰模型 Kimi K3。基于平头哥训推一体 AI 芯片与高速互联架构,该实例可将万亿级 MoE 模型的专家并行通信流量限制在单一高带宽域内,有效提升推理效率。#AI大模型##阿里云##月之暗面Kimi#
189模型与技术IT之家全球第一,智元 WITA-Omni Preview 具身大模型登顶 DailyOmni 全模态理解榜单
智元自研的具身原生全模态大模型 WITA-Omni Preview 在 DailyOmni 榜单中以 85.21 分登顶,在音视频联合理解与时序推理能力上超越国内外主流模型。其核心在于创新的 Thinker–Talker–Actor 架构,将物理动作和表情提升为与语音并列的一级输出。#AI大模型##具身智能#
190模型与技术IT之家微软 GitHub Copilot 现支持调用 Grok 4.5 AI 模型
马斯克旗下 SpaceXAI 昨日(7 月 28 日)发布公告,宣布其 Grok 4.5 模型已入驻 GitHub Copilot 平台,邀请全球数百万开发者使用。
191模型与技术IT之家阿里云 Qoder 开源 Better Harness,面向编程 Agent 的分析与持续改进工具
Qoder 官方公众号昨日(7 月 28 日)发布博文,官宣已在 GitHub 平台上开源 Better Harness。
192模型与技术IT之家OpenAI 计划向 10 万名科学家免费开放 GPT-5.6 系列 AI 模型等资源
OpenAI 今天(7 月 30 日)在 X 平台发布推文,宣布启动 ChatGPT for Academic Researchers 计划,将会向 10 万名科研人员免费开放 ChatGPT 高级功能。
193模型与技术IT之家Meta 扎克伯格:五年后,全球数十亿人将有专属的个人 AI 智能体
扎克伯格在财报电话会议上大胆预测:“无论把时间范围设定为五年还是其他期限,我都认为,未来没有数十亿人使用个人智能体的可能性极低。个人智能体能够理解你的目标,全天候为你工作,帮助你在任何看重的领域实现目标。”
194模型与技术IT之家OpenAI 部署 GPT-5.6 优化模型自身推理性能,端到端服务成本最多降低 20%
OpenAI 公司昨日(7 月 29 日)发布博文,宣布通过 GPT-5.6 Sol 模型,来优化 GPT-5.6 系列模型本身 AI 推理链路,端到端服务成本最多降低 20%。
195模型与技术IT之家微软宣布用户可通过 Fireworks AI 在 Microsoft Foundry 部署 Kimi K3 模型
微软于 7 月 28 日发布公告,宣布用户通过 Fireworks AI 在微软 Microsoft Foundry 上部署月之暗面的 Kimi K3 模型。
196模型与技术IT之家马斯克:Grok 4.6 将于 8 月 7 日发布,几周后推出 2.1 万亿参数 Grok 4.7
马斯克透露 Grok 4.6 和 Grok 4.7 的发布计划,两款模型参数分别达 1.5 万亿、2.1 万亿,将在性能方面获得显著提升。#Grok大模型#
197模型与技术IT之家研究显示:AI 聊天机器人实施情感诈骗的能力已超越人类
四所大学联合研究测试发现,AI 聊天机器人在恋爱诈骗这类“长期骗局”中,获取受害者信任的效果远超人类,同意诈骗请求的比例接近一半。#AI诈骗#
198模型与技术IT之家华为官宣小艺高分超出第 56 届国际物理奥林匹克竞赛理论金牌线
第 56 届国际物理奥林匹克竞赛(IPhO 2026)日前正式落幕,华为官方今日宣布,小艺在理论考试中取得 28.6 分(满分 30 分)的优异成绩,高分超出金牌线。#小艺# #华为鸿蒙#
199模型与技术IT之家降价 80%!OpenAI 下调 GPT-5.6 Luna AI 模型费用,性价比超 DeepSeek V4 Pro
在 GPT-5.6 系列发布(7 月 9 日发布)约 3 周后,OpenAI 公司今天(7 月 31 日)宣布下调 GPT-5.6 Terra 和 GTP-5.6 Luna 两款模型的调用费用,本次调整暂不影响 GPT-5.6 Sol 模型。
200模型与技术IT之家谷歌最强具身推理模型:Gemini Robotics ER 2 登场,支持连续视频理解与多机器人协作
谷歌 DeepMind 昨日(7 月 30 日)发布博文,宣布推出 Gemini Robotics ER 2 模型,是其面向机器人的最强具身推理(embodied reasoning)模型。
201模型与技术IT之家谷歌:多亏人工智能,6 月修复的 Chrome 漏洞比过去两年总和还多
6 月推出的 Chrome 149 和 Chrome 150 共修复 1072 个安全漏洞。此前两年发布的 23 个 Chrome 版本合计修复 1036 个漏洞,不及最近两个版本的修复总量。
202模型与技术IT之家打击低质量 AI 内容,领英现允许用户举报 AI 垃圾帖文
领英推出举报选项,用户可一键举报 AI 生成的低质量垃圾帖文,同时调整平台内置 AI 工具,不再支持生成完整帖文,仅保留基础校对功能。#领英AI垃圾帖文治理#
203模型与技术IT之家Meta 借助 AI 大幅缩短应用开发周期,更多新应用已在路上
近期推出的产品包括面向 Marketplace 卖家的应用、Facebook 群组应用、通过“氛围编程”打造的游戏应用、Instagram 照片应用,以及 AI 睡前故事实验。
204模型与技术IT之家消息称 DeepSeek 计划在内蒙古建设大型 AI 数据中心,增加 1GW 算力
据彭博社报道,DeepSeek 正扩大算力布局,计划在内蒙古建设大型 AI 数据中心,增加 1GW 算力。部分算力预计 2027 年底或 2028 年初投用,目前暂不清楚项目所用芯片。#DeepSeekAI数据中心#
205模型与技术IT之家新研究:AI 对就业市场的真正威胁不是失业,而是让加薪更困难
最新研究显示,AI 暂未对整体就业产生可检测影响,但会显著压低工资增速,低收入劳动者受冲击最明显,未来或将进一步加剧收入不平等。
206模型与技术IT之家智谱 GLM Coding Plan 订阅回归:透明积分制,每月 118 元起
智谱今日官宣 GLM Coding Plan 订阅回归,套餐价格和套餐规则有所调整。即日起至 2026 年 8 月 15 日,订阅新版包年 / 包季套餐分别享限时 7 折/ 8 折优惠。
207模型与技术IT之家印度人工智能企业 Sarvam AI 将开发 T 级模型
这一设想中的新模型预计将在未来六个月内完成,可在编程、网络安全、科学研究等领域与领先模型展开竞争。
208模型与技术IT之家亚马逊 Zoox 获得首份专用 Robotaxi 临时豁免,可在美国开展付费服务
美国 NHTSA 允许 Zoox 两年内在监管框架下每年商业部署最多 2500 辆汽车。从下月开始,拉斯维加斯的 Zoox 出行服务将转为付费模式。
209模型与技术IT之家Anthropic:第三方评估环境配置失误,导致三起真实网络安全事件
这三次事件中 Anthropic 的模型都被指派了无限制的“夺旗”网络攻击任务。此类任务的测试环境需与真实互联网隔离,但错误配置导致模型实际上拥有真实互联网访问权限。
210模型与技术IT之家MiniMax H3 全模态生成模型正式发布:最高支持 15 秒 2K 分辨率,超分方案革新
MiniMax H3 全模态生成模型今日正式发布,该模型支持多模态上下文统一理解,可输出原生双声道音视频,具备商用级多场景内容生成能力,适配多个商业领域。近日还将开放模型权重。#MiniMax H3#
211模型与技术IT之家余承东说到做到,华为盘古 openPangu-2.0-Pro 模型及技术报告开源上线
开源盘古 5050 亿参数的 openPangu-2.0-Pro 模型(模型权重、基础推理代码)及技术报告正式开源上线。
212模型与技术IT之家微信公众号推出 AI 智能“一键排版”功能
公众号创作者手机登录“公众号助手 App”或是进入网页版公众号后台,创作一篇文章或选择草稿箱里要发布的文章,系统会自动识别内容结构,并出现「一键排版」图标选项,点击即可开始排版。
213模型与技术IT之家AI 挤压作家收入:14419 本小说洞察,约 20% 书籍 AI 含量超 25%
科技媒体 Wccftech 昨日(7 月 30 日)发布博文,报道称最新论文指出,在畅销自出版类型小说中,约有 33% 含有 AI 生成内容。
214模型与技术IT之家阿里发布 Qwen-Audio-3.0-ASR-Flash 语音识别大模型,让 AI 更好听懂专业词汇
Qwen-Audio-3.0-ASR-Flash 主要在上下文一致性、行业词识别和热词定制化三个维度做了系统性的优化,同时让模型具备语音润色能力,可直接输出结构化文本。
215模型与技术IT之家字节跳动国内推出 Seedance 2.5 视频 AI 模型:单次生成时长 30 秒、突破长叙事能力
字节跳动今天(7 月 31 日)发布公告,宣布推出 Seedance 2.5 视频生成模型,可单次生成 30 秒高质量视频片段,已陆续上线即梦 AI 与豆包专业版,API 服务也将于近期接入火山方舟。
216模型与技术IT之家韩国最大人工智能基础模型:LG AI 研究院发布 750B 参数 K-EXAONE 2.0
LG AI 研究院当地时间今日在 Hugging Face 上发布了 K-EXAONE 2.0 模型。
217模型与技术IT之家腾讯混元:基于 Hy3 模型的科研智能体 Hyra 攻克加法组合学 50 年未解难题
腾讯混元今日发文宣布,科研智能体 Hyra 找到了一个关键构造,为加法组合学中一个悬而未决半个多世纪的开放问题给出了完整答案。
218模型与技术IT之家“小号”美国最强开源模型:Inkling-Small 登场,约 1/4 规模提供相近 AI 性能
Thinking Machines Lab 昨日(7 月 30 日)发布博文,宣布推出 Inkling-Small 模型,其性能媲美 Inkling,但规模降低至约四分之一。
219模型与技术IT之家OpenAI 两项改进让 GPT-5.6 Sol 在 AI 基准 ARC-AGI-3 上提分 188%
ARC Prize ARC 奖 ARC 奖 ARC 奖团队推出的全新交互式推理基准测试,旨在衡量人工智能代理(AI Agent)在未知和动态环境中的类似人类的智能与技能获取效率
220模型与技术IT之家谷歌最新 AI 大模型 Gemini 3.5 Pro 短暂上线 Arena 竞技场,已延迟数月
据多位用户反馈,鸽了许久的谷歌 Gemini 3.5 Pro 大模型今日短暂现身 AI 盲测平台 Arena,上线仅 30 分钟便被撤下。该模型原定于 6 月推出,但多次跳票。#谷歌AI# 此次短暂露面,暗示测试可能已进入最后阶段。
221模型与技术IT之家DeepSeek-V4-Flash 正式版 API 上线公测,V4-Pro 正式版将“尽快”发布
今天(31 日)下午,DeepSeek 通过 API 文档发布日志,宣布 DeepSeek-V4-Flash 正式版 API 上线公测。
222模型与技术IT之家消息称阿里千问模型已在特斯拉车机内测,号称能听能答、能控车、能导航
消息称阿里千问模型已在特斯拉车机内测,目前已在真实车机环境完成大量测试,可支持语义理解、控车导航等能力,已有多家国内头部车企宣布接入该模型。#阿里千问大模型#
223模型与技术IT之家德里高等法院裁定 OpenAI 利用印媒 ANI 内容训练 AI 未侵犯版权
OpenAI 于当地时间上周五(24 日)在印度赢得了一项关键法律诉讼:德里高等法院认定其利用亚洲国际新闻(印度)社 (注:以下简称 ANI) 的内容来训练人工智能不构成侵犯版权。
224模型与技术IT之家发改委:全球每销售 10 台人形和四足智能机器人,就有 8 台产自中国
据新华社今日消息,记者从国家发展改革委新闻发布会上获悉,在智能机器人领域, 当前全球每销售 10 台人形和四足智能机器人 , 就有 8 台产自中国 。

