ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

AI 资讯日报 | 2026年10月5日:DeepSeek将中美顶尖模型差距缩至3%,Gemini 4 Argon百万Token输出,阿里确认Qwen 4训练中,智能体安全治理升温

AI 资讯日报 | 2026年10月5日:DeepSeek将中美顶尖模型差距缩至3%,Gemini 4 Argon百万Token输出,阿里确认Qwen 4训练中,智能体安全治理升温 一、模型与产品1. 谷歌发布Gemini 4 Argon旗舰模型百万Token输出主打长周期复杂工作流谷歌正式推出新一代旗舰大模型Gemini 4 Argon单轮最大输出Token上限由上代6.4万提升至100万可独立完成跨数万行代码迁移等长链路工程任务官方18项基准测试中拿下13项领先。初期采用受控分阶段发布优先向经过审核的安全研究人员开放推广期API定价为输入每百万Token 2美元、输出10美元。来源环球网科技、TechCrunch、IT之家2. DeepSeek V4.1 Flash将中美顶尖模型差距缩至3%彭博行业研究数据显示DeepSeek V4.1 Flash在LiveBench上得分81.1与Anthropic旗舰模型的83.4仅差约3%创下中美顶级模型最小差距纪录该差距从年初的约15%、5月的约9%持续收窄。该模型已于9月10日以MIT协议开源发布。来源Bloomberg、AI Briefing3. OpenAI测试ChatGPT图像生成可视化广告周活用户达12亿OpenAI宣布将于本月晚些时候在美国测试ChatGPT图像生成过程中的可视化广告广告将明确标注并与生成图片分离公司同时披露ChatGPT周活用户已达12亿。来源BleepingComputer、AI Weekly4. 微软发布实时语音转写模型MAI-Transcribe-2-Streaming微软推出MAI-Transcribe-2-Streaming主打低延迟流式识别在Artificial Analysis实时语音转写榜单登顶适合会议记录与实时字幕场景官方称识别质量领先同代模型。来源MarkTechPost、Hex20775. Anthropic为Claude Code上线Mods系统Anthropic推出Claude Code Mods系统用户可自定义智能体行为、定制界面甚至替换底层模型支持拦截危险命令、逐步查看代码改动上线首日社区即出现上下文占用面板等自定义组件。来源The Decoder、Hex20776. Tavus发布真人级交互模型Griffin盲测近半数用户误认为真人AI视频交互企业Tavus推出端到端实时人类交互模型Griffin重点优化实时眼神感知、动态打断与沉默语义理解在一对一视频通话盲测中48%的受试者误将AI判定为真人可应用于直播、客服、社交陪伴等场景。来源CSDN、稀土掘金7. 苹果Siri AI十月新增五种语言Siri AI本月新增法语、日语、韩语、葡萄牙语、西班牙语支持并上线Apple Watch端Live Rewind与Siri Recap功能欧盟地区上线时间可能明显滞后。来源AI Briefing8. NASA与IBM开源首批月球科学基础模型NASA与IBM联合发布并开源Lunar Foundation Model基于月球勘测轨道飞行器17年积累的近200万组图像切片训练显著降低月球极地水冰沉积物预测误差为行星科学研究提供开放工具。来源稀土掘金、CSDN二、行业与商业动态1. Mistral完成30亿欧元D轮融资估值超210亿欧元法国AI公司Mistral完成30亿欧元D轮融资估值超210亿欧元约合240亿美元并承诺2030年前建成1吉瓦欧洲算力新设慕尼黑中心聚焦物理AI与工业AI团队含来自Emmi AI的30余名物理学家。来源AI Briefing、Bloomberg2. 决策模型赛道爆发Jev日处理量达1万亿Token国内团队跟进开源TypeSafe AI的决策模型Jev发布三周即在硅谷引发热议其不做文本生成、而是将输入归类到预设输出是否/评分/列表选择目前约25%的财富500强企业正在使用日处理Token量达1万亿公司正洽谈新一轮融资目标规模10亿美元、估值或超100亿美元。国内上海人工智能实验室开源多模态决策模型Intern-Decision创业公司StartLux推出0.8B至27B五档开源决策模型决策模型国产开源竞速开启。来源华尔街日报、IT之家、稀土掘金3. 英伟达支持的Reflection AI拟发布开源权重模型对标DeepSeek与Qwen英伟达投资的Reflection AI准备发布首个开源权重模型目标对标DeepSeek与Qwen等头部中文开源系统为西方企业提供银行级合规、低成本的模型底座。来源Axios、AI Weekly4. 谷歌收紧Gemini免费权益10月9日起免费用户仅可用Flash-Lite谷歌宣布自10月9日起免费版Gemini用户仅能使用Flash-Lite轻量模型Flash、Pro等主力模型转为付费订阅专属AI Pro用户首次获得原Ultra专属的Deep Think能力。来源AI Briefing、quidproquo5. 微软Copilot 365 Wave 4全面可用落地SharePoint与OneDrive微软Copilot 365 Wave 4在SharePoint、OneDrive实现全面可用并更新FinOps治理能力以调度后台任务10月产品条款新增Azure未来容量预留等服务。来源AI Briefing6. Meta Muse购物智能体与多家零售巨头合作Meta宣布Muse智能体与沃尔玛、Gap、丝芙兰、Expedia、Wayfair、百思买等达成合作用户可由智能体代为完成购物与结算。来源AIBriefs三、国内动态1. 阿里确认Qwen 4大模型训练中公布Zhenwu V900芯片阿里巴巴在云栖大会确认新一代Qwen 4大模型正在训练中并公布自研Zhenwu V900芯片官方称性能较前代提升约3倍Qwen 4.5与Qwen 5将瞄准5万亿至10万亿参数规模较当前旗舰Qwen3.8-Max的2.4万亿参数大幅跃升。来源今日头条、AI Briefing2. 智谱GLM-5.3被Cursor收录开放权重模型最高分智谱GLM-5.3在CursorBench 4.0中拿下开放权重模型最高分42.6%被Cursor正式收录高盛研报加持下智谱当天股价大涨近7%。来源TRAE官方中文社区3. 何恺明新作VISTA为大模型装上视觉记忆何恺明团队发布新作VISTA为大模型引入视觉记忆能力测试中Claude Opus 5在ARC-AGI-3公开关卡得分从40.68冲至100GPT-5.6 Sol从13.33分提升至99分。来源TRAE官方中文社区4. 阿里发布同声传译大模型Qwen3.8-LiveTranslate阿里发布同声传译大模型Qwen3.8-LiveTranslate实现译文同帧同出为实时跨语言场景提供低延迟方案。来源TRAE官方中文社区5. 小米旗舰MiMo-V2.6-Pro超1万亿参数支持1M上下文小米旗舰模型MiMo-V2.6-Pro参数规模超1万亿支持100万Token上下文。来源TRAE官方中文社区6. 华为τ芯片规模化量产美团开源长视频生成模型华为τ芯片进入规模化量产阶段为国产大模型提供算力支撑美团开源长视频生成模型丰富国产开源生态同期华为与高通签署覆盖5G、计算、网络与AI的专利交叉许可。来源网易、TechStartups7. AI制药卖铲人生意成形Anthropic湿实验室出手字节前部门独立Anthropic湿实验室首个项目用Claude智能体识别出一种与CRISPR相关、此前未被表征的酶系统字节跳动前AI药物发现部门独立并更名Anew LabsAI制药基础设施赛道升温。来源TRAE官方中文社区四、芯片与基础设施1. 英伟达发布桌面级DGX Spark 64GB本地跑千亿模型门槛降至4999美元英伟达推出64GB统一内存、1 PetaFLOP算力的桌面级DGX Spark面向本地智能体运行、微调与推理10月23日由华硕、戴尔、惠普、微星等伙伴开售起价4999美元两台可组网池化128GB内存让千亿参数模型免云端运行。来源MarkTechPost、觉醒学院2. 英伟达6.68亿美元投资GMI Cloud亚马逊拟投80亿美元自研AI芯片英伟达宣布向GMI Cloud投资6.68亿美元深化算力基础设施布局同期亚马逊被曝计划投入80亿美元自研AI芯片加速云端算力自主化全球算力产业竞合格局持续重构。来源网易、TechStartups3. 亚马逊调涨AI GPU租用费用15%评估芯片售后回租亚马逊同日调涨AI GPU租用费用15%并评估以售后回租方式将约80亿美元Nvidia Grace Blackwell芯片移出资产负债表反映其2026年200亿美元资本支出压力下的成本腾挪。来源qz、quidproquo4. Strata开源推理引擎12GB显卡本地跑125B大模型开发者社区开源推理引擎Strata将125B参数的Qwen3.8-Flash-Next按专家混合方式跨GPU、内存与SSD卸载单张RTX 3090/4090消费级显卡即可离线运行吞吐约100-140 tokens/s数据全程本地处理。来源GitHub、CSDN
返回列表