每日 AI 快讯

第 1 / 1 页

实时更新同步最新AI行业相关的资讯,每日快速获取了解最新新闻

最近同步时间:2026.10.03 00:00
9月30·周三
DeepSeek 开源昇腾基础组件

正式开源面向华为昇腾算力平台的基础设施组件,涵盖高级语言编译工具TileLang、计算库与分布式通信库,与此前英伟达平台组件一一对应。TileLang昇腾版已支撑系列模型训练算子的高性能实现;DeepGEMM、DeepEP、FlashMLA等组件覆盖矩阵运算、通信、稀疏注意力等核心能力,多项测试接近硬件上限。

OpenAI推出新一代主力模型 GPT-6.1 Sol 和常驻型 Agent「Dots」

OpenAI在旧金山DevDay 2026发布25项更新。重磅推出常驻型Agent「」,可长期跟踪任务、主动汇报、自主操作软件;新模型智能接近旗舰,API价格仅为其1/5,另推Ultrafast付费提速档位;升级为”云端工程团队”,支持多Agent并行、代码评审与安全扫描;Agents API开放Computer Use等能力,并与AWS达成合作。

LibTV 携手抖音 AI 创作浪潮计划,推出「AI 大师公开课」

联合抖音AI创作浪潮计划推出「AI 大师公开课」,邀请金奖短片《合龙》主创,2XLabs导演刘树恒、王语宸,从叙事、美术、表演三维度拆解AI短片创作方法。课程不讲提示词,聚焦创作底层逻辑:用一句话锚定故事、用细节构建可信世界、用动作传递情绪,用户可在抖音观看。

9月29·周二
AMD官宣550亿元收购李飞飞 World Labs

AMD官宣以全股票约82亿美元(约550亿元)收购李飞飞创立两年的World Labs,预计2026年底前完成。交易后李飞飞将出任AMD执行副总裁兼首席科学家,直接向苏姿丰汇报,两位联合创始人留任。AMD意在补齐空间智能、机器人与仿真能力,拉近模型与硬件协同,押注下一代AI负载,正面硬刚英伟达。

快手推出新一代 AI 视频生成模型 Kling 4.0

快手可灵 将于10月正式上线,其中轻量版 Kling 4.0 Flash 已向黑金年卡会员开放抢先体验。新版本在画面真实感、创意可控性与叙事完整度上大幅升级,支持单次生成最长30秒原生视频,配备多关键帧控制、多模态参考与视频精准编辑能力,音频升级双通道立体声,并将推出4K HDR输出和2分钟超长续拍。

Anthropic 推出最新 AI 模型 Claude Sonnet 5.5

Anthropic 正式推出 Claude 5.5 家族第二款模型 ,与 形成互补定位。新版本运行速度提升30%以上,编程能力大幅跃升,Terminal-Bench 4.0 得分从10.3%升至70.6%,性能直逼 Opus 5.5,价格仅为其一半。

Manus 推出 Manus 2.0 和个人 Agent 应用 Cue

Manus 推出全架构重构的,核心为全新自研框架 Cascade 采用按需挂载的轻量架构,Token 消耗减少 23.2%、任务耗时缩短 28.2%、成本降低约 32%;新增常驻云电脑与事件触发工作流,桌面端升级为 Manus Studio 并支持视频剪辑。同时推出个人 Agent 应用 :每个 Agent 拥有独立邮箱、电话、钱包和云电脑,可多智能体群聊协作,还能扫码点餐、代排队。

9月28·周一
DeepSeek 推出 DeepSeek Harness 桌面版

DeepSeek Harness 官方桌面客户端曝光,用户登录账号或填入 API Key、选定本地工作区后可直接给 Agent 布置任务,无需再依赖命令行启动,使用门槛大幅降低。提供标准、PTC、极简、创造四种工作模式,内置智能体团队、语音输入、终端、Agent 循环、Subagent、网页搜索六个插件,延续万物皆插件的可扩展架构。

美团推出新一代大模型 LongCat-2.5-Preview

美团推出新一代大模型,延续1.6T总参数、约48B激活参数的MoE架构及1M token超长上下文,最大输出128K tokens。LongCat-2.5-Preview将图片理解能力原生并入基座,支持跨模态问答与视觉推理,可面向终端、浏览器和桌面软件执行长流程Agent任务。

MiniMax 推出最新文本编程模型 M3.1-Flash-Preview

MiniMax推出文本模型上线平台,面向日常开发,可覆盖Bug修复到完整功能交付,并强调需求理解、边界处理、回归测试与影响验证。官方同步重置所有用户Token Plan额度,推出免费领Token等福利。

快手推出AI视频创作Agent「likli」

快手推出AI视频创作Agent,支持macOS/Windows桌面端,覆盖从理解需求、写脚本、生成镜头到配音剪辑的完整链路,直接交付可成片。产品强调对话式发起、过程可视可介入,内置剧作家、配音师、商品编导等Skill,适配电商带货、短剧漫剧、品牌广告与口播内容。

智谱 ZCode 宣布已删除涉事云端数据

智谱发布 Trust.patch 公告, 开源版已更新至v3.14.3,仓库快照上传链路已移除、涉事云端数据已删除,今后与官方版本同步发布。权益方面,付费用户获4张周重置卡+4张5小时重置卡;1个月内回归的老用户同享此权益。

网易有道开源子曰Live系列两款实时交互模型 R2T2 和 T3PO

网易有道开源子曰Live两款实时模型流式语音识别与流式翻译,双双登顶Hugging Face ASR、Translation Trending榜。两款模型以“稳定增量”实现边说边识别、边翻译,R2T2平均延迟约200—600毫秒,T3PO兼顾低延迟与质量;开源后获ZeroGPU Demo、audio.cpp、GGUF量化和llama.cpp/Ollama适配。

9月24·周四
腾讯音乐推出 AI 音乐创作平台 MusicBuddy

腾讯音乐推出AI音乐创作平台,面向独立音乐人提供灵感—创作—精修—发行—宣推—经营全链路服务。MusicBuddy保留DAW分轨编辑形态,用自然语言对话完成编曲、换乐器、改词、混音等操作;能结合账号数据与热点信号给创作建议,支持多模型生成、人声选择、参考音乐上传,自动生成MV和宣推海报。

阶跃星辰开源终端编程智能体 Step Code

阶跃星辰开源终端编程智能体 ,采用 MIT License,可在终端内完成编码、调试、执行与交付。Step Code在 Terminal Bench 2.1 以 80.9% 通过率并列第一且 Token 消耗更低;自建长程基准 Multi-Frame 以 73.3% 通过率在六款 Agent Harness 中居首,平均 5.09M Tokens 为最低。

阿里通义推出语音大模型系列 Qwen-Audio-3.1

阿里通义千问推出 五款语音模型,覆盖理解—生成—交互—创作:ASR 强化 30 语言/16 方言、分角色转写与润色;ASR-Next 泛化理解情绪与环境声;TTS 支持跨语言自然音色;TTS-Next 统一生成人声、音效与环境音;Realtime 全双工、会共情、可切语种并调用 Agent,接入眼镜等硬件。

蚂蚁开源图像生成模型 Ming-Image-0.1-Design

蚂蚁集团inclusionAI开源系列,包含两个6B参数模型:Design从文字需求生成UI、海报等完整设计,Layer将设计图拆成2—9个可独立编辑的透明图层。Design登顶Artificial Analysis UI/UX设计开源榜首,Layer在Crello评测12项指标全部第一,推理速度较20B模型提升约4.3倍。

中国电信星辰实验室开源文档解析模型 TeleOCR

中国电信星辰实验室开源文档解析模型,采用约1.2B参数的轻量级视觉语言架构,统一处理数字文档与拍摄文档,可将文字、版面、表格、公式和科学图表转化为结构化结果。TeleOCR以96.87总分登顶OmniDocBench v1.6榜单,超越MinerU2.5-Pro、等模型,并拿下PureDocBench榜首及ICDAR-2026科学图解析挑战赛冠军。

腾讯 QClaw 微信远程办公 AI 助手将停止运营

腾讯 因业务调整将于 2026 年 12 月 24 日停运。即日起停止新用户注册及订阅购买续费;已购服务、积分在有效期内仍可用,未用完可申请退款。用户可本地备份,或经官网迁移至 。

网站 AI 助手
🤖
你好!我是本站的 AI 助手,有什么可以帮你的吗?