OpenAI Sora 2模型发布:AI视频生成进入新纪元,公司估值突破5000亿美元OpenAI发布新一代视频生成模型Sora 2,实现音视频同步生成与物理规律精准模拟。其社交应用凭借Cameo功能两天获16.4万下载,推动公司估值达5000亿美元。AI快讯# ai视觉模型# OpenAI# Sora11个月前
OpenAI宣布将ChatGPT转变为开放平台,欲打造下一代互联网核心入口OpenAI在2025年DevDay宣布将ChatGPT升级为开放平台,允许第三方应用集成。本文深度解析其操作系统级野心、AgentKit开发工具与8亿用户生态,探讨AI智能体如何重塑流量入口与商业格...AI快讯# ChatGPT开放平台11个月前
谷歌AI科研编程系统 – 自动生成专家级科学软件科研手动编写软件效率低下。谷歌AI系统融合LLM与树搜索,自动生成和优化科学软件,在scRNA-seq批整合、COVID-19预测等多项任务上性能超越人类专家方案。AI项目和框架# 编程ai# 谷歌1年前
华为开源7B参数openPangu-Embedded-7B-v1.1华为开源openPangu-Embedded-7B-v1.1模型,首创快慢思考双模式自由切换技术。通过渐进式微调和自适应机制,在保持精度的同时将思维链缩短近50%,显著提升推理效率,支持边缘部署与复杂...AI项目和框架# ai模型# 华为# 大语言模型1年前
Claude重磅更新,可创建编辑Excel、Word、PPT和PDF并输出可用格式Claude现可直接创建和编辑Excel、PPT、PDF及文档!上传数据即可自动生成统计分析、可视化图表及专业报告,支持跨格式智能转换。免费体验AI驱动的一站式办公解决方案,大幅提升工作效率。立即体验...AI快讯# claude# 文件处理1年前
Qwen3-ASR-Flash – 阿里通义录音文件识别模型阿里通义千问Qwen3-ASR-Flash是一款高精度语音识别模型,支持11种语言及多种方言口音。其创新上下文引导机制可定制识别结果,提升专业术语准确率。在复杂噪声环境、歌声转写(错误率低于8%)及多...AI项目和框架# ai模型# 语音文件识别# 语音模型1年前
Seedream 4.0 – 字节跳动多模态4K图像生成模型|免费AI创作工具Seedream 4.0是字节跳动推出的新一代多模态图像模型,支持4K高清生成与编辑,融合文本+图像输入,实现多图融合、风格迁移、精准修图,10倍提速,适用于电商、设计、影视创作。AI项目和框架# AI图像框架# ai模型# 字节跳动1年前
混元图像 2.1 – 一种用于高分辨率(2K)文本到图像生成的高效扩散模型寻找能生成高质量2K图像且原生支持中文的开源AI绘画模型?腾讯混元图像2.1来了!本文带你详细了解其原理、优势,并提供从环境配置到生成第一张图片的完整指南,附赠PromptEnhancer提示词优化技...AI项目和框架# AI图像框架# Tencent# 混元大模型1年前
Karpathy发布全新Vibe Coding指南,提出三层AI编程结构Andrej Karpathy提出三层AI编程架构,通过Cursor自动补全(75%日常任务)、Claude Code功能实现、GPT-5 Pro深度调试的分层协作,重塑开发效率模型。本文详解架构设计...AI快讯1年前
阿里通义APP上线形象自定义功能,可自由设定AI助手形象、声音等。通义APP上线全新形象自定义功能,支持更换助手形象、克隆声音、设定人设,打造专属AI分身。提供20+音色选择,AI帮写人物设定,开启个性化智能交互体验。AI快讯# 阿里巴巴1年前