ai-tab

帅气的我简直无法用语言描述!
OpenAI Sora 2模型发布:AI视频生成进入新纪元,公司估值突破5000亿美元

OpenAI Sora 2模型发布:AI视频生成进入新纪元,公司估值突破5000亿美元

OpenAI发布新一代视频生成模型Sora 2,实现音视频同步生成与物理规律精准模拟。其社交应用凭借Cameo功能两天获16.4万下载,推动公司估值达5000亿美元。
11个月前
OpenAI宣布将ChatGPT转变为开放平台,欲打造下一代互联网核心入口

OpenAI宣布将ChatGPT转变为开放平台,欲打造下一代互联网核心入口

OpenAI在2025年DevDay宣布将ChatGPT升级为开放平台,允许第三方应用集成。本文深度解析其操作系统级野心、AgentKit开发工具与8亿用户生态,探讨AI智能体如何重塑流量入口与商业格...
11个月前
谷歌AI科研编程系统 – 自动生成专家级科学软件

谷歌AI科研编程系统 – 自动生成专家级科学软件

科研手动编写软件效率低下。谷歌AI系统融合LLM与树搜索,自动生成和优化科学软件,在scRNA-seq批整合、COVID-19预测等多项任务上性能超越人类专家方案。
1年前
华为开源7B参数openPangu-Embedded-7B-v1.1

华为开源7B参数openPangu-Embedded-7B-v1.1

华为开源openPangu-Embedded-7B-v1.1模型,首创快慢思考双模式自由切换技术。通过渐进式微调和自适应机制,在保持精度的同时将思维链缩短近50%,显著提升推理效率,支持边缘部署与复杂...
1年前
Claude重磅更新,可创建编辑Excel、Word、PPT和PDF并输出可用格式

Claude重磅更新,可创建编辑Excel、Word、PPT和PDF并输出可用格式

Claude现可直接创建和编辑Excel、PPT、PDF及文档!上传数据即可自动生成统计分析、可视化图表及专业报告,支持跨格式智能转换。免费体验AI驱动的一站式办公解决方案,大幅提升工作效率。立即体验...
1年前
Qwen3-ASR-Flash – 阿里通义录音文件识别模型

Qwen3-ASR-Flash – 阿里通义录音文件识别模型

阿里通义千问Qwen3-ASR-Flash是一款高精度语音识别模型,支持11种语言及多种方言口音。其创新上下文引导机制可定制识别结果,提升专业术语准确率。在复杂噪声环境、歌声转写(错误率低于8%)及多...
1年前
Seedream 4.0 – 字节跳动多模态4K图像生成模型|免费AI创作工具

Seedream 4.0 – 字节跳动多模态4K图像生成模型|免费AI创作工具

Seedream 4.0是字节跳动推出的新一代多模态图像模型,支持4K高清生成与编辑,融合文本+图像输入,实现多图融合、风格迁移、精准修图,10倍提速,适用于电商、设计、影视创作。
1年前
混元图像 2.1 – 一种用于高分辨率(2K)文本到图像生成的高效扩散模型

混元图像 2.1 – 一种用于高分辨率(2K)文本到图像生成的高效扩散模型

寻找能生成高质量2K图像且原生支持中文的开源AI绘画模型?腾讯混元图像2.1来了!本文带你详细了解其原理、优势,并提供从环境配置到生成第一张图片的完整指南,附赠PromptEnhancer提示词优化技...
1年前
Karpathy发布全新Vibe Coding指南,提出三层AI编程结构

Karpathy发布全新Vibe Coding指南,提出三层AI编程结构

Andrej Karpathy提出三层AI编程架构,通过Cursor自动补全(75%日常任务)、Claude Code功能实现、GPT-5 Pro深度调试的分层协作,重塑开发效率模型。本文详解架构设计...
1年前
阿里通义APP上线形象自定义功能,可自由设定AI助手形象、声音等。

阿里通义APP上线形象自定义功能,可自由设定AI助手形象、声音等。

通义APP上线全新形象自定义功能,支持更换助手形象、克隆声音、设定人设,打造专属AI分身。提供20+音色选择,AI帮写人物设定,开启个性化智能交互体验。
1年前