只读信息流

今日情报

今日 24 条推荐,19 条新消息,近 7 天历史,另有 159 条候选落选。这是只读分享页,不连接私人控制台。

推送时间 2026-08-04 07:42
24主推
19新消息
7历史
07:42数据更新于

今天

雷达增量

12 条

MiniMax H3单卡RTX 5090生成

新消息全文MiniMax (@minimax_ai)发布 08/04 05:16 · 收录 08/04 07:40

MiniMax宣布H3模型可在单张RTX 5090上本地生成内容,仅需几分钟,从文本提示生成,标志本地AI能力重大突破。

看点降低算力成本,本地运行AI模型,直接影响你的工具链选择。

免费使用Claude Code等AI编码工具

新消息摘录GitHub Trending发布 08/04 07:21 · 收录 08/04 07:42

开源项目 free-claude-code 允许从终端、应用、IDE 或手机免费使用 Claude Code、Codex 和 Pi,支持语音,类似 OpenClaw,Python 实现,已获 4.4 万星。

看点直接降低你的 AI 工具成本,免费替代付费编码助手,值得立即尝试。

OpenAI优化语音会话架构

新消息全文OpenAI (@openai)发布 08/04 04:38 · 收录 08/04 07:40

OpenAI介绍ChatGPT Voice改进:音频走专用快速路径,推理异步,启动从六次网络往返减至一次,提升响应速度。

看点语音交互性能提升,影响你构建语音Agent的体验与成本。

OpenAI新模型2千美元解决10个数学难题

新消息全文OpenAI (@openai)发布 08/04 02:54 · 收录 08/04 07:40

OpenAI内部版下一代模型用约2000美元token在数学和理论计算机科学领域取得10项新成果。

看点官方确认AI推理能力突破,影响对模型能力与成本比的判断。

OpenAI Astra模型2千美元解决10个数学难题

新消息全文Rohan Paul (@rohanpaul_ai)发布 08/04 04:06 · 收录 08/04 07:40

OpenAI内部版Astra模型用约2000美元token解决了10个长期未解数学问题,成本低于送2人参会。

看点证明AI推理能力飞跃,可能改变对模型能力与成本比的判断。

Hermes Agent 借 NeMo Relay 大幅提效

新消息全文NVIDIA AI (@nvidiaai)发布 08/04 00:07 · 收录 08/04 07:40

NVIDIA AI 宣布 Hermes Agent 通过与 NeMo Relay 集成及多项策略,显著提升效率,尤其对小型/弱/本地模型效果明显。

看点本地小模型 Agent 效率提升,直接降低你的推理成本与延迟。

Cursor插件直连Google Workspace

新消息全文Cursor (@cursor_ai)发布 08/04 04:31 · 收录 08/04 07:40

Cursor推出新插件,让Agent能直接读写Gmail、Drive、Calendar、Docs和Sheets,实现跨应用操作。

看点可直接用Cursor构建自动化工作流,节省集成成本。

Levelsio展示AI视频编辑Agent

新消息全文Pieter Levels (@levelsio)发布 08/04 07:33 · 收录 08/04 07:40

Pieter Levels开发AI视频编辑器,集成Cursor式侧边栏Agent,可自动剪辑视频,当前基础但已能自主完成编辑,并调用xAI。

看点展示AI视频编辑Agent落地案例,启发Jayden产品功能设计。

Cursor云Agent效率提升20-30%

新消息全文Cursor (@cursor_ai)发布 08/04 00:36 · 收录 08/04 07:40

Cursor云Agent token效率提升20-30%,计算机使用场景提升80%,改进MCP、技能和计算机使用处理。

看点直接降低Agent运行成本,提升任务委派能力。

v0推出API支持程序化构建应用

新消息全文v0 (@v0)发布 08/04 03:41 · 收录 08/04 07:40

v0发布新API,支持从提示、仓库或ZIP启动聊天,渲染预览,发送后续消息,并部署到Vercel。

看点可直接集成到开发流程,提升原型构建效率。

同一会话用subagent切换模型

新消息全文宝玉 (@dotey)发布 08/04 07:39 · 收录 08/04 07:40

宝玉分享:在同一session中可通过subagent指定不同模型执行任务,主agent负责调度,提升灵活性和效率。

看点直接提升Agent工具链使用效率,降低多模型切换成本。

AI自动化研究系统超越人工调优模型

新消息全文Rohan Paul (@rohanpaul_ai)发布 08/04 03:02 · 收录 08/04 07:40

Intology 的自动化研究系统 Locus 后训练出的模型,在基准测试中以 51.6% 对 49% 击败官方人工调优的 Qwen3-1.7B,显示 AI 可自主完成研究步骤。

看点AI 自动化研究能力提升,可减少你的研发人力成本,提高模型优化效率。

今天

AI HOT 精选

12 条

AirLLM 实现单块 4GB GPU 运行 70B 模型推理

新消息编辑摘要Hacker News 热门(buzzing.cc 中文翻译)发布 08/04 00:24 · 收录 08/04 07:40

AirLLM 项目支持在单块 4GB 显存 GPU 上运行 70B 参数大模型推理,无需多卡或大规模显存配置。该项目已开源,相关讨论在 Hacker News 上获得 103 点热度,引发社区关注。

欧盟《人工智能法案》透明度规则生效,违规最高罚 1500 万欧元

新消息编辑摘要The Verge:AI(RSS)发布 08/04 01:38 · 收录 08/04 07:40

欧盟《人工智能法案》下的新透明度义务于 8 月 2 日生效,要求公司披露用户何时与 AI 模型互动,并为合成音视频和文本添加机器可读标记。欧盟还推出了一套可选的 AI 披露标签供平台采用,但标注要求本身是强制性的。违规公司面临最高 1500 万欧元(约 1720 万美元)或全球年营业额 3% 的罚款,8 月 2 日前推出的模型有 4 个月宽限期。

Palantir 强劲季度后,CEO Alex Karp 称 AI 行业"马克思主义"

新消息编辑摘要TechCrunch:AI(RSS)发布 08/04 07:19 · 收录 08/04 07:40

Palantir CEO Alex Karp 在季度股东信中警告,前沿 AI 实验室对企业过于不可信,并称其意图"占有所谓合作伙伴的生产资料",带有"马克思主义色彩"。该公司第二季度营收 19 亿美元,同比增长 93%,利润 11 亿美元。Karp 主张 Palantir 提供模型无关的 AI 与分析软件,让企业掌控自身数据与 AI"废气"(提示词、编排、上下文)。

GPT-Live实时音频新架构发布

新消息编辑摘要X:Greg Brockman (@gdb)发布 08/04 06:25 · 收录 08/04 07:40

GPT-Live 是一种用于实时音频的新架构和栈: GPT-Live 可以在说话的同时聆听。 为了让这种体验在 ChatGPT 规模下显得自然,我们从客户端到模型重建了语音栈。 这一新架构让音频持续流动,因此更深入的推理和工具使用不会打断对话。

Claude Code 连接器可复用至 Artifacts

新消息编辑摘要X:Thariq (@trq212)发布 08/04 05:13 · 收录 08/04 07:40

我想很多人没有意识到--如果你连接了一个 Claude 连接器(例如你的 Gmail、日历、Slack 等),Claude Code 也将能够使用它们,包括在 Artifacts 中。

EA 首席战略官谈生成式 AI 如何进入可游玩的实时游戏世界

新消息编辑摘要Runway:News(网页)发布 08/04 04:12 · 收录 08/04 07:40

EA 首席战略官 Mihir Vaidya 认为,游戏是 AI 的试验场,但生成式 AI 进入游戏面临 60 帧/秒、数千玩家同步和低延迟等严苛约束,不能只追求"看起来真实",而必须"行为正确"。他主张采用神经符号架构,在生成能力之外保留确定性与可控性,并称"控制是下一个前沿"。EA 将 AI 影响分为效率、扩展和转型三个层面,其中《模拟人生》已服务超 5 亿玩家,拥有近万亿种游玩排列组合。

微软开源 Orchard 智能体训练框架

新消息编辑摘要X:Microsoft Research (@MSFTResearch)发布 08/04 03:43 · 收录 08/04 07:40

Orchard 是一个面向研究社区的开源框架,用于跨任务类型训练和评估 AI 智能体。它降低了复杂性,同时通过让研究人员复用同一套基础设施,支持较小模型也能实现强劲性能。https://msft.it/6019a8fqP

OpenRouter 推出 Ori Eval 简化评估流程

历史入档编辑摘要X:OpenRouter (@OpenRouter)发布 08/03 23:31 · 首次收录 08/04 07:40

推出 Ori Eval:编写首个评估的最简单方式。 没有绝对最好的模型,只有最适合每项任务的模型。Ori Eval 利用 OpenRouter 的 API 处理代码库中的每项任务,然后评估结果。 curl -fsSL https://openrouter.ai/skills/spawn-ori-eval

商汤发布 SenseNova U1.5-Lite-Preview 开源模型

历史入档编辑摘要X:商汤 SenseTime (@SenseTime_AI)发布 08/03 22:40 · 首次收录 08/04 07:40

商汤推出 SenseNova U1.5-Lite-Preview,一个基于 NEO-Unify 架构的轻量级原生统一多模态模型,仅 8B-MoT 参数即可达到商业闭源模型的生成与编辑质量。

Google Agent Skills 幕后:如何构建、测试与规模化

历史入档编辑摘要Google AI:DEV 作者专属(RSS)发布 08/03 22:33 · 首次收录 08/04 07:40

Google Agent Skills 团队详解其开源技能库的构建与治理流程:项目始于 Google Cloud Next 2026 前的"swarm"冲刺,发布后 GitHub 星标超 15,000。为保证规模化下的质量,每个技能须通过标准化目录结构、CI/CD 流水线(含 linter、链接检查、AI 辅助清单)及提交时与每周的持续评估,并优先引用远程 MCP 工具。

Cloudflare Workers 与 Containers 现已支持入站 TCP 连接和 gRPC

历史入档编辑摘要Cloudflare Blog发布 08/03 21:00 · 首次收录 08/04 07:40

Cloudflare 在 Agents Week 期间推出 Workers 运行时新处理器 connect(socket),可直接接受 Spectrum 提供的入站 TCP 套接字,并支持将套接字转发至 Durable Objects 或 Containers,实现全双工通信。