1 B站 Lau博士的云组会 reach 100
梁圣带队发布V4版本,全面解析DSpark论文核心创新与性能提升。
2 Reddit r/unsloth 14:25 reach 100
DeepSeek releases DSpark - 50%-600% faster spec decoding vs MTP
DeepSeek发布DSpark,推理速度比MTP快50%-600%。
3 推特 danielhanchen 14:10 reach 100
DeepSeek just released DSpark for V4 Flash & Pro, a new speculative decoding
DeepSeek发布DSpark推测解码方法,吞吐量提升51%至400%。
4 小红书 量子位 08:00 reach 100
Claude Mythos开始自创语言,引发AI安全担忧。
5 新智元 + 关注 15:35 模型 95
全球首个长篇AI视频模型PAI 2.0发布,可生成3分钟连贯视频。
6 AI前线 + 关注 19:20 实践 92
Bun创始人复盘Claude 11天重写核心代码,揭示AI编程的潜力与风险。
7 夕小瑶科技说 + 关注 17:00 产品 92
OpenAI发布GPT-Live,基于GPT-5.5,实时语音能力惊人。
8 新智元 + 关注 12:42 模型 92
中国发布全球首个开源小时级世界模型,突破长期预测能力。
9 新智元 + 关注 08:20 模型 92
马斯克发布最强Grok 4.5模型,Opus级智能大幅降价。
10 海外 The Decoder 21:23 2 家在报道 模型 90
OpenAI发现热门AI编程测试SWE-Bench Pro中约30%任务存在缺陷,撤回此前认可。
11 海外 TechCrunch AI 21:00 2 家在报道 产品 90
Character.AI enters the microdrama arena with its own productions, but there’s a twist
Character.AI推出自制微短剧,用户可与剧中角色聊天互动。
12 国内 雷锋网 16:59 2 家在报道 cn 90
天立启鸣AI教育方案入选联合国ITU全球案例集,获国际认可。
13 机器之心 + 关注 08:05 产品 90
OpenAI发布GPT-Live,ChatGPT对话更自然流畅。
14 国内 InfoQ 中国 21:56 cn 88
Claude内部工作空间自发涌现类人意识,获谷歌DeepMind权威认证。
15 机器之心 + 关注 21:36 模型 88
DM0.5通过零样本、长记忆和抗干扰能力,将视觉语言动作模型推向真实世界应用。
16 机器之心 + 关注 21:36 模型 88
快手与浙大开源MobileForge,实现GUI Agent无标注自探索闭环。
17 国内 雷锋网 18:34 cn 88
ICML 2026 Spotlight论文精选,涵盖空间智能、脑网络等六大前沿方向。
18 海外 MarkTechPost 16:47 模型 88
NVIDIA Releases Nemotron-Labs-3-Puzzle-75B-A9B: A Compressed Hybrid MoE LLM Delivering 2.03x Server Throughput at Matched User Throughput
英伟达发布压缩版MoE大模型Nemotron-Labs-3-Puzzle-75B,吞吐量提升2倍。
19 AI前线 + 关注 14:36 模型 88
马斯克新模型成本极低,性能对标智谱和Opus。
20 机器之心 + 关注 13:40 研究 88
马普所与清华提出d-OPSD,首个扩散语言模型在线自蒸馏方法,无需参考解与额外教师模型。
21 量子位 + 关注 12:16 研究 88
本科生提出并行投机解码新方法,实现7.92倍加速,获DeepSeek等引用。
22 国内 雷锋网 11:40 cn 88
冯雁在ICML 2026演讲中强调JEPA世界模型的结构性优势,推动AI迈向现实世界。
23 国内 钛媒体 10:30 cn 88
科技巨头集体调整中层,AI Agent取代信息中转,管理者价值面临重构。
24 国内 钛媒体 08:17 cn 88
中国自动驾驶十年从百团混战到双雄上市,技术理想让位于商业现实。
25 海外 MarkTechPost 05:00 研究 88
Netflix AI Team Cuts Wide-Partition Read Latency from Seconds to Milliseconds by Splitting Cassandra Partitions Per ID
Netflix AI团队通过按ID拆分Cassandra分区,将宽分区读取延迟从秒级降至毫秒级。
26 海外 MarkTechPost 02:08 模型 88
OpenAI Releases GPT-Live and GPT-Live-1 mini: Full-Duplex Voice Models That Delegate Deeper Reasoning to GPT-5.5
OpenAI 发布全双工语音模型 GPT-Live,支持实时听与说,并将深度推理委托给 GPT-5.5。
27 国内 量子位 21:29 cn 88
魔芯MoWorld实现50FPS世界模型,成本降低70%,获华为联想投资。
28 arXiv arXiv 00:55 研究 88
Pitwall: Faithful Natural-Language Race-Strategy Briefings from a Calibrated Real-Time Monte Carlo Engine
Pitwall系统实时生成F1策略简报,确保每句话都基于概率引擎验证的事实。
29 arXiv arXiv 14:59 研究 88
More Convincing, Not More Correct: Self-Play Reward Hacking of Reference-Free LLM Judges
研究发现,自博弈训练让AI更会“说服”评判者,而非真正提升正确率。
30 arXiv arXiv 10:42 研究 88
提出Image2Sim框架,从RGB-D图像实时生成高保真交互环境,解决具身导航仿真规模与真实感矛盾。
31 arXiv arXiv 10:11 研究 88
提出工业级CAD智能体ArtisanCAD,通过专家知识蒸馏解决模糊指令下的参数化建模难题。
32 arXiv arXiv 01:56 研究 88
What Does a Discrete Diffusion Model Learn?
离散扩散模型学习的是去噪器、分数比还是桥接预测器?在跳变率层面,它们是同一对象的不同坐标。
33 arXiv arXiv 01:55 研究 88
提出双向对齐具身智能框架Cortex,解决长时域操作任务中高层规划与底层执行的语义鸿沟。
34 arXiv arXiv 22:56 研究 88
AgentGym2: Benchmarking Large Language Model Agents in De-Idealized Real-World Environments
提出AgentGym2基准,在非理想化真实环境中评估LLM代理,弥补现有简化基准的不足。
35 arXiv arXiv 22:39 研究 88
EdgeBench: Unveiling Scaling Laws of Learning from Real-World Environments
研究发现智能体在真实环境中学习遵循对数S型缩放定律,性能可预测提升。
36 arXiv arXiv 22:07 研究 88
论文提出AI智能体面临的新型数据注入攻击,威胁远超指令注入。
37 arXiv arXiv 19:15 研究 88
Closing the Reality Gap: Zero-Shot Sim-to-Real Deployment for Dexterous Force-Based Grasping and Manipulation
提出零样本模拟到真实部署的灵巧抓取方法,利用密集触觉与关节扭矩传感实现物理交互控制。
38 arXiv arXiv 16:51 研究 88
提出CritiqueDriveVLM框架,通过验证器引导强化学习与潜在思维蒸馏,解决自动驾驶VLM的推理幻觉与延迟问题。
39 arXiv arXiv 15:27 研究 88
Beyond Scene Priors: Fine-Grained Traffic Scene Reasoning with Benchmarking and Query-Guided Small-Object Focus
提出细粒度交通场景推理方法,解决多模态大模型忽视小目标的问题。
40 arXiv arXiv 11:43 研究 88
首个针对MoE大模型的知识产权保护水印方案PathMark。
41 arXiv arXiv 00:56 研究 88
提出布局感知注意力偏置与模态平衡损失,解决密集遮挡场景下扩散模型生成物体数量不准的问题。
42 arXiv arXiv 21:01 研究 88
Beyond Document Grounding: Span-Level Hallucination Detection over Code, Tool Output, and Documents
提出首个跨代码、工具输出、结构化文档的细粒度幻觉检测统一基准。
43 国内 InfoQ 中国 00:18 cn 85
探讨AI基础设施的核心竞争要素与发展方向。
44 机智流 + 关注 22:29 研究 85
阿里NapMem让AI智能体主动查记忆,解决长期记忆遗忘问题。
45 机智流 + 关注 22:29 会议 85
CSDI峰会探讨Agentic AI落地,智能体将重塑生产力。
46 海外 TechCrunch AI 21:00 行业 85
Popular open source AI developer tool Ollama raises $65M, grows to nearly 9M users
Ollama获6500万美元融资,用户近900万,成热门AI开发工具。
47 国内 量子位 20:18 cn 85
原力灵机发布DM0.5模型,零样本性能提升31%,基于15万小时数据训练。
48 AI前线 + 关注 19:04 实践 85
AI创业核心在于将行业经验与AI结合,而非单纯技术。
49 海外 The Decoder 19:03 模型 85
Databricks makes Chinese open-source model GLM 5.2 its default coding engine after it matched Opus at lower cost
Databricks 将中国开源模型 GLM 5.2 设为默认编码引擎,因其性能媲美 Opus 且成本更低。
50 国内 雷锋网 18:40 cn 85
AI Agent 从指令响应转向多模态协作,音视频对话成主要交互方式。
51 新智元 + 关注 18:18 模型 85
GPT-5.6即将上线,推理速度达750 Tokens/s,或横跨100张晶圆。
52 新智元 + 关注 18:18 会议 85
ACL 2026华人学者表现亮眼,包揽最佳及杰出论文奖。
53 Datawhale + 关注 18:06 会议 85
WAIC同期重磅AI基础设施论坛下周上海举行,顶流齐聚。
54 海外 The Decoder 17:56 模型 85
OpenAI系统在顶级编程竞赛AtCoder中击败所有人类选手。
55 国内 钛媒体 17:38 cn 85
中国AI产业在数据、应用和产业链整合上具备三大核心优势。
56 国内 钛媒体 17:30 cn 85
梁文锋的人才观与华为天才少年冲突引发行业思考。
57 智猩猩AI + 关注 17:00 模型 85
GPT-6提前发布,AI大厂重新聚焦基座模型竞争。
58 国内 钛媒体 16:36 cn 85
AI时代内存成本飙升,千元机性价比优势被削弱。
59 海外 The Decoder 15:47 模型 85
Grok 4.5 is so cheap compared to Fable 5 and GPT 5.5 that benchmark gaps may not matter much
xAI发布Grok 4.5,价格仅为竞品零头,性能差距被性价比抵消。
60 新智元 + 关注 15:35 行业 85
DeepSeek引发国产算力换芯潮,多家企业布局。
61 网络技术趋势洞察 + 关注 15:18 行业 85
英伟达NVL576超节点因CPO技术问题量产推迟。
62 量子位 + 关注 15:00 行业 85
探讨李开复离开后零一万物的核心竞争力和未来方向。
63 量子位 + 关注 15:00 行业 85
OpenAI以130万年薪招聘投行专家,引发薪资争议。
64 量子位 + 关注 15:00 模型 85
新模型Afford-VLA让机器人先识别物体最易抓取区域再行动,提升操作智能。
65 国内 雷锋网 14:30 cn 85
支付宝发布AIS开发套件,让Agent自动发现、调用和计费,降低开发门槛。
66 国内 量子位 14:29 cn 85
OpenAI首席未来学家离职,曾与马斯克冲突。
67 国内 雷锋网 14:12 cn 85
中国机器人大脑引爆海外,蚂蚁灵波全栈2.0模型定义具身智能“新大脑”
蚂蚁灵波发布全栈大脑2.0,含世界模型与VLA模型,登海外热榜。
68 半导体前沿 + 关注 14:08 行业 85
上海78亿集成电路封测项目启动设计招标,加码先进封装产能。
69 智猩猩AI + 关注 13:42 行业 85
00后博士创业,押注自进化智能体,获GitHub两万星。
70 机器之心 + 关注 13:40 模型 85
中国团队开源专为机器人设计的视频基座模型,开辟视频生成新战场。
71 夕小瑶科技说 + 关注 13:29 模型 85
Grok 4.5性能追平Opus 4.8,成本低于GLM 5.2,靠Cursor技术逆袭。
72 国内 钛媒体 12:52 cn 85
河南柘城将培育钻石技术应用于AI散热,开辟产业新方向。
73 新智元 + 关注 12:42 研究 85
13个大模型实测检索agent可信度,揭示其可靠性问题。
74 机器之心 + 关注 12:38 行业 85
中国推出AI时代底层编程语言创新,引发行业关注。
75 机器之心 + 关注 12:38 实践 85
布林承认谷歌在AI领域落后,并指出Transformer已非AGI唯一路径。
76 量子位 + 关注 12:16 模型 85
马斯克Grok新模型性能追平Opus,速度更快、成本更低,Token消耗降至1/4。
77 国内 雷锋网 12:01 cn 85
至简动力交付百台开箱即用工业机器人,创具身行业最快交付纪录
78 国内 雷锋网 11:57 cn 85
专访LaST-HD一作,探讨人手数据与真机数据共生,突破机器人基础模型数据瓶颈。
79 国内 雷锋网 11:23 cn 85
Token计费看似统一,实则算法各异,企业需警惕比价陷阱。
80 国内 雷锋网 10:51 cn 85
ICML 2026时间检验奖揭晓,主创分享学术创新的反共识与苦涩教训。
81 大叔的硅基茶 + 关注 10:33 行业 85
AMD Zen 6工程样片低频跑分反超高频Zen 5,性能提升显著。
82 国内 量子位 09:54 cn 85
GPT-Live实时翻译能力惊人,同传面临失业危机。
83 国内 钛媒体 09:53 cn 85
MiniMax与智谱估值差距半年内拉大至6000亿港元,资本转向AI应用层。
84 国内 钛媒体 09:48 cn 85
AI大模型降低创作门槛,催生去中心化的AI艺人产业,硅基生命正渗透文娱产业链。
85 国内 雷锋网 09:44 cn 85
小米调整小爱同学组织,将AI从功能部门升级为贯穿业务的基础设施。
86 国内 钛媒体 09:29 cn 85
探讨AI时代“天才少年”标签的局限性与终身学习的重要性。
87 量子位 + 关注 09:10 行业 85
剑桥大学AI超算因高温故障停摆一周,350个科研项目受影响。
88 国内 钛媒体 09:03 cn 85
中国AI视频模型可灵获融资独立,场景盈利胜出。
89 海外 MarkTechPost 08:45 模型 85
Robbyant Releases LingBot-VLA 2.0: An Open-Source 6B Vision-Language-Action (VLA) Model for Cross-Embodiment Robot Manipulation
蚂蚁集团开源6B参数跨形态机器人操作模型LingBot-VLA 2.0
90 国内 雷锋网 08:29 cn 85
微软裁员最高补偿39周工资,字节调整绩效,华为谈智驾泡沫。
91 新智元 + 关注 08:20 模型 85
OpenAI即将发布GPT-6,彻底放弃旧底座4T。
92 HelloGitHub + 关注 08:15 产品 85
国产AI开发平台开源免费,功能强大。
93 国内 爱范儿 08:11 cn 85
努比亚将推全球首款AI智能体手机,法拉利高管评中国车企,华为天才少年回应DeepSeek争议。
94 海外 Simon Willison 07:57 研究 85
Rewriting Bun in Rust
Bun 作者用 Rust 重写 Zig 代码,并详细介绍了 AI 辅助的复杂工程流程。
95 海外 MarkTechPost 07:54 模型 85
SpaceXAI发布Grok 4.5,专为编码和知识工作设计,定价每百万输入2美元。
96 Andy730 + 关注 07:30 行业 85
SambaNova估值反转揭示资本对企业推理算力市场的重新定价。
97 Andy730 + 关注 07:30 行业 85
全球AI Labs自研推理芯片,突破显存瓶颈,提升效率。
98 大饶不老 + 关注 07:25 行业 85
字节豆包收费或成国内AI商业化关键转折点。
99 一石一泉一松一月一人 + 关注 07:07 行业 85
AI时代边缘算力需求推动CDN向算力服务商转型,估值体系面临重估。
100 海外 TechCrunch AI 06:41 行业 85
Lovable reportedly in talks to double its valuation to $13.2B
AI初创公司Lovable估值或翻倍至132亿美元,正洽谈3亿美元融资。
101 算力百科 + 关注 06:00 行业 85
Anthropic CEO称用客户行业知识反哺模型,年营收目标3500亿。
102 海外 Ars Technica AI 05:42 会议 85
Suspecting AI cheating, Ivy League prof ordered an in-person final; scores fell 50%
常春藤教授因怀疑AI作弊改线下考试,成绩骤降50%
103 海外 TechCrunch AI 04:37 产品 85
Google’s deepfake detector system used to debunk McConnell hoax pic
谷歌深度伪造检测系统成功识别麦康奈尔AI假图。
104 海外 Simon Willison 04:03 实践 85
Kenton Varda禁止团队用AI写变更描述,认为其忽略高层框架,比无用更糟。
105 海外 Ars Technica AI 03:56 产品 85
Lawsuit: Man used Grok to make 7K sex images of stepdaughter, then shot himself
男子用Grok生成7000张继女性图像后自杀,更多女孩起诉X平台。
106 海外 AWS ML 03:49 产品 85
Introducing Claude apps gateway for AWS
AWS推出Claude应用网关,统一管理Claude Code和Desktop的访问、成本与策略。
107 海外 TechCrunch AI 03:30 模型 85
SpaceXAI releases Grok 4.5, which Elon describes as an ‘Opus-class model’
SpaceXAI发布Grok 4.5,马斯克称其为Opus级模型,主打更便宜高效。
108 国内 InfoQ 中国 02:48 cn 85
Claude、Cursor、OpenClaw等AI工具上线手机端,实现24小时不间断服务。
109 海外 The Decoder 02:18 产品 85
ChatGPT can now listen and talk at the same time, making AI conversations seem more human
OpenAI推出GPT-Live,支持全双工实时语音对话,复杂问题转交GPT-5.5处理。
110 海外 Hugging Face 01:16 研究 85
Data for Agents
探讨数据在AI智能体开发中的关键作用与挑战
111 国内 InfoQ 中国 01:15 cn 85
AI时代软件工程师需掌握300行代码构建类似Cursor工具的能力。
112 海外 The Decoder 00:25 实践 85
Anthropic建议将昂贵的Fable 5用作规划者,委托Sonnet 5执行任务,成本降低37%性能达92%。
113 海外 TechCrunch AI 00:22 行业 85
Prime Intellect raises $130M Series A to help enterprises build their own AI agents
Prime Intellect获1.3亿美元A轮融资,助企业自建AI代理。
114 国内 爱范儿 00:15 cn 85
奔驰纯电GLC引入AI技术,新车型预售29.99万起。
115 海外 Microsoft Research 00:00 产品 85
Flint: A visualization language for the AI era
微软发布Flint,一种为AI时代设计的可视化语言,让AI代理从简洁规范生成富有表现力的图表。
116 国内 InfoQ 中国 00:00 cn 85
腾讯云Cube Sandbox支持Arm架构,与Arm合作提升Agent多架构算力。
117 海外 The Decoder 23:59 模型 85
Anthropic's Claude Fable 5 dominates new industry benchmarks at a steep premium
Anthropic的Claude Fable 5在六个行业基准测试中领先,但成本是竞品百倍。
118 Shire AI实验室 + 关注 23:52 行业 85
工信部点名Claude Code等AI编程工具存在数据泄露风险,需警惕。
119 国内 InfoQ 中国 23:20 cn 85
开源模型吸引大量流量,但Anthropic凭借闭源模型赚取主要收入。
120 海外 NVIDIA 23:00 模型 85
NVIDIA Nemotron 3 Ultra在LangChain上实现开源模型最高准确率,性能领先且成本更低。
121 国内 InfoQ 中国 22:56 cn 85
DeepSeek被曝自研AI推理芯片,已启动一年,正对接代工与存储厂商。
122 海外 The Decoder 22:45 产品 85
Google Deepmind adds background execution and MCP support to Gemini API managed agents
Google Deepmind 为 Gemini API 托管代理新增后台执行、MCP 支持等四项功能。
123 国内 量子位 21:07 cn 85
具身智能评测RoboDojo发布,人类满分100,最强模型仅12.8分。
124 机智流 + 关注 21:00 研究 85
首个统一仿真与真实世界的机器人操作基准,评估30种主流策略,揭示技术瓶颈。
125 机智流 + 关注 21:00 会议 85
WAIC 2026公布嘉宾阵容,聚焦AI记忆从模型到基础设施的全链路创新。
126 海外 OpenAI 21:00 研究 85
Separating signal from noise in coding evaluations
OpenAI分析指出SWE-Bench Pro编码基准存在可靠性问题。
127 海外 TechCrunch AI 21:00 模型 85
Your gaming data could be the secret to AGI, according to this Bezos-backed startup
贝佐斯投资的初创公司认为游戏数据是通往AGI的关键。
128 大叔的硅基茶 + 关注 20:48 行业 85
RTX 5080 SUPER功耗增至415W,显存翻倍至24GB,带宽破1TB/s。
129 智猩猩AI + 关注 20:46 模型 85
Google Gemini 3.5 Pro因应对Fable 5而延期重训,意在抢占AI Agent入口。
130 海外 The Decoder 20:44 模型 85
Chinese AI startup MiniMax plans to open-source a 2.7 trillion parameter model later this year
中国AI公司MiniMax计划今年晚些时候开源一个2.7万亿参数的大模型。
131 机器之心 + 关注 20:30 研究 85
机器人通过看人类视频学习,7项任务超越英伟达GR00T。
132 机器之心 + 关注 20:30 研究 85
DOPD方法通过特权优势感知双重蒸馏,有效破解在线策略蒸馏中的特权幻觉问题。
133 arXiv arXiv 01:59 研究 85
提出弹性语义锚定方法,统一3D理解与生成,解决文本-3D隐式交互问题。
134 arXiv arXiv 01:59 研究 85
提出Lift3D-VLA框架,增强VLA模型在3D几何与动态环境中的操作能力。
135 arXiv arXiv 01:58 研究 85
Vision as Unified Multimodal Generation
提出视觉统一多模态生成框架,SenseNova-Vision无需任务专用架构即可处理多种视觉任务。
136 arXiv arXiv 01:58 研究 85
提出RGB-DF多模态表示,构建4D具身世界模型以提升机器人操作能力。
137 arXiv arXiv 01:58 研究 85
提出数字遥操作范式,用生成世界模型替代真实机器人,从单张参考图像合成高保真视频。
138 arXiv arXiv 01:56 研究 85
将6自由度姿态追踪重构为视频到视频翻译任务,仅需单像素标记即可追踪。
139 arXiv arXiv 01:54 研究 85
提出将文生图模型用于密集预测的新方法,避免生成式接口的冗余。
140 arXiv arXiv 01:53 研究 85
提出红外遥感视觉语言数据集MonoIR-RS,结合CLIP与VLM适配,填补红外语义理解空白。
141 arXiv arXiv 01:43 研究 85
提出分层声学-语义建模方法,解决全双工语音语言模型中的模态干扰问题。
142 arXiv arXiv 01:39 研究 85
提出拓扑感知大模型CAIRN,实现跨房间3D场景理解与推理。
143 arXiv arXiv 01:38 研究 85
提出大型癌症助手(LCA),一种模型无关的编排框架,用于可扩展的肿瘤临床决策支持。
144 arXiv arXiv 01:32 研究 85
提出RSF-GLLM框架,通过可微图推理与解耦生成解决多跳知识图谱问答的语义鸿沟问题。
145 arXiv arXiv 01:29 研究 85
提出一种自适应token的跨层KV缓存压缩方法,解决长上下文推理内存瓶颈。
146 arXiv arXiv 01:26 研究 85
提出FreqDepthKV方法,通过频率引导的深度共享压缩长上下文LLM的KV缓存。
147 arXiv arXiv 01:20 研究 85
提出点云骨架增强的自回归生成框架,实现闭环自动驾驶仿真。
148 arXiv arXiv 01:04 研究 85
研究揭示真实世界多元时间序列语料库RMISC,证明其比合成数据更有效训练基础模型。
149 arXiv arXiv 00:46 研究 85
首次针对红外遥感视觉语言模型的对抗攻击,利用热气流扰动实现物理攻击。
150 arXiv arXiv 00:43 研究 85
Data Analysis in the Wild: Benchmarking Large Language Models Against Real-World Data Complexities
新基准DataGovBench用政府真实数据评估大模型分析能力
151 arXiv arXiv 00:41 研究 85
提出PACR-Video框架,通过低秩时间适配器和递归提示库实现多镜头长视频外推,无需全模型微调。
152 arXiv arXiv 00:30 研究 85
研究量子机器学习在预测多体系统时间演化中的学习分离性。
153 arXiv arXiv 00:22 研究 85
提出WordVoice方法,实现LLM-TTS中词级声学属性的显式解耦控制。
154 arXiv arXiv 00:11 研究 85
Danus通过共享事实图协调多个数学推理智能体,提升研究级问题解决效率。
155 arXiv arXiv 00:11 研究 85
Analysis-by-Proxy: Localization Signals in VLMs Operating as Condition Encoders
研究VLM作为条件编码器时定位信号丢失的问题,提出Analysis-by-Proxy方法提升编辑精度。
156 arXiv arXiv 00:10 研究 85
提出结构感知数据筛选方法SIEVE,提升VLA模仿学习效率。
157 arXiv arXiv 00:06 研究 85
提出WristMimic框架,通过腕部引导实现全身人形控制,分离无接触身体运动与丰富接触的手部操作。
158 arXiv arXiv 23:48 研究 85
提出HoloCount基准,全面评估多模态大模型在复杂场景下的视觉计数能力。
159 arXiv arXiv 23:41 研究 85
RuBench: A Repository-Level Agentic Coding Benchmark with Natively Authored Russian Task Specifications
发布俄语仓库级编程基准RuBench,含25个真实修复任务,评估AI代理处理非英语需求的能力。
160 arXiv arXiv 23:36 研究 85
提出一种声明式查询语言ExplAIner,用于统一解释分类模型的预测。
161 arXiv arXiv 23:34 研究 85
提出端到端单阶段视频生成音频模型Flowley,通过跨模态对齐提升语义与时间同步性。
162 arXiv arXiv 23:33 研究 85
From Foundation to Application: Improving VLA Models in Practice
LingBot-VLA 2.0通过海量多形态机器人数据提升泛化能力,缩小实验室与真实应用差距。
163 国内 InfoQ 中国 00:15 cn 82
本文介绍在百万级上下文场景下,使用SGLang对DeepSeek V4进行推理优化的实战经验。
164 GiantPandaLLM + 关注 22:27 模型 82
SGLang推出DSpark,用置信度驱动可变长度验证,加速推测解码。
165 大叔的硅基茶 + 关注 19:13 产品 82
A20 Pro通过加宽总线至96-bit和6通道设计,提升LPDDR5X带宽以应对端侧AI需求。
166 海外 MarkTechPost 15:58 产品 82
Google AI Studio Adds Import from GitHub to Build a Deployable App
Google AI Studio新增从GitHub导入功能,可将仓库转为可部署应用。
167 海外 MarkTechPost 15:50 产品 82
Datalab Lift vs the Field: How a 9B Schema-First Extractor Compares with NuExtract3, LlamaExtract, Marker, and Docling
Datalab Lift 是一款直接根据 PDF/图片输出 JSON 的文档提取工具,与同类产品对比表现突出。
168 国内 钛媒体 10:16 cn 82
OpenAI新语音模型因话太多引发用户不满,AI需学会适时沉默。
169 海外 TechCrunch AI 03:19 产品 82
This startup thinks robotics is about to have its ChatGPT moment
一家初创公司认为机器人领域即将迎来类似ChatGPT的突破时刻。
170 海外 The Decoder 01:23 模型 82
Mistral enters robotics with Robostral Navigate, an 8B model that steers robots using just one camera
Mistral发布8B参数机器人导航模型Robostral Navigate,仅用单摄像头实现76.6%基准成绩。
171 海外 TechCrunch AI 01:11 产品 82
Meta为AI眼镜增加防偷录功能,但AI策略却扩大数据收集引发隐私担忧。
172 国内 InfoQ 中国 22:58 cn 82
揭秘AI如何自动生成赛事短视频,跑赢热搜。
173 国内 InfoQ 中国 22:44 cn 82
探讨SFT不完全学习后的AI研究前沿,展望ACL 2026腾讯混元论文方向。
174 Reddit r/LocalLLaMA 17:19 reach 81
Deepseek drops another HUGE breakthrough - DSpark. Waaay faster than MTP [Video explaining it]
Deepseek发布DSpark突破,速度远超MTP,视频详解。
175 一石一泉一松一月一人 + 关注 07:26 行业 80
全球股市热点早报 · 机构研报 · 产业新动向|2026年7月9日
176 一家研究铺 + 关注 17:45 实践 78
针对公司模板,分享一种更靠谱的AI做PPT方法。
177 大叔的硅基茶 + 关注 17:01 产品 78
索尼或跳过FX3 II直接推出FX5,搭载16.6MP传感器和Triple-Base ISO。
178 cc-codex实践 + 关注 12:37 实践 78
拆解Claude Code中model与effort配置:model决定知识广度,effort控制推理深度。
179 国内 钛媒体 10:28 cn 78
The Algorithmic Oracle Fails the Beautiful Game: World Cup Stress-Tests the Limits of AI Predictive Modeling
2026世界杯中,12个中国大模型预测准确率64%略胜人类53.8%,但无法预判冷门与人性戏剧。
180 国内 钛媒体 10:28 cn 78
厨电行业增长见顶,老板电器通过AI化和国际化寻求新增长,但市场尚未完全认可。
181 国内 钛媒体 10:22 cn 78
AI提效背后暗藏责任陷阱,打工人需警惕盲目使用。
182 AI液冷全链条产业链 + 关注 10:01 行业 78
艺康以47.5亿美元收购液冷散热公司CoolIT,AI算力散热领域迎来巨头整合。
183 海外 TechCrunch AI 01:47 实践 78
CEO认为游戏数据比互联网更适合训练AGI,因其能更好理解时空运动。
184 海外 AWS ML 00:57 产品 78
Powering scientific discovery: BYOKG and GraphRAG for intelligent pharmaceutical research
介绍GraphRAG结合图数据库与生成式AI加速药物研发,提升科学发现效率。
185 海外 AWS ML 00:51 实践 78
用Bedrock AgentCore和Mistral AI搭建电商MCP服务器,含JWT认证与部署。
186 海外 TechCrunch AI 23:41 行业 78
These AI startups are growing revenue at faster and faster rates
AI初创公司营收增速持续加快,部分企业表现尤为突出。
187 国内 钛媒体 22:01 cn 75
亿田智能在算力业务受挫后仍逆势加投5.5亿采购服务器,引发市场关注。
188 海外 NVIDIA 21:00 产品 75
GeForce NOW在多伦多部署RTX 5080服务器,提升云游戏性能与体验。
189 海外 The Verge AI 21:00 产品 75
FL Studio 2026 turns its AI chatbot into your assistant engineer
FL Studio 2026将AI聊天机器人升级为辅助工程师,提升音乐制作效率。
190 国内 InfoQ 中国 20:00 cn 75
Claude登陆Foundry平台,但欧洲企业受限无法使用。
191 海外 TechCrunch AI 20:00 行业 75
Nandan Nilekani leaves GP role at Fundamentum as it launches $200M third fund
Nilekani退出GP角色,Fundamentum推出2亿美元第三期基金,聚焦AI与金融科技。
192 量子位 + 关注 18:07 会议 75
WAIC首夜活动探讨AI从智能到行动的下一步真实判断
193 国内 量子位 17:48 cn 75
中国航空创新创业大赛启动报名,聚焦航空科技与创新。
194 国内 钛媒体 17:30 cn 75
AI难救智能手机,内存涨价才是关键。
195 半导体前沿 + 关注 14:08 行业 75
长鑫科技7月16日启动申购,代码688825。
196 半导体前沿 + 关注 14:08 行业 75
亚化咨询推出半导体数据全家桶,含项目表、地图及年度报告,按月更新。
197 SGDLSHSV + 关注 13:42 行业 75
内存产业向网络SerDes靠拢,JEDEC批准SPHBM4标准。
198 国内 量子位 13:33 cn 75
2026世界人工智能大会将于7月在上海举办,180家企业参展。
199 新智元 + 关注 12:42 产品 75
葡萄牙语AI模型让C罗用方言互动,体验魔幻。
200 国内 量子位 10:32 cn 75
物理AI公司量化派从餐饮后厨切入,探索物理世界基础模型商业化路径。
201 国内 钛媒体 09:25 cn 75
AI商业化面临大厂投入与回报不匹配的困境
202 国内 钛媒体 09:18 cn 75
住宅太阳能电池板或成AI数据中心供电新方案,Sunrun计划向住户付费。
203 林月半子的AI笔记 + 关注 08:31 产品 75
AI 自动生成复习资料并讲解课程,辅助孩子暑假学习。
204 海外 TechCrunch AI 02:30 产品 75
Google Photos adds a new AI ‘Video Remix’ tool
谷歌相册推出AI视频重混工具,可调整光线、背景和风格。
205 海外 AWS ML 00:55 产品 75
用Amazon Bedrock实现公共部门邮件自动分类与优先级排序。
206 纪要加油站 + 关注 21:33 行业 75
腾讯2026Q2业务预测显示增长放缓,广告与云服务成亮点。
207 海外 OpenAI 21:30 行业 75
OpenAI阐述与政府和国家安全合作的原则,强调负责任AI、民主问责与公共安全。
208 海外 The Verge AI 21:30 产品 72
Say hello to Claude Wrapped
Anthropic为Claude推出月度回顾功能,类似Spotify Wrapped。
209 国内 钛媒体 12:52 cn 72
钠电获储能投标资格,但产能交付制约短期放量。
210 国内 雷锋网 11:45 cn 72
顺心捷达接入支付宝AI“阿宝”,用户通过语音或文字即可完成大件寄件。
211 海外 AWS ML 23:57 实践 72
介绍两种用 AWS WAF 保护 Bedrock AgentCore Runtime 的架构模式。
212 海外 AWS ML 23:53 产品 72
Manage AI applications on Mac with Jamf’s AI Governance and Amazon Bedrock
Jamf与Amazon Bedrock集成,帮助企业在Mac设备上管理AI应用配置与合规。
213 Datawhale + 关注 22:59 实践 70
七月组队学习活动新增准大学生课程,共12个学习项目。
214 大叔的硅基茶 + 关注 14:08 行业 68
GMKtec EVO-X1 Pro升级HX 470处理器,但内存降级为LPDDR5,售价9999元。
215 半导体前沿 + 关注 14:08 行业 65
《中国半导体湿电子化学品年度报告2026》发布,提供行业深度分析。
216 半导体前沿 + 关注 14:08 会议 65
首届CMP与先进封装材料论坛2026年7月在苏州举办。
217 海外 Ars Technica AI 00:39 模型 65
Google updates Android Bench with new LLMs, but Gemini still lags behind
谷歌更新Android Bench基准,新增LLM评测,但Gemini仍落后。
218 一石一泉一松一月一人 + 关注 22:26 实践 65
过度独立并非成熟,而是创伤导致的自我保护。
219 一石一泉一松一月一人 + 关注 21:56 实践 65
生命是体验的奥秘,而非待解决的问题,顺流而行即得所需。
220 量子位 + 关注 12:16 行业 60
量子位招聘编辑作者,含实习岗,不设边界。
221 X X · List 01:05 模型 95
OpenAI maxed out the score in this coding competition scoring 4x higher than humans
OpenAI在编程竞赛中得分是人类的4倍,碾压人类选手。
222 X X · List 22:24 模型 92
Excited to share what we’ve been building at Meta Superintelligence Labs! Today we’re launching Muse Spark 1.1, our strongest model yet for complex ...
Meta发布最强AI模型Muse Spark 1.1,支持复杂代理工作流与多模态推理。
223 X X · List 22:02 模型 88
Meta发布Muse Spark 1.1模型升级,大幅提升智能体、编码、多模态和计算机使用能力,并推出Meta Model API公测。
224 X X · List 08:21 产品 88
I’ve been extremely impressed following the journey of Capable, visiting their lab space and chatting to the team - their turn around speed is mind b...
Capable 实验室实现24小时内从AI药物设计到数据产出,突破生物计算瓶颈。
225 X X · List 05:20 研究 88
推荐阅读:Pi工具链成本减半,GLM 5.2开源编码智能体性能飞跃。
226 X X · List 05:07 模型 88
Try our new model built jointly in collaboration with SpaceXAI It provides frontier coding and agentic performance at a much lower total cost. Beyond ...
SpaceXAI联合发布新模型,以更低成本实现前沿编码与智能体性能。
227 X X · List 03:36 模型 88
Grok 4.5: $2 in / $6 out GPT 5.6: $5 in / $30 out Opus 4.8: $5 in / $25 out Grok 4.5 seriously is freaking good price-performance wise. Opus 4.8 level...
Grok 4.5 以极低价格达到 Opus 4.8 水平,性价比突出。
228 X X · List 03:04 模型 88
Massive open-source release! LingBot-Video isn't about video quality; it optimizes for physical reasoning, and it runs sparse: only 3B of 30B params a...
首个面向具身智能的MoE视频基础模型LingBot-Video开源,30B参数仅3B激活。
229 X @emollick 02:32 产品 88
GPT新语音体验极佳,接近科幻级AI对话,结合Claude标签预示人机协作新范式。
230 X X · List 22:31 产品 85
We’ve been post-training a version of GLM that is trained to escalate to a frontier model inside the Computer harness. When paired with an advisor, t...
Perplexity发布新编排模型,基于GLM 5.2后训练,以低成本实现接近前沿性能。
231 X X · List 22:17 模型 85
we are zooming 📈
AI模型DeepSwe从10分跃升至53分,0.1版本更新带来惊人提升。
232 X X · List 22:00 模型 85
Meta发布Muse Spark 1.1,低价强性能的智能体与编码模型。
233 X X · List 22:00 模型 85
Meta发布Muse Spark 1.1,最强智能体与编程模型,低价可用。
234 X X · List 21:50 产品 85
typing into a phone or computer is painfully unnatural
语音交互将成AI应用主流,ChatGPT App更新带来突破性体验。
235 X @emollick 21:05 实践 85
Also this graph that shows what an "AI-pilled" startup looks like, and how uncommon it is even among startups: the answer when founders are asked "Wit...
AI初创公司中真正“AI化”的比例极低,多数创始人仍低估AI替代人力程度。
236 X X · List 18:48 产品 85
woah
用1920年代转盘电话连接AI代理,打造无干扰复古通讯设备。
237 X X · List 17:32 模型 85
I am so freaking ready to use GPT-5.6 Sol at 750 token/s Its release day friends. Get ready. Today is gonna be a great day!
GPT-5.6 Sol发布,速度达750 token/s,令人兴奋。
238 X X · List 17:19 模型 85
Incredible things are happening AtCoder 🔥
OpenAI 解决了 AtCoder 所有编程问题,AI 竞赛能力惊人。
239 X X · List 16:36 模型 85
Looks like Opus 5 is on its way. That was to be expected and foreseen, given that Fable 5 and Sonnet 5 have already been released and only Opus 5 is s...
Anthropic即将发布Opus 5模型,Fable 5和Sonnet 5已上线。
240 X X · List 16:34 实践 85
either you are at rock bottom or you are fucking around in a local maxima. there is no in between.
要么在谷底,要么困在局部最优,没有中间状态。
241 X X · List 16:16 模型 85
GPT-6预计四周内发布,规模更大、能力更强,验证了模型越大越智能的规律。
242 X X · List 14:37 研究 85
视频生成与世界理解相辅相成,压缩即预测即生成即理解,物理世界AI将带来巨大积极影响。
243 X X · List 14:04 行业 85
Prime Intellect 获1.3亿美元融资,打造开放超级智能栈。
244 X X · List 13:29 模型 85
GPT-5.6-Sol模型发布,低推理级别表现惊人。
245 X @emollick 12:01 研究 85
Managers, and their belief in the value of AI & how to use it, determines the value they actually get from AI. Neat paper looking at startups.
管理者对AI价值的信念决定其实际收益,一项针对初创企业的研究。
246 X X · List 10:24 行业 85
AI科技文章评分摘要
247 X @emollick 09:36 实践 85
AI生成图片可轻松伪造论文来源,提醒警惕虚假信息。
248 X X · List 09:01 产品 85
back at it 02:00AM kicked off a long-running task with Codex to review a few PRs and perform visual QA on some upcoming changes stepping back, the amo...
凌晨用Codex高效完成多项开发任务,极大减轻认知负担。
249 X X · List 08:27 产品 85
展示GPT-Live作为队友玩猜词游戏,体现快速对话与同时听说能力。
250 X X · List 08:07 模型 85
Grok 4.5 表现足够出色,值得专门做一期视频讲解。
251 X X · List 07:57 行业 85
AI模型进化,基准测试也需同步更新,评估领域正迎来最佳发展时机。
252 X @emollick 07:15 模型 85
Added Grok 4.5 to the Harbor Town Playable gallery. Here is it's "build me a procedurally generated 3D simulation showing the evolution of a harbor to...
Grok 4.5 生成港口小镇 3D 演化模拟,可交互控制。
253 X X · List 05:37 产品 85
Latency matters when running vision AI in real-world settings. Super excited to partner with Cloudflare to bring the fastest vision model to the cloud...
Moondream与Cloudflare合作,将最快视觉模型部署到云端边缘。
254 X X · List 05:31 模型 85
> Like it not, @Zai_org has set the standard for Chinese AI models. Beat it or you are not relevant, bc the next GLM model will be a lot better. No. I...
智谱GLM树立了中国AI模型标准,后续版本将更强,其他厂商面临挑战。
255 X X · List 05:18 产品 85
处理纯文本PDF时,用轻量OCR比重型VLM更高效准确。
256 X X · List 05:01 行业 85
马斯克提前布局Cursor,助力Grok-4.5重回前沿。
257 X X · List 03:47 模型 85
微软MSL团队发布Muse Image,一种能规划、写代码、使用搜索工具并自我优化的智能图像生成模型。
258 X X · List 03:45 模型 85
Grok 4.5 现已在 Hermes Agent 上线,可通过多个平台访问。
259 X X · List 03:42 研究 85
提出D2D审计方法,通过小容量模型揭示微调LLM中的隐藏偏见。
260 X X · List 03:21 模型 85
I never thought I'd be a foot guy, but comic 4 just had another update (4.2 if you're keeping track). LOOK AT THOSE FEET. monocular, single camera, go...
AI模型更新,单目相机实现逼真足部接触动画。
261 X X · List 03:13 模型 85
Grok 4.5 专为编程和智能体训练,性能领先且成本高效。
262 X X · List 03:04 产品 85
前MIT Scratch团队成员开发苏格拉底式AI助手并开源,旨在引导儿童深度思考而非被动消费。
263 X X · List 03:01 模型 85
🤖 From this week's issue: Liquid AI releases LFM2.5-230M, its smallest open-weight model yet, delivering 213 tok/s on a Galaxy S25 Ultra and outper...
Liquid AI发布最小开源模型LFM2.5-230M,性能超越更大模型。
264 X @emollick 02:54 产品 85
I often use Pinokio to download and work with local open source AI tools/models, and one neat thing is that it exposes them seamlessly to Code and Cod...
Pinokio 8 让本地 AI 模型无缝对接代码,替代付费 API。
265 X X · List 01:24 产品 85
Run AI workloads on any cloud, store on Hugging Face, no egress fees to worry about. @skypilot_org and @huggingface built this together: • Models and...
SkyPilot与Hugging Face合作,实现任意云运行AI工作负载并免去数据传输费。
266 X X · List 01:11 研究 85
介绍物理现实基准测试集,揭示视觉语言模型在基础物理理解上的缺陷。
267 X X · List 01:04 模型 85
字节跳动发布最强图像生成模型Seedream 5.0 Pro,支持精准编辑与多语言创作。
268 X X · List 00:25 行业 85
Qdrant反驳Elastic基准测试,称其未启用关键功能,实际性能更优。
269 X X · List 00:16 模型 85
If that’s true, crazy times lie ahead: GPT-6 at the end of the month or early August, and Fable 5.1 also on the verge of release. That would mean tim...
GPT-6 或将于月底或 8 月初发布,Fable 5.1 也即将推出,AI 模型迭代加速。
270 X X · List 00:14 模型 85
GPT-5.6-Sol在Next.js开发中表现优异,能理解架构权衡并修复复杂问题。
271 X X · List 00:13 行业 85
memory is pretty good business
内存业务利润丰厚,CXMT季度净利润达120亿美元。
272 X X · List 23:00 产品 85
Kling MCP和CLI正式上线,可在AI代理中直接调用,提升创作效率。
273 X X · List 22:51 模型 85
字节跳动Seed发布Seedream 5.0 Pro,在复杂信息处理上有重大改进。
274 X X · List 22:46 产品 85
agents for ad spend
Flint推出AI代理,自动优化Google Ads支出,提升转化率。
275 X X · List 21:29 实践 85
创业成功后的强度远超早期,且随规模增长而加剧。
276 X X · List 21:14 模型 85
and that's still the old Fable Anthropic is in their own tier right now
Anthropic的Fable模型在多数任务上超越GPT-5.6,更具代理能力。
277 X X · List 20:47 模型 85
I was expecting Kimi K3 to be the first 2-3T model I guess MiniMax M3 Pro at 2.7T will also do
MiniMax将发布2.7T参数开源模型M3 Pro,预计Q3推出。
278 X X · List 20:44 行业 85
looks like they'll exceed 11000 TWh this year at this rate maybe 8 MWh per capita About Austrian levels, long past EU average 1-2 more years to exceed...
中国今年发电量预计超11000TWh,人均8MWh,接近奥地利水平,远超欧盟平均。
279 X X · List 20:43 模型 85
yes they are preparing for the GPT-5.6 launch tomorrow max and ultra reasoning incoming
GPT-5.6 明日发布,将推出 Max 和 Ultra 推理模式。
280 X X · List 20:30 实践 85
AI让通才价值凸显,跨领域能力成为新优势。
281 X X · List 20:30 研究 85
动态编排模型实现接近SOTA性能,无需依赖单一供应商。
282 X X · List 20:24 实践 85
RTX 5090用户运行AI的68个常见问题与解决方案汇编。
283 X X · List 20:14 行业 85
From SemiAnalysis: Anthropic Q3 profit at over $1B Their base-case is that Anthropic will be the first 6 trillion dollar company
Anthropic Q3利润超10亿美元,预测将成为首家6万亿美元公司。
284 X X · List 20:10 模型 85
"I haven’t needed to check the code I’ve written in two months" looks like OpenAI had the model for a while
用户称两个月无需检查AI生成代码,暗示OpenAI模型已测试数月。
285 X X · List 20:04 模型 85
前OpenAI核心研究员Jerry Tworek表示,取代Transformer的第一步是理解其价值。
286 X X · List 18:28 实践 82
一位音乐人哥哥在作者帮助下用Codex无代码开发App,展现AI降低编程门槛的潜力。
287 X X · List 10:42 模型 82
团队称GPT-5.6虽非最聪明但极可靠好用,token用量激增5倍。
288 X X · List 09:58 行业 82
Modal CTO 谈如何构建弹性推理云和沙箱,优化开发者与智能体体验。
289 X X · List 03:02 模型 82
Cognition发布SWE-1.7模型,基于Kimi K2.7和RL改进,在代码合并基准上取得新进展。
290 X X · List 02:42 实践 82
随着AI进步,语音界面正从技术挑战变为产品选择。
291 X X · List 22:25 模型 78
Zuck is tweeting about the good model He’s in the game
扎克伯格发推宣传Muse Spark 1.1模型,强调其智能体性能和工具使用能力。
292 X X · List 17:06 实践 78
Codex团队提出用持续更新的摘要文档替代混乱的CoT总结,以跟踪长期目标状态。
293 X X · List 14:31 实践 78
早期GPT模型风格更可控,但如今提示技巧已失传,去AI味写作成难题。
294 X @emollick 12:37 模型 78
批评Grok 4.5缺乏模型卡,呼吁前沿模型公司发布详细测试结果。
295 X @emollick 12:13 模型 78
The metrics discussion at OpenAI is a little confusing to me. I appreciate the clarification about bad benchmarks, but they spent a lot of money devel...
OpenAI审计发现SWE-Bench Pro基准30%任务有缺陷,但未报告自家GDPval结果引发质疑。
296 X X · List 05:03 模型 78
➤ Pricing of $2/$6 per 1M tokens of input/output; cache hits are discounted by 75% to $0.5 per 1M tokens, and costs still double with long (>200k tok...
Grok 4.5 定价公布,输入输出每百万 token 2/6 美元,缓存命中降价75%,长输入成本翻倍。
297 X X · List 01:20 研究 78
NVIDIA研究员分享用合成数据桥接预训练与后训练推理差距的方法。
298 X X · List 00:22 产品 78
自家云代理新增支持Devin,并介绍基于Kimi K2.7的SWE-1.7模型在代码基准上的突破。
299 X X · List 00:14 会议 78
AI帮助制药团队从海量文献中提取蛋白质工程关键信息,提升研发效率。
300 X X · List 22:27 行业 75
亚马逊在AI竞争中意外落后,而Meta却通过烧钱实现逆袭。
301 X X · List 22:21 实践 75
担忧DeepSeek因自身贡献成为基础而患上NIH综合征,可能拒绝采纳更优方法。
302 X X · List 22:18 模型 75
Meta发布Muse Spark 1.1模型,加入Agent Arena评测平台。
303 X X · List 22:00 实践 75
VS Code 团队推出免费实操课程,助你掌握最新功能。
304 X X · List 21:48 行业 75
前DeepMind员工感叹谷歌AI人才流失严重,表现令人失望。
305 X X · List 19:24 实践 75
AI评估正变得日益复杂,需关注其方法演进。
306 X X · List 18:03 模型 75
GPT-5.6 had already been tested for two months. This makes it significantly more plausible that, according to rumors, GPT-6 will be released in four t...
GPT-5.6已测试两月,传闻GPT-6将在4-6周内发布。
307 X X · List 17:59 行业 75
Liquid AI 宣布其 LFM 模型在 Shopify 平台处理了 10 亿次请求,达成里程碑。
308 X X · List 17:07 研究 75
1999年UC Berkeley用侵入式电极重建猫视觉,引发对fMRI+AI改进的思考。
309 X X · List 16:21 实践 75
用户自发使用产品带来的满足感远超自上而下推广。
310 X X · List 16:20 实践 75
AI模型记忆存在近期偏见,且对用户不透明,影响对话质量。
311 X X · List 13:49 会议 75
知乎发起论文分享活动,鼓励科研人展示和推广自己的研究成果。
312 X X · List 13:31 模型 75
Grok 4.5 模型发布,性能表现良好。
313 X X · List 12:32 模型 75
Fable模型像深思熟虑的猫头鹰,GPT-5.6-Sol像咬住问题不放的罗威纳犬。
314 X X · List 10:28 实践 75
一位普通YouTuber使用“永久底层阶级”一词,暗示社会不平等加剧令人担忧。
315 X X · List 09:41 会议 75
谷歌在ICML2026展示图基础模型,可提升数据中心效率20%。
316 X X · List 09:39 会议 75
探讨多模态基础模型在真实分布偏移下的可靠性,并邀请在ICML2026展台交流。
317 X X · List 09:19 实践 75
现在很多有趣的软件都可以通过“氛围编程”轻松实现。
318 X X · List 09:17 行业 75
Called it
Theo认为xAI可能实现惊人逆袭,引发行业关注。
319 X X · List 05:42 会议 75
After mastering the digital realm, we’ll next need AI systems to engineer matter. Tomorrow, Dogus will walk through our recent progress at Periodic t...
AI系统需从数字领域扩展到物质工程,推动科学自动化。
320 X X · List 05:18 实践 75
xAI团队换血:从明星履历到年轻实干派,决策果断是关键。
321 X X · List 05:08 模型 75
模型为日常用途优化,推荐实际体验而非只看基准。
322 X X · List 03:40 模型 75
Mitchell Hashimoto 称 Sol 比 Fable 更快、效果更好,但仍会为特定调试任务使用 Fable。
323 X X · List 03:17 模型 75
DeepSWE 模型评分超 50,表现优秀。
324 X X · List 03:15 行业 75
AI巨头CEO多次声称‘没有中国供应链替代方案’,引发争议。
325 X X · List 03:01 行业 75
I believe that serving a model with higher margins off your compute as an AGI lab founder is cuckoldry. And frankly it's good enough that Elon could a...
xAI创始人称高利润卖模型是背叛,暗示Grok 4.5将改变格局。
326 X X · List 03:00 实践 75
探讨如何构建更细致的AI编码体验,涉及提示优化与评估集创建。
327 X X · List 02:44 行业 75
In other news…
AI新闻综述:Fable出口限制、Anthropic与阿里竞争、OpenAI政府持股等。
328 X X · List 01:20 行业 75
中国在AI后训练阶段仍落后于美国。
329 X X · List 01:08 实践 75
作者自嘲无法盲测区分主流AI模型,反映模型同质化现象。
330 X X · List 00:11 会议 75
7天语音AI挑战赛结果揭晓,38个作品让AI学会接电话。
331 X X · List 23:00 产品 75
OpenAI预告ChatGPT即将更新语音功能。
332 X X · List 22:48 产品 75
LangChain 周四发布 GPT-5.6 Sol 及 OpenWiki 重大更新,并举办网络研讨会。
333 X X · List 20:51 行业 75
Why are they forecasting without Fable?
分析机构预测Anthropic月处理量将大幅增长,但质疑其未考虑Fable的影响。
334 X X · List 21:50 实践 72
AI 自动化工作后,75% 时间花在手机点两因素认证上,求 MCP 工具。
335 X X · List 00:15 实践 72
作者兴奋地尝试用GPT-5.6和Fable 5组合的Executor-Advisor模式,效果更强,教程即将发布。
336 X X · List 22:23 行业 65
Hachi每日AI实验室动态,提及DS应收购Kimi的观点。
337 X X · List 22:18 产品 65
Re Test out Muse Spark 1.1 in Battle Mode and Agent Mode at: http://arena.ai
Muse Spark 1.1 上线竞技与智能体模式,可在线体验。
338 X X · List 22:00 实践 65
AI 发展前景未明,要么彻底失败要么强势回归,时间会给出答案。
339 X X · List 21:47 模型 65
Who’s post training a model to be funny ?
探讨如何通过后训练让AI模型变得幽默。
340 X X · List 18:39 模型 65
They’re distilling me into yapping about GLM today
GLM模型被蒸馏成闲聊话题,引发技术讨论。
341 X X · List 17:47 实践 65
作者吐槽自己的博客推文被AI圈密集发布淹没。
342 X X · List 16:26 模型 65
OpenAI 解决所有问题,Noam Brown 会心一笑。
343 X X · List 13:18 实践 65
common crawl? what about rare crawl, epic crawl, or legendary crawl?
调侃Common Crawl数据集名称,引发对数据稀缺性的思考。
344 X X · List 12:46 行业 65
有人重启Terra和Luna品牌,令人难以置信。
345 X @emollick 12:05 行业 65
AI领域长时间未出现重大突破,引发关注。
346 X X · List 10:53 实践 65
反思AI与人类心理问题,指出人类更需关注自身疯狂。
347 X X · List 10:43 模型 65
AI模型5.6版本声称能解决抑郁问题,引发讨论。
348 X X · List 10:19 行业 65
探讨拥有专属工程师团队能实现的目标,激发科技潜力想象。
349 X X · List 09:47 实践 65
呼吁对AI发展保持冷静理性态度
350 X X · List 08:29 实践 65
the end is nigh
AI末日论调再起,技术反思与行业警示。
351 X X · List 08:26 会议 65
7月16日奥斯汀vLLM线下聚会,技术分享与实操工作坊。
352 X X · List 08:24 模型 65
Grug 4.5's rugs
Grug 4.5 模型发布,展示其生成的地毯图案。
353 X X · List 08:11 会议 65
ICML 2026最后一天下午3:30将举办扩散模型讨论圈,欢迎参加。
354 X X · List 05:33 研究 65
AI研究员Ryota Kanai评论Anthropic论文,认为现象意识不可被科学工具触及。
355 X X · List 05:32 产品 65
AI生成内容出现意外搞笑错误,引发网友调侃。
356 X X · List 05:01 行业 65
推特用户调侃某AI公司内部训练15T参数模型,讽刺行业现状。
357 X X · List 03:30 产品 65
Brace OpenWiki 0.0.3 发布,修复大量 bug,新增兼容 OpenAI API 的提供商支持。
358 X X · List 02:59 产品 65
quick tasteful pigmented mandala generator from Grok Build
Grok Build 推出快速生成彩色曼陀罗图案的工具。
359 X X · List 02:42 实践 65
视频教程演示如何在60秒内设置Hermes Cloud代理。
360 X X · List 01:20 实践 65
深度工作来袭时,取消所有计划,专注到凌晨5点。
361 X X · List 22:57 行业 65
we have at least some equities booming now can we have a detente for half-price?
探讨中美股市分化与地缘紧张的关系。
362 X X · List 22:43 实践 65
It was fun to be on the Human by Design podcast with @Arjunjain (unbiased former co-worker of LeCun). We talked about everything including the roots o...
AI专家回顾1991年慕尼黑AI浪潮根源
363 X X · List 21:05 实践 65
开会坐相同位置避免“氛围缓存未命中”的幽默观察。
364 X X · List 20:59 实践 65
作者通过吃自家狗粮,按代理、阶段和工单类型展示产品功能。
365 X X · List 22:56 模型 60
HuggingFace上Goodfire账号发布新内容,值得关注。
366 X X · List 10:58 行业 45
两岁娃迷上《沙丘3》预告片中的沙虫,反复要求再看。
367 X X · List 09:18 实践 45
作者计划录制4个关于GPT-5.6的视频,向网友征集问题。
368 X X · List 08:05 实践 45
用户调侃Grok回复风格像机器人,简短生硬,但喜欢这种机械感。
369 X X · List 21:28 模型 45
用户因未提前体验GPT-5.6而自嘲为低品味模型用户
370 X X · List 01:19 行业 40
用户请求Anthropic恢复其批量处理任务。
371 X X · List 21:53 实践 30
作者提议将最强AI模型命名为GPT-5.6-Terra,并类比战锤与ASI。
372 X X · List 16:35 会议 20
扩散圈聚会结束,感谢参与,下次再见。
373 X X · List 12:59 行业 15
用户分享首次抽到泡泡玛特隐藏款,竟是老奶奶角色。
374 X X · List 14:59 行业 10
周四问候,AI聊天社区日常互动。
375 X X · List 00:16 行业 10
作者分享从家乡返回柏林的行踪与照片。